Generative AI & LLMs intermediate

Diffusion Model

The architecture behind most AI image and video generation: start from noise, remove it step by step.

Ein Diffusionsmodell wird darauf trainiert, einen Verrauschungsprozess umzukehren. Aus reinem Rauschen und einem Text-Prompt entrauscht es Schritt für Schritt, bis ein Bild entsteht, das zum Prompt passt. Es hat GANs als Standard abgelöst, weil es stabiler trainiert und besser skaliert.

In der Praxis: Fünfzig Entrauschungsschritte zwischen zufälligem Rauschen und einer fertigen Illustration.