Diffusion Model
The architecture behind most AI image and video generation: start from noise, remove it step by step.
Ein Diffusionsmodell wird darauf trainiert, einen Verrauschungsprozess umzukehren. Aus reinem Rauschen und einem Text-Prompt entrauscht es Schritt für Schritt, bis ein Bild entsteht, das zum Prompt passt. Es hat GANs als Standard abgelöst, weil es stabiler trainiert und besser skaliert.
In der Praxis: Fünfzig Entrauschungsschritte zwischen zufälligem Rauschen und einer fertigen Illustration.