Generative AI & LLMs intermediate

Diffusion Model

The architecture behind most AI image and video generation: start from noise, remove it step by step.

Un modello di diffusione è addestrato a invertire un processo di aggiunta di rumore. Partendo da puro disturbo e da un prompt testuale, rimuove il rumore in modo iterativo finché non emerge un’immagine che corrisponde al prompt. Ha sostituito le GAN come impostazione predefinita perché si addestra in modo più stabile e scala meglio.

In pratica: Cinquanta passaggi di rimozione del rumore tra un disturbo casuale e un’illustrazione finita.