Diffusion Model
The architecture behind most AI image and video generation: start from noise, remove it step by step.
Um modelo de difusão é treinado para reverter um processo de adição de ruído. Dado um chuvisco puro e um prompt de texto, ele remove ruído iterativamente até emergir uma imagem que corresponde ao prompt. Substituiu as GANs como padrão porque treina de forma mais estável e escala melhor.
Na prática: Cinquenta passos de remoção de ruído entre um chuvisco aleatório e uma ilustração pronta.