Generative AI & LLMs intermediate

Diffusion Model

The architecture behind most AI image and video generation: start from noise, remove it step by step.

Um modelo de difusão é treinado para reverter um processo de adição de ruído. Dado um chuvisco puro e um prompt de texto, ele remove ruído iterativamente até emergir uma imagem que corresponde ao prompt. Substituiu as GANs como padrão porque treina de forma mais estável e escala melhor.

Na prática: Cinquenta passos de remoção de ruído entre um chuvisco aleatório e uma ilustração pronta.