Modelo de difusão

Um modelo de difusão é um tipo de modelo de A IA generativa cria conteúdo novo — texto, imagens, áudio ou código — a partir de uma instrução, em vez de apenas analisar dados já existentes. Mais no glossário → usado sobretudo para criar imagens, mas também áudio ou vídeo. O seu funcionamento é curioso: durante o treinamento, aprende a inverter um processo que vai acrescentando cada vez mais «ruído» (manchas aleatórias) a uma imagem até destruí-la por completo. Já treinado, faz exatamente o contrário: parte de puro ruído aleatório e vai limpando-o aos poucos, em muitos passos, até que desse caos surja uma imagem nítida e coerente. Quando combinado com texto, uma instrução escrita guia esse processo para que o resultado corresponda ao que pedimos. É a tecnologia por trás de geradores de imagens muito conhecidos como Stable Diffusion, DALL·E ou Midjourney. Os modelos de difusão substituíram em grande parte as técnicas anteriores pela qualidade e pelo realismo dos seus resultados, e são uma peça central do recente crescimento da IA generativa.