Modelo de difusión

Un modelo de difusión es un tipo de modelo de La IA generativa crea contenido nuevo —texto, imágenes, audio o código— a partir de una instrucción, en vez de solo analizar datos existentes. Más en el glosario → que se usa sobre todo para crear imágenes, aunque también audio o vídeo. Su funcionamiento es curioso: durante el entrenamiento aprende a invertir un proceso que va añadiendo «ruido» (manchas aleatorias) a una imagen hasta destruirla por completo. Ya entrenado, hace justo lo contrario: parte de puro ruido aleatorio y lo va limpiando poco a poco, en muchos pasos, hasta que de ese caos emerge una imagen nítida y coherente. Cuando se combina con texto, una indicación escrita guía ese proceso para que el resultado se ajuste a lo que pedimos. Es la tecnología que hay detrás de generadores de imágenes muy conocidos como Stable Diffusion, DALL·E o Midjourney. Los modelos de difusión han desplazado en gran medida a técnicas anteriores por la calidad y el realismo de sus resultados, y son una pieza central del auge reciente de la IA generativa.