Диффузионная модель (diffusion model) — это генеративная архитектура, которая учится создавать новые данные, поэтапно «очищая» шум до осмысленного изображения или текста. Такие модели лежат в основе инструментов вроде DALL-E 3, Stable Diffusion и Midjourney. Они отличаются от GAN тем, что используют процесс постепенного восстановления данных, а не состязание двух сетей.
Пример
Stable Diffusion применяет диффузионную модель для генерации картин по текстовому описанию. Пользователь вводит промпт, а модель поэтапно преобразует шум в изображение.