Qu'est-ce que Diffusion Model ?
Il s’agit d’une méthode d’intelligence artificielle qui produit des images nettes et significatives à partir de données bruitées.
Définition
Les modèles de diffusion sont des systèmes d’intelligence artificielle générative capables de créer des images significatives à partir d’un bruit aléatoire, c’est-à-dire un écran picotant. Il apprend en nettoyant les données étape par étape et révèle finalement l'image souhaitée.
Comment ça marche
Pendant l'entraînement, le modèle ajoute progressivement du bruit aux images, les rendant complètement floues. Puis il apprend à inverser ce processus ; c'est-à-dire qu'il reconstruit l'image originale à partir d'un ensemble de points bruités.
Où est-ce utilisé
DALL-E est utilisé dans des outils de rendu tels que Midjourney et Stable Diffusion.
Souvent confondu avec
Il est confondu avec le GAN (Generative Adversarial Networks), mais les modèles de diffusion produisent des résultats plus stables et de meilleure qualité.
Questions fréquentes
Est-ce qu'il ne produit que des images ?
Il est principalement axé sur le visuel mais peut également être adapté pour la production audio et vidéo.
Pourquoi nécessite-t-il autant de puissance de traitement ?
Construire l’image étape par étape nécessite une puissance de traitement intense car elle nécessite un calcul mathématique de millions de pixels.
Termes liés
This explanation was written in plain language for TreScout · translated from the Turkish original. If something looks wrong or missing, write to hello@trescout.com. Read in Turkish →