← Glossaire
Glossaire · AI

Qu'est-ce que Diffusion Model ?

Il s’agit d’une méthode d’intelligence artificielle qui produit des images nettes et significatives à partir de données bruitées.

Définition

Les modèles de diffusion sont des systèmes d’intelligence artificielle générative capables de créer des images significatives à partir d’un bruit aléatoire, c’est-à-dire un écran picotant. Il apprend en nettoyant les données étape par étape et révèle finalement l'image souhaitée.

Analogie : C'est comme un sculpteur retirant lentement l'excédent d'un bloc de marbre et révélant la sculpture à l'intérieur. Le modèle découvre des modèles de bruit et les clarifie.

Comment ça marche

Pendant l'entraînement, le modèle ajoute progressivement du bruit aux images, les rendant complètement floues. Puis il apprend à inverser ce processus ; c'est-à-dire qu'il reconstruit l'image originale à partir d'un ensemble de points bruités.

Où est-ce utilisé

DALL-E est utilisé dans des outils de rendu tels que Midjourney et Stable Diffusion.

Souvent confondu avec

Il est confondu avec le GAN (Generative Adversarial Networks), mais les modèles de diffusion produisent des résultats plus stables et de meilleure qualité.

Questions fréquentes

Est-ce qu'il ne produit que des images ?

Il est principalement axé sur le visuel mais peut également être adapté pour la production audio et vidéo.

Pourquoi nécessite-t-il autant de puissance de traitement ?

Construire l’image étape par étape nécessite une puissance de traitement intense car elle nécessite un calcul mathématique de millions de pixels.

Termes liés

Cette explication a été rédigée en langage clair pour TreScout puis traduite automatiquement depuis l’original turc · la version turque fait foi. Si quelque chose vous semble erroné ou manquant, écrivez à hello@trescout.com. Lire en turc →