← Glossar
Glossar · AI

Was ist Diffusion Model?

Dabei handelt es sich um eine Methode der künstlichen Intelligenz, die aus verrauschten Daten saubere und aussagekräftige Bilder erzeugt.

Definition

Diffusionsmodelle sind generative künstliche Intelligenzsysteme, die aus zufälligem Rauschen aussagekräftige Bilder, also einen prickelnden Bildschirm, erzeugen können. Es lernt, indem es die Daten Schritt für Schritt bereinigt und schließlich das gewünschte Bild zum Vorschein bringt.

Analogie: Es ist, als würde ein Bildhauer langsam den Überschuss von einem Marmorblock entfernen und die Skulptur im Inneren freilegen. Das Modell erkennt Muster im Rauschen und verdeutlicht sie.

So funktioniert es

Während des Trainings fügt das Modell den Bildern nach und nach Rauschen hinzu, wodurch sie völlig unscharf werden. Dann lernt er, diesen Prozess umzukehren; das heißt, es rekonstruiert das Originalbild aus einer verrauschten Menge von Punkten.

Wo es eingesetzt wird

DALL-E wird in Rendering-Tools wie Midjourney und Stable Diffusion verwendet.

Häufig verwechselt mit

Es wird mit GAN (Generative Adversarial Networks) verwechselt, aber Diffusionsmodelle liefern stabilere und qualitativ hochwertigere Ergebnisse.

Häufige Fragen

Produziert es nur Bilder?

Es ist in erster Linie visuell fokussiert, kann aber auch für die Audio- und Videoproduktion angepasst werden.

Warum ist so viel Rechenleistung erforderlich?

Der schrittweise Aufbau des Bildes erfordert eine hohe Rechenleistung, da eine mathematische Berechnung von Millionen von Pixeln erforderlich ist.

Verwandte Begriffe

Diese Erklärung wurde für TreScout in einfacher Sprache verfasst und maschinell übersetzt aus dem türkischen Original · maßgeblich ist die türkische Fassung. Wenn etwas falsch oder unvollständig wirkt, schreiben Sie an hello@trescout.com. Auf Türkisch lesen →