Diffusionsmodell
Ein Diffusionsmodell ist eine Art generatives KI Künstliche Intelligenz ist die Fähigkeit eines Computersystems, Aufgaben zu erledigen, die wir mit menschlicher Intelligenz verbinden – etwa Sprache verstehen, Bilder erkennen oder Entscheidungen treffen. Mehr im Glossar → -Modell, das vor allem zum Erzeugen von Bildern dient, aber auch für Audio oder Video. Seine Funktionsweise ist eigentümlich: Beim Training lernt es, einen Vorgang umzukehren, der einem Bild immer mehr „Rauschen" (zufällige Flecken) hinzufügt, bis es völlig zerstört ist. Fertig trainiert macht es genau das Gegenteil: Es startet von reinem Zufallsrauschen und säubert es Schritt für Schritt in vielen Durchgängen, bis aus diesem Chaos ein scharfes, stimmiges Bild hervorgeht. In Kombination mit Text lenkt eine geschriebene Eingabe diesen Prozess, damit das Ergebnis dem entspricht, was wir verlangt haben. Es ist die Technik hinter bekannten Bildgeneratoren wie Stable Diffusion, DALL·E oder Midjourney. Diffusionsmodelle haben ältere Verfahren wegen der Qualität und des Realismus ihrer Ergebnisse weitgehend verdrängt und sind ein zentraler Baustein des jüngsten Aufschwungs der generativen KI.