Beantwortet von der Redaktion von Business.Digital Stand
Der Latent Space, auf Deutsch der latente oder verborgene Raum, ist der mathematische Raum, in dem ein KI-Modell Daten in komprimierter Form repräsentiert. Statt mit rohen Pixeln oder Texten zu arbeiten, bilden viele Modelle eine interne Repräsentation ab, die die wesentlichen Eigenschaften der Daten in weniger Dimensionen erfasst.
Stell dir vor, du musst ein Bild eines Hundes so beschreiben, dass jemand es rekonstruieren kann. Du könntest alle 1 Million Pixelwerte nennen, oder du sagst: “Labrador, braun, sitzend, Frontansicht, natürliches Licht.” Diese kompakte Beschreibung ist das, was der Latent Space tut, nur in Zahlenform.
Wie wird der Latent Space genutzt?
Autoencoder-Architekturen komprimieren Input in einen Latent Space (Encoder) und rekonstruieren ihn aus diesem (Decoder). VAEs (Variational Autoencoders) und der Latent Space von Stable Diffusion funktionieren nach ähnlichem Prinzip. Bildgeneratoren produzieren Bilder, indem sie im Latent Space navigieren.
Eine der merkwürdigsten Eigenschaften: Im Latent Space kann man “rechnen”. Bei Bildmodellen kann man zwischen zwei Punkten im Latent Space interpolieren und erhält glatte Übergänge zwischen zwei Bildern. Bei Sprachmodellen liegt “König minus Mann plus Frau ≈ Königin” im Latent Space nahe.
Was bedeutet das für das Verstehen von KI?
Der Latent Space erklärt, warum generative Modelle Bilder oder Texte produzieren können, die so wirken als verstünden sie die Bedeutung. Das Modell hat eine interne Repräsentation von “Bedeutung” gelernt, auch wenn diese rein mathematisch ist.
Es erklärt auch, warum kleine Änderungen im Input manchmal große Änderungen im Output produzieren: Man bewegt sich durch den Latent Space und trifft dabei auf andere Regionen. Für den Unternehmenseinsatz von KI ist das Konzept vor allem nützlich, um Möglichkeiten und Grenzen generativer Systeme zu verstehen. Mehr in einer KI-Beratung.