Künstliche Intelligenz

Embedding

Die Umwandlung von Text oder Bild in eine Zahlenreihe, mit der ein Computer Ähnlichkeit berechnen kann.

Einfach erklärt

Ein Embedding-Modell stellt Text durch eine Zahlenreihe dar. Damit lassen sich unter anderem inhaltlich ähnliche Texte suchen; wie gut die Ähnlichkeit erfasst wird, hängt vom Modell ab. „Urlaub" und „Ferien" landen dicht beieinander, „Urlaub" und „Steuererklärung" weit auseinander. Das ist die Grundlage vieler Suchfunktionen.

Nähe im Zahlenraum bedeutet thematische Ähnlichkeit, nicht Wahrheit und nicht Anonymität. Eine Suche findet passende Absätze, prüft aber nicht deren Richtigkeit. Aus Embeddings lassen sich Inhalte teilweise rekonstruieren – sie ersetzen kein echtes Schwärzen sensibler Stellen.

Beispiel aus dem Alltag

Du suchst intern nach „Ferien", das System zeigt auch einen Abschnitt, in dem nur „Urlaub" steht.

Häufige Fragen

  • Sind Embeddings anonym?

    Nein. Aus ihnen lassen sich Inhalte teils rekonstruieren. Sie ersetzen kein Schwärzen und keine Zugriffsregeln für sensible Texte.

Wie aus Übungen ein fortlaufendes Training wird: medienkundigs Lernzyklus kennenlernen.

Weiterlesen

Passend dazu