Zum Inhalt springen
Strategie-Call buchen

Begriff

Begriff: Sprachmodell, Token, Kontextfenster

Drei Begriffe, die erklären, wie Sprachmodelle arbeiten und warum ihre Antworten Grenzen haben.

Ein großes Sprachmodell (LLM) ist ein Programm, das aus riesigen Textmengen gelernt hat, wahrscheinliche Fortsetzungen von Text zu berechnen. Daraus entstehen Antworten, Zusammenfassungen und Entwürfe. Es versteht Inhalte nicht wie ein Mensch, kann aber Muster in Sprache sehr gut nutzen.

Ein Token ist die Einheit, in der ein Modell Text verarbeitet. Das kann ein Wort, ein Wortteil oder ein Zeichen sein. Im Deutschen ergeben lange zusammengesetzte Wörter oft mehrere Token. Abgerechnet wird bei vielen Anbietern nach der Zahl der verarbeiteten Token.

Das Kontextfenster ist die Textmenge, die ein Modell auf einmal berücksichtigen kann: Ihre Frage, mitgegebene Dokumente und die bisherige Unterhaltung. Was darüber hinausgeht, wird nicht beachtet.

  • Ein Modell kann sich irren und dabei überzeugend klingen.
  • Es kennt nur Inhalte aus dem Training und aus dem, was Sie ihm mitgeben.
  • Gleiche Fragen können leicht unterschiedliche Antworten liefern.

Daraus folgt: Geben Sie relevanten Kontext mit, prüfen Sie wichtige Aussagen und nutzen Sie Modelle als Entwurfshilfe, nicht als alleinige Quelle für Fakten.

Zur Übersicht

Verwandt

Mehr zu Sprachmodelle