Glossar
Sprachmodell
Ein Sprachmodell ist ein Modell, dessen Training speziell auf menschliche Sprache ausgerichtet ist: Es lernt anhand riesiger Mengen an Text, wie wahrscheinlich verschiedene Wörter oder Wortfolgen in einem gegebenen Zusammenhang sind, und nutzt das, um Text Stück für Stück fortzusetzen, etwa als Antwort auf eine Frage.
Sein Input ist Text, sein unmittelbarer Output aber nicht: Er ist eine Score-Liste über alle Textstücke, die es kennt. Text entsteht daraus erst durch einen Auswahlschritt und eine Schleife.
Ein Beispiel: Du gibst einem Chatbot den Text „Die Katze sitzt“. Das Sprachmodell dahinter liefert nicht sofort eine fertige Antwort. Es gibt für jedes Textstück (Token), das es kennt, einen Score aus, wie gut dieses Stück als Nächstes passt. Ein Auswahlschritt nimmt etwa „auf“, hängt es an, und der längere Text geht wieder hinein. So entsteht die Antwort Stück für Stück.
Nicht verwechseln mit einem Chatbot: Der Chatbot ist die Anwendung, in die du schreibst. Das Sprachmodell ist das Modell darin, das die Scores berechnet. Der bisherige Gesprächsverlauf wird jedes Mal wieder als Input mitgeschickt. Durch dein Gespräch ändert sich das Sprachmodell selbst nicht, seine Parameter bleiben stehen, bis jemand neu trainiert.
Wo du dem Begriff begegnest: In Berichten über KI-Chatbots, oft als „großes Sprachmodell“ oder englisch Large Language Model, kurz LLM. Auch auf dem Handy: Die Wortvorschläge über manchen Tastaturen, etwa Gboard, stammen aus einem Sprachmodell, und auf manchen Geräten läuft ein kleineres Sprachmodell direkt auf dem Gerät. Anbieter rechnen die Nutzung von Sprachmodellen zudem meist pro Token ab.
Eingeführt in „Input und Output: Was eine Funktion tut“.