Ein LLM (Large Language Model, großes Sprachmodell) ist ein KI-Modell, das an enormen Textmengen trainiert wurde und auf dieser Grundlage Sprache verarbeitet und erzeugt: Es beantwortet Fragen, fasst zusammen, übersetzt, formuliert und schreibt Code. Im Kern tut das Modell dabei immer dasselbe: Es berechnet, welches Wortstück (Token) am wahrscheinlichsten als Nächstes folgt, und reiht Milliarden solcher Vorhersagen zu flüssigen Antworten.
Das „Large" bezieht sich auf die Dimensionen: Milliarden interner Parameter, Trainingsdaten im Umfang großer Teile des öffentlichen Internets, erheblicher Rechenaufwand. Bekannte Modellfamilien sind etwa GPT (OpenAI), Claude (Anthropic), Gemini (Google) und Llama (Meta). Zu unterscheiden ist das Modell von der Anwendung darauf: ChatGPT ist ein Produkt, GPT das Sprachmodell darunter; dieselben Modelle stecken per Schnittstelle (API) auch in Firmensoftware.
Die Grenzen ergeben sich aus dem Funktionsprinzip: Der Wissensstand endet mit den Trainingsdaten, und wo Wissen fehlt, liefert das Modell mitunter eine plausibel klingende Erfindung statt einer Lücke.