GPT steht für Generative Pre-trained Transformer und bezeichnet die Sprachmodellfamilie von OpenAI. Die drei Namensteile beschreiben das Modell vollständig: Es erzeugt Text, es wurde in einem aufwendigen Vortraining auf großen Textmengen allgemein trainiert, und es beruht auf der Transformer-Architektur. Nach dem Vortraining folgt eine Feinabstimmung, unter anderem mit menschlichem Feedback, die das Modell auf hilfreiche und sichere Antworten ausrichtet.
Die Reihe entwickelte sich seit 2018 über mehrere Generationen, die sich in Größe, Kontextfenster, Multimodalität und Antwortqualität unterscheiden. Angesprochen wird GPT entweder über Produkte wie ChatGPT oder direkt über die API, was die Einbindung in eigene Anwendungen erlaubt.
Bei der Nutzung über die Schnittstelle rechnen Anbieter üblicherweise nach Token ab, getrennt nach Ein- und Ausgabe, weshalb lange Kontexte unmittelbar auf die Kosten durchschlagen. Konkrete Modellnamen, Preise und Leistungsdaten veralten schnell und gehören nur mit Datumsangabe in eine Dokumentation.