Large Language Model (LLM)
Ein Large Language Model (LLM) ist ein großes Sprachmodell, das mit enormen Textmengen trainiert wurde. Es erzeugt Text, indem es Stück für Stück das wahrscheinlich nächste Textstück vorhersagt.
Auch bekannt als: Sprachmodell · Large Language Model
So funktioniert das
Ein LLM wird mit sehr großen Textmengen trainiert und lernt dabei statistische Muster der Sprache. Bei einer Anfrage berechnet es Stück für Stück, welches Textstück (Token) am wahrscheinlichsten als Nächstes folgt — so entstehen ganze Antworten. Es „weiß“ Dinge nur insofern, als sie sich in diesen Mustern niedergeschlagen haben. Bekannte Modellfamilien sind GPT, Claude, Gemini, Llama und Mistral.
Beispiel aus der Praxis
Du gibst einem LLM die E-Mail eines Kunden und die Bitte, eine höfliche Antwort zu entwerfen. Das Modell formuliert einen Text, der zu Anliegen und Ton passt — ohne dass du Regeln für jeden Einzelfall schreiben musst.
Das solltest du wissen
- Ein LLM ist kein Nachschlagewerk: Es kann überzeugend falsch liegen (siehe Halluzination).
- Sein Wissen endet mit dem Trainingsstand. Aktuelle oder interne Informationen musst du ihm mitgeben, zum Beispiel per RAG.
- Modelle unterscheiden sich stark bei Qualität, Geschwindigkeit, Kosten und Datenschutz. Welches passt, hängt von der Aufgabe ab.
Passende Werkzeuge