Ein Large Language Model (LLM, deutsch „großes Sprachmodell") ist ein KI-Modell, das auf riesigen Mengen an Text trainiert wurde und darauf spezialisiert ist, menschliche Sprache zu verstehen und zu erzeugen. LLMs sind die Technologie hinter Werkzeugen wie ChatGPT und bilden das Herzstück der generativen KI-Welle. Ihre Kernfähigkeit klingt erstaunlich einfach: Sie sagen voraus, welches Wort – genauer: welcher Sprachbaustein – als Nächstes am wahrscheinlichsten folgt. Aus dieser scheinbar simplen Aufgabe entsteht, im riesigen Maßstab und mit gewaltigen Datenmengen trainiert, die Fähigkeit, flüssige Texte zu schreiben, Fragen zu beantworten, zu übersetzen und zu programmieren.
Das „Large" im Namen ist wörtlich zu nehmen: Diese Modelle bestehen aus Milliarden von Parametern – den intern gelernten Stellschrauben – und wurden mit einem großen Teil des öffentlich verfügbaren Textes trainiert. Genau diese Größe erklärt sowohl die beeindruckenden Fähigkeiten als auch die charakteristischen Schwächen.
Wie ein LLM funktioniert
Im Kern arbeitet ein LLM mit Wahrscheinlichkeiten. Es zerlegt Text in kleine Einheiten, sogenannte Token – das können ganze Wörter, Wortteile oder Zeichen sein. Auf Basis des bisherigen Textes berechnet das Modell, welches Token als Nächstes am wahrscheinlichsten ist, wählt es aus, hängt es an und wiederholt den Vorgang. So entsteht Wort für Wort eine Antwort. Die zugrundeliegende Architektur heißt „Transformer" und erlaubt es dem Modell, weit auseinanderliegende Teile eines Textes in Beziehung zu setzen – der Grund, warum LLMs Kontext über längere Passagen halten können.
Entscheidend für das Verständnis: Ein LLM „weiß" nichts im menschlichen Sinne und schlägt nichts nach. Es erzeugt die statistisch plausibelste Fortsetzung. Das erklärt, warum es oft brillant und manchmal selbstbewusst falsch ist.
Was LLMs können – und was nicht
| Stärken | Schwächen |
|---|---|
| Flüssige, kontextbezogene Texte erzeugen | Erfinden plausibel klingende Falschaussagen (Halluzinationen) |
| Zusammenfassen, übersetzen, umformulieren | Kein verlässliches Faktenwissen, kein echtes „Verstehen" |
| Code schreiben und erklären | Wissen endet am Trainingsdatenstand |
| Auf natürliche Sprache reagieren | Können bei Mathematik und Logik patzen |
Der wichtigste Fallstrick ist die Halluzination: das überzeugende Erfinden von Fakten, Quellen oder Zahlen, die es nicht gibt. Weil ein LLM auf Plausibilität optimiert ist, nicht auf Wahrheit, klingt eine falsche Antwort oft genauso souverän wie eine richtige. Deshalb gilt: LLM-Ausgaben in kritischen Kontexten immer prüfen.
Ein konkretes Beispiel
Ein Unternehmen möchte aus langen Kundenbewertungen schnell die wichtigsten Kritikpunkte herausziehen. Früher hätte das jemand manuell durchlesen müssen. Mit einem LLM gibt man die Bewertungen ein und bittet das Modell, die häufigsten Kritikpunkte gegliedert zusammenzufassen. In Sekunden liefert es eine brauchbare Übersicht. Der Mitarbeiter prüft sie – stichprobenartig gegen die Originale – und arbeitet damit weiter. Das LLM hat die Bewertungen nicht „verstanden", aber die sprachlichen Muster zuverlässig genug erfasst, um echte Arbeit abzunehmen. Dieser Dreischritt aus Eingabe, schneller Verarbeitung und menschlicher Prüfung ist das typische Muster eines sinnvollen LLM-Einsatzes.
LLMs im Unternehmen einsetzen
Damit ein LLM über allgemeine Antworten hinaus auf das eigene Unternehmen passt, gibt es mehrere Wege. Per Prompt (der Eingabe-Anweisung) lässt sich das Verhalten unmittelbar steuern. Mit Retrieval-Augmented Generation (RAG) bindet man eigene Dokumente an, sodass das Modell auf geprüftem Firmenwissen antwortet, statt frei zu assoziieren – oft über eine Vektordatenbank umgesetzt. Und durch Fine-Tuning lässt sich ein Modell auf spezielle Aufgaben weitertrainieren. Welcher Weg passt, hängt vom Anwendungsfall, der Datenlage und dem Budget ab – für viele Fälle reicht ein gut formulierter Prompt plus Anbindung eigener Daten.
Datenschutz und Verantwortung
Weil LLMs oft als Cloud-Dienst laufen und mit Unternehmensdaten gefüttert werden, sind Datenschutz und Vertraulichkeit zentrale Fragen. Wohin fließen die eingegebenen Daten, werden sie zum Training genutzt, wie lässt sich sensibles Material schützen? Seriöse Einführungen klären das vorab. Eine gut verständliche, technisch fundierte Einführung in die Funktionsweise und Risiken großer Sprachmodelle bietet das BSI zu generativen KI-Modellen.
Einordnung
Das Large Language Model ist die Schlüsseltechnologie der aktuellen KI-Welle: ein erstaunlich vielseitiges Sprachwerkzeug, das vieles kann, was vorher Menschen vorbehalten war – aber kein Wissensspeicher und kein Wahrheitsgarant. Sein Nutzen entfaltet sich dort, wo man seine Stärke (Sprache verarbeiten) gezielt einsetzt und seine Schwäche (Fakten erfinden) durch Prüfung und Anbindung an verlässliche Daten abfängt. Wer LLMs mit dieser realistischen Erwartung einsetzt, gewinnt ein mächtiges Werkzeug; wer ihnen blind vertraut, handelt sich Probleme ein.