Glossar

LLM (Large Language Model): Definition und Funktionsweise

Ein LLM ist ein auf sehr großen Textmengen trainiertes Sprachmodell, das das jeweils nächste Wort vorhersagt. Was das praktisch bedeutet.

Erstgespräch vereinbaren +49 174 164 5727

LLM (Large Language Model): Definition und Funktionsweise

Ein Large Language Model (LLM) ist ein auf sehr großen Textmengen trainiertes Sprachmodell, das gelernt hat, den jeweils wahrscheinlichsten nächsten Textbaustein vorherzusagen. Aus dieser einen Grundfähigkeit ergeben sich alle sichtbaren Leistungen: Zusammenfassen, Übersetzen, Formulieren, Klassifizieren und Beantworten von Fragen. Ein LLM bildet damit die technische Basis für Werkzeuge wie ChatGPT, Claude oder Gemini.

Funktionsweise

Das Modell zerlegt Text in Token (Wortbausteine) und berechnet für jeden möglichen nächsten Token eine Wahrscheinlichkeit. Es wählt einen aus, hängt ihn an und wiederholt den Vorgang — Wort für Wort. Trainiert wird diese Fähigkeit an riesigen Textkorpora aus dem Internet, Büchern und Fachtexten. Wie viel das Modell in einer Anfrage gleichzeitig verarbeiten kann, begrenzt das Kontextfenster.

Warum das wichtig zu wissen ist

Ein LLM weiß nichts im eigentlichen Sinn. Es erzeugt Text, der zu dem passt, was es gelernt hat. Deshalb klingen falsche Antworten genauso überzeugend wie richtige — der Mechanismus ist derselbe. Diese frei erfundenen, aber plausibel formulierten Aussagen heißen Halluzinationen. Wer das verstanden hat, prüft Ergebnisse dort nach, wo Fakten zählen.

Praktische Folgerungen

  • Kontext schlägt Prompting. Ein Modell mit den richtigen Hintergrundinformationen liefert bessere Ergebnisse als ein raffiniert formulierter Prompt ohne.
  • Aktualität ist begrenzt. Das Trainingswissen hat einen Stichtag. Aktuelle Informationen kommen nur über angebundene Suche oder eigene Dokumente (RAG) hinein.
  • Rechnen ist nicht die Stärke. Zahlenarbeit gehört in ein Werkzeug, das rechnet, nicht in ein Modell, das Text vorhersagt.

LLM und KI — die Abgrenzung

Künstliche Intelligenz ist der Oberbegriff für alle Verfahren, die menschenähnliche Aufgaben lösen. Ein LLM ist eine bestimmte Bauform davon, spezialisiert auf Sprache. Andere KI-Bauformen erkennen Bilder oder steuern Maschinen — das können LLM nicht.

Bekannte Modelle

ModellAnbieterLandBesonderheit
GPTOpenAIUSAgrößtes Ökosystem
ClaudeAnthropicUSAlange Dokumente, Facharbeit
GeminiGoogleUSAtief in Google-Dienste integriert
MistralMistral AIFrankreicheuropäischer Anbieter, offene Modelle
LlamaMetaUSAoffen, lokal betreibbar

Offene Modelle wie Llama oder Mistral lassen sich auf eigener Hardware betreiben. Ihre Qualität liegt unter den größten kommerziellen Modellen, reicht für viele Aufgaben aber aus — und die Daten verlassen das Haus nicht. Welches Modell zu welchem Anwendungsfall passt, klärt unsere KI-Beratung.

Häufige Fragen

Was ist der Unterschied zwischen LLM und KI?

KI ist der Oberbegriff für alle Verfahren, die menschenähnliche Aufgaben lösen. Ein LLM ist eine bestimmte Bauform davon, spezialisiert auf Sprache.

Kann man ein LLM selbst betreiben?

Offene Modelle ja, auf eigener Hardware. Die Qualität liegt unter den größten kommerziellen Modellen, reicht für viele Aufgaben aber aus.

Wie funktioniert ein LLM?

Es zerlegt Text in Token, berechnet für jeden möglichen nächsten Token eine Wahrscheinlichkeit und hängt den gewählten an — Wort für Wort. Trainiert wird das an riesigen Textkorpora aus Internet, Büchern und Fachtexten.

Warum machen LLMs Fehler?

Weil sie nichts im eigentlichen Sinn wissen, sondern Text erzeugen, der zum Gelernten passt. Falsche Antworten klingen deshalb genauso überzeugend wie richtige — solche erfundenen Aussagen heißen Halluzinationen und müssen dort geprüft werden, wo Fakten zählen.

Sind die Antworten eines LLM aktuell?

Nur begrenzt: Das Trainingswissen hat einen Stichtag. Aktuelle Informationen gelangen nur über eine angebundene Suche oder eigene Dokumente (RAG) in die Antwort.

Können LLMs rechnen?

Rechnen ist nicht ihre Stärke, denn ein Sprachmodell sagt Text voraus, statt zu kalkulieren. Zahlenarbeit gehört in ein Werkzeug, das tatsächlich rechnet.