Large Language Model (LLM)
Auch: LLM, Sprachmodell, großes Sprachmodell
Ein Large Language Model (LLM, deutsch: großes Sprachmodell) ist ein KI-Modell, das mit sehr großen Textmengen trainiert wurde und dadurch Texte verstehen, zusammenfassen und erzeugen kann.
Wie ein LLM funktioniert
Ein LLM sagt, vereinfacht gesagt, Wort für Wort voraus, welcher Text als Nächstes am wahrscheinlichsten folgt. Grundlage sind Muster, die das Modell beim Training auf Milliarden von Texten gelernt hat. Durch weiteres Training und Feedback lernt es, Fragen zu beantworten und Anweisungen zu folgen.
Bekannte LLMs und Anwendungen
| Anwendung | Anbieter |
|---|---|
| ChatGPT | OpenAI |
| Gemini | |
| Claude | Anthropic |
| Copilot | Microsoft |
| Perplexity | Perplexity AI (nutzt mehrere Modelle) |
Trainingswissen und Websuche
Ein LLM kennt nur, was bis zum Ende seines Trainings im Datenbestand war. Viele Anwendungen ergänzen das Modell deshalb um eine Websuche und zeigen dabei Quellen an, sogenannte Citations. Das Verfahren dahinter heißt Retrieval-Augmented Generation (RAG). Für Marken heißt das: Sichtbar wird man sowohl über häufige Erwähnungen im Web als auch über gut auffindbare, aktuelle Inhalte.
LLM und KI-Sichtbarkeit
Die Optimierung für LLM-basierte Antworten wird als Generative Engine Optimization (GEO) oder LLMO bezeichnet. Einen Überblick gibt der Leitfaden KI-Sichtbarkeit.
Warum Modelle aktuelle Ereignisse nicht kennen, erklärt Knowledge Cutoff.
Häufige Fragen
Was ist der Unterschied zwischen KI und LLM?
KI (künstliche Intelligenz) ist der Oberbegriff für Systeme, die Aufgaben mit menschenähnlicher Intelligenz lösen. Ein LLM ist eine bestimmte Art von KI, die auf Sprache spezialisiert ist.
Können LLMs sich irren?
Ja. LLMs können überzeugend klingende, aber falsche Aussagen erzeugen. Das nennt man Halluzination. Quellenangaben helfen, Antworten zu überprüfen.