LLM – Large Language Model

Ein LLM (Large Language Model, deutsch: großes Sprachmodell) ist ein KI-Modell, das Text vorhersagt und erzeugt – trainiert auf riesigen Textmengen. Bekannte Beispiele sind GPT, Claude und Llama.

Wie funktioniert ein LLM?

LLMs arbeiten mit Token (Wortteilen), verarbeiten Text in einem neuronalen Netz (Transformer-Architektur) und sagen Wort für Wort das wahrscheinlichste nächste Token vorher. Dadurch entstehen kohärente Antworten, Zusammenfassungen und Code.

Stärken und Grenzen

  • Stärken: Textverständnis, Übersetzung, Programmieren, Zusammenfassen
  • Grenzen: Halluzinationen (erfundene Fakten), fehlendes Weltwissen, Rechenfehler

Ausführlich erklärt im Wissens-Artikel LLMs verstehen: Wie große Sprachmodelle funktionieren.

Verwandt: LLMs verstehen · Was ist Inference?