Großes Sprachmodell
Die auf riesigen Textmengen trainierte KI-Art hinter Chatbots wie ChatGPT und Claude.
Ein großes Sprachmodell, kurz LLM, ist die Art künstlicher Intelligenz hinter Assistenten wie ChatGPT, Claude und Gemini. Es wird mit enormen Textmengen trainiert und lernt die statistischen Muster der Sprache, welche Wörter und Gedanken typischerweise aufeinander folgen.
Aus diesem Training entsteht eine überraschend große Bandbreite an Fähigkeiten: Ein LLM kann Fragen beantworten, Texte schreiben und bearbeiten, übersetzen, zusammenfassen und sogar funktionierenden Code erzeugen. Dabei sagt es auf Grundlage des bisherigen Verlaufs jeweils das nächste Token voraus.
Ebenso wichtig ist, was ein LLM nicht ist. Es hat keine direkte Verbindung zur Wahrheit und kein echtes Verständnis. Es erzeugt plausiblen Text, der meist richtig ist, aber selbstbewusst falsch sein kann, ein Fehler, der Halluzination genannt wird. Das zu wissen ist der Schlüssel zu einem guten Umgang mit diesen Werkzeugen.
-
Ein Training für 500 Dollar: So schlägt ein 9B-Modell die Spitzenmodelle bei einer eintönigen Aufgabe
-
Ein indisches Gericht nennt KI-Training „private Nutzung“ – Verlage sollten das Kleingedruckte lesen
-
OpenAI analysiert 800.000 berufliche Chats – und entdeckt, dass Menschen nebenbei fremde Jobs erledigen
-
Samsung verhandelt über eine Beteiligung an Mistral und treibt Europas KI-Hoffnung auf eine Bewertung von 20 Milliarden Euro
-
Starting With AI, Part 1: An Honest Map for Your First Week