Was ist ein Large Language Model?
Ein Large Language Model ist ein neuronales Netz, das auf riesigen Textmengen trainiert wurde. Dabei lernt es statistische Muster in Sprache: welche Wörter, Sätze und Gedanken zusammenpassen. Daraus entsteht die Fähigkeit, Fragen zu beantworten, Texte zu schreiben, zu übersetzen, Code zu erzeugen und Inhalte zusammenzufassen.
Bekannte Beispiele sind die Modelle hinter ChatGPT, Claude oder Gemini sowie offene Modelle, die Unternehmen selbst betreiben können.
Wie ein LLM arbeitet
Ein LLM zerlegt Text in kleine Einheiten, sogenannte Tokens, und berechnet, welches Token am wahrscheinlichsten folgt. Indem es das wiederholt, entstehen ganze Antworten. Was das Modell bei einer Anfrage berücksichtigen kann, ist durch sein Kontextfenster begrenzt.
Daraus folgen zwei Grenzen: Ein LLM kennt nur, was in seinem Training oder im aktuellen Kontext steht, und es prüft Aussagen nicht auf Wahrheit. Deshalb kann es halluzinieren.
Die Rolle des LLM in einer Unternehmens-KI
Das Sprachmodell ist der Motor, aber nicht das ganze Fahrzeug. Damit es im Unternehmen nützlich wird, braucht es Gedächtnis für internes Wissen, Integrationen in bestehende Systeme, Agenten für konkrete Aufgaben und Kontrollmechanismen wie Freigaben.
Weil sich Modelle schnell weiterentwickeln, ist ELEVUM modellagnostisch gebaut. Über den AI Provider Layer lassen sich Modelle austauschen, das Memory bleibt erhalten. Sie binden sich so nicht an einen einzelnen Anbieter.