Im Jahr 2025 berichtete OpenAI von rund 700 Millionen wöchentlich aktiven Benutzern allein für ChatGPT. Diese Zahl berücksichtigt noch nicht die Hunderte Millionen weiterer Anwender von konkurrierenden Lösungen wie Google Gemini, Microsoft Copilot oder Claude von Anthropic. All diese Anwendungen basieren auf einer Klasse künstlicher Intelligenz, die als Large Language Models (LLMs) bezeichnet wird.

Ein Large Language Model ist ein Deep-Learning-System, das mit enormen Mengen an Textdaten trainiert wird, um natürliche Sprache zu verstehen und zu generieren. Die Auswirkungen dieser Technologie sind jedoch alles andere als einfach. In diesem Leitfaden erläutern wir, was LLMs sind, wie sie funktionieren, welche Anwendungsfälle am häufigsten vorkommen und warum LLMs für den großflächigen Einsatz künstlicher Intelligenz so bedeutend sind.

 

Was ist ein LLM?

Ein Large Language Model (LLM) ist eine Form der künstlichen Intelligenz, die auf neuronalen Netzwerken basiert und mit Milliarden von Wörtern aus Textdaten trainiert wird. Ziel eines LLM ist es, menschliche Sprache zu verstehen, vorherzusagen und zu erzeugen.

LLM-basierte Systeme gehören zur übergeordneten Kategorie der generativen KI. Sie gehen über das Klassifizieren und Recherchieren von Informationen hinaus und erstellen neue Inhalte, darunter Antworten, Zusammenfassungen, Programmcode, Übersetzungen und vieles mehr.

LLMs sind sogenannte Foundation Models. Das bedeutet, dass sie zunächst mit allgemeinen Daten in großem Maßstab trainiert werden und anschließend für spezifische Anwendungsfälle angepasst und feinabgestimmt werden können, ohne dass das Training von Grund auf neu beginnen muss.

Was LLMs von früheren KI-Ansätzen unterscheidet, sind vor allem der Umfang der Trainingsdaten und die Leistungsfähigkeit ihrer Architektur. Während ältere Systeme auf manuell erstellte Regeln oder aufgabenspezifische Trainingsdatensätze angewiesen waren, lernen LLMs statistische Muster aus menschlicher Sprache in ihrer ganzen Breite. Dadurch können sie ein breites Spektrum an Aufgaben bewältigen, oft mit wenig oder sogar ganz ohne zusätzliches Training.

Im Bereich der Cyber-Sicherheit bieten LLMs vielfältige Einsatzmöglichkeiten. So integriert beispielsweise Rubrik Security Cloud LLM-basierte Intelligenz, um Sicherheitsteams dabei zu unterstützen, unstrukturierte Daten zu interpretieren, Anomalien schneller zu erkennen und die Reaktion auf Sicherheitsvorfälle in komplexen Unternehmensumgebungen zu beschleunigen.

 

Wie funktionieren LLMs?

LLMs basieren auf einer neuronalen Netzwerkarchitektur namens Transformer, die 2017 von Google-Forschern vorgestellt wurde. Transformer-Modelle verarbeiten Texte, indem sie diese in sogenannte Token zerlegen. Dabei handelt es sich um kleine Einheiten wie Wörter, Wortteile oder Zeichenfolgen. Das Modell lernt anschließend die statistischen Zusammenhänge zwischen diesen Token anhand riesiger Trainingsdatensätze.

Der Trainingsprozess umfasst im Wesentlichen zwei Phasen:

  1. Vortraining (Pre-Training): Das Modell verarbeitet Milliarden von Dokumenten, darunter Bücher, Webseiten, Quellcode und wissenschaftliche Publikationen. Dabei lernt es, das nächste Token innerhalb einer Sequenz vorherzusagen. Dieser Schritt ist äußerst rechenintensiv und erfordert spezialisierte Hardware, die oft über Wochen oder Monate hinweg betrieben wird.

  2. Feinabstimmung (Fine-Tuning): Nach dem Vortraining wird das Modell mit einem kleineren, gezielt ausgewählten Datensatz für bestimmte Aufgaben oder gewünschte Verhaltensweisen optimiert. Auf diese Weise wird aus einem allgemeinen LLM beispielsweise ein Assistent für den Kundensupport, ein Programmiertool oder eine Unterstützung für Sicherheitsanalysten.

Phase

Zweck

Verwendete Daten

Dauer

Vortraining (Pre-Training)

Erlernen allgemeiner Sprachmuster

Milliarden von Dokumenten

Wochen oder Monate

Feinabstimmung (Fine-Tuning)

Anpassung an spezifische Aufgaben oder Verhaltensweisen

Tausende bis Millionen spezialisierter Beispiele

Stunden oder Tage

 

Laut Untersuchungen des Human-Centered AI Institute der Stanford University enthalten die größten LLMs inzwischen Hunderte von Milliarden Parametern. Diese Parameter sind numerische Gewichtungen, in denen das Modell das während des Trainings erlernte Wissen speichert. Mithilfe von Deep-Learning-Verfahren können diese Parameter komplexe und nuancierte sprachliche Muster erfassen, die mit früheren Methoden des maschinellen Lernens nicht erkennbar waren.

 

Gängige Anwendungsbereiche für LLMs

LLMs haben den Sprung aus Forschungslaboren in den Alltag von Unternehmen und Nutzern geschafft. Heute bilden sie die Grundlage für zahlreiche Anwendungen in unterschiedlichsten Branchen:

  • Textgenerierung: Schreibassistenten, Zusammenfassungs- und Content-Erstellungstools unterstützen bei der Erstellung von Texten, Berichten oder Ideen. Beispiele sind ChatGPT, Claude und Gemini.

  • Code-Vervollständigung: Entwicklertools schlagen Programmcode in Echtzeit vor und vervollständigen ihn automatisch. Dazu zählen Lösungen wie GitHub Copilot oder Amazon CodeWhisperer.

  • Kundensupport: Chatbots und virtuelle Assistenten beantworten Standardanfragen eigenständig und übernehmen Support-Anfragen der ersten Ebene, ohne dass eine direkte menschliche Unterstützung erforderlich ist.

  • Sprachübersetzung und Grammatikprüfung: LLMs ermöglichen Übersetzungen und sprachliche Korrekturen in Echtzeit für zahlreiche Sprachen.

  • Datenklassifizierung und Verschlagwortung: Große Mengen unstrukturierter Daten können automatisch kategorisiert und gekennzeichnet werden.

Insbesondere im Bereich der Cyber-Sicherheit werden LLMs zunehmend in Plattformen zur Bedrohungsüberwachung eingebettet. Sie helfen dabei, Protokolldaten zu analysieren, Risikosignale in unstrukturierten Dokumenten zu klassifizieren und Sicherheitsvorfälle in verständlicher, natürlicher Sprache zusammenzufassen. Dadurch verbringen Sicherheitsanalysten deutlich weniger Zeit mit manuellen Triage-Aufgaben.

 

Warum LLMs für die KI-Landschaft so wichtig sind

LLMs haben die Möglichkeiten der künstlichen Intelligenz im Umgang mit natürlicher Sprache grundlegend verändert. Vor ihrem Aufkommen basierte die Sprachverarbeitung überwiegend auf regelbasierten oder statistischen Verfahren. Diese konnten beispielsweise Stimmungen erkennen oder benannte Entitäten identifizieren, waren jedoch nicht in der Lage, zusammenhängende längere Texte zu erstellen oder komplexe Themengebiete zu erfassen und zu verknüpfen.

Heute beschleunigen LLMs die Einführung und Nutzung von KI in Unternehmen, SaaS-Umgebungen und Sicherheitsinfrastrukturen. Ihre Fähigkeit, unstrukturierte Daten wie E-Mails, Verträge, Protokolldateien oder Support-Tickets in großem Umfang zu analysieren und zu interpretieren, eröffnet Unternehmen neue Möglichkeiten zur Automatisierung und Gewinnung von Erkenntnissen, die zuvor nicht zugänglich waren.

Im Sicherheitskontext ermöglichen LLMs, Zero-Trust-Konzepte auch auf unstrukturierte Daten auszudehnen. Sie können Risikosignale in Dokumenten und Kommunikationsinhalten erkennen und interpretieren – Informationen, die von traditionellen regelbasierten Systemen häufig nicht zuverlässig analysiert werden können. Die Funktionen von Rubrik zum Schutz unstrukturierter Daten nutzen KI-gestützte Analysen, um sensible Informationen unabhängig von ihrem Format zu erkennen, zu klassifizieren und zu schützen. Diese Fähigkeit gewinnt zunehmend an Bedeutung, da die Datenmengen in Unternehmen stetig wachsen und sich die potenziellen Angriffsflächen entsprechend vergrößern.

Laut dem State of AI Report 2024 von McKinsey hat sich die Einführung generativer KI in Unternehmen innerhalb eines Jahres verdoppelt. Large Language Models werden dabei als der wichtigste Treiber für neue Automatisierungs- und Effizienzpotenziale genannt.

LLMs sind längst keine reine Forschungstechnologie mehr. Sie bilden heute die Grundlage einer neuen Generation KI-gestützter Tools, die verändern, wie Unternehmen arbeiten, kommunizieren und ihre Daten schützen. Wer die KI-Landschaft im Jahr 2026 und darüber hinaus verstehen und erfolgreich nutzen möchte, sollte daher wissen, was ein LLM ist, wie es funktioniert und in welchen Bereichen es eingesetzt werden kann. Wenn Sie mehr darüber erfahren möchten, wie sich künstliche Intelligenz und Cyber-Sicherheit ergänzen und welche Auswirkungen diese Entwicklung auf Ihre Organisation haben kann, wenden Sie sich an das Vertriebsteam von Rubrik.

 

FAQ