BEGRIFFKI & SPRACHMODELLE

RAG Retrieval-Augmented Generation

von everbrave studioStand: Juli 2026~4 Min Lesezeit
IN EINEM SATZ

RAG verbindet die Textgenerierung eines Sprachmodells mit dem gezielten Abruf passender Informationen aus externen Quellen.

/01 WAS DAHINTER STECKT

Was ist Retrieval-Augmented Generation?

Retrieval-Augmented Generation, kurz RAG, ergänzt eine Anfrage um Inhalte aus einer getrennten Wissensquelle. Zuerst sucht ein Retrieval-System nach passenden Textstellen, zum Beispiel in Produktdokumentation, Richtlinien oder einem Wissensarchiv. Die gefundenen Ausschnitte werden zusammen mit der Frage an das Sprachmodell übergeben. Das LLM formuliert seine Antwort dann auf Basis dieses zusätzlichen Kontexts und kann die verwendeten Fundstellen ausweisen.

RAG verändert normalerweise nicht die trainierten Gewichte des Modells. Genau darin liegt der Unterschied zum Fine-Tuning: Fine-Tuning passt das Verhalten des Modells mit Trainingsbeispielen an; RAG liefert zur Laufzeit austauschbares Wissen. Neue Dokumente lassen sich dadurch schneller berücksichtigen, sofern Index und Zugriffsregeln gepflegt sind. Trotzdem ist RAG kein Wahrheitsfilter. Die Suche kann unpassende Passagen liefern, ein Dokument kann veraltet sein und das Modell kann Quellen falsch wiedergeben. Gute Systeme prüfen daher Berechtigungen, Fundqualität, Zitate und Antworten getrennt.

/02 EHRLICH ÜBERSETZT

RAG im Klartext

KLARTEXT
Kein Training des Modells, keine automatische Wahrheitsgarantie und kein Ersatz für gepflegte Quelldokumente.
Ein Abrufverfahren, das relevante externe Inhalte als zusätzlichen Kontext für die aktuelle Modellantwort bereitstellt.
RAG versorgt ein LLM mit Quellenwissen zur Laufzeit. Es kann Halluzinationen reduzieren und Nachweise ermöglichen, verhindert falsche Antworten aber nicht automatisch.
/03 SO GEHST DU ES AN

So läuft eine RAG-Anfrage ab

01Anfrage aufbereiten. Das System erfasst die Frage, berücksichtigt Berechtigungen und formuliert daraus eine geeignete Suchanfrage.
02Quellen abrufen. Eine Suche bewertet indexierte Abschnitte und liefert die relevantesten erlaubten Fundstellen samt Metadaten.
03Antwort belegen. Das LLM formuliert mit dem gefundenen Kontext. Anschließend prüft die Anwendung Zitate, Abdeckung und Ausgabeformat.

Häufige Fragen

Was ist der Unterschied zwischen RAG und Fine-Tuning?

RAG ruft bei jeder Anfrage passende Informationen aus einer externen Quelle ab und legt sie in den Modellkontext. Fine-Tuning verändert Modellparameter anhand von Trainingsbeispielen und eignet sich eher für gewünschtes Verhalten, Stil oder wiederkehrende Muster. Für häufig wechselndes Faktenwissen ist RAG meist direkter aktualisierbar. Beide Verfahren können kombiniert werden.

Verhindert RAG Halluzinationen?

RAG kann das Risiko senken, weil das Modell relevante Quellen erhält. Es kann Halluzinationen aber nicht ausschließen. Die Suche kann die falschen Passagen auswählen, Dokumente können Fehler enthalten und das Modell kann Belege untreu zusammenfassen. Gute Tests betrachten deshalb Abrufqualität und Antwortqualität separat und erlauben dem System, bei fehlender Evidenz keine Antwort zu geben.

Welche Daten eignen sich für RAG?

Geeignet sind gepflegte Dokumente, deren Herkunft, Aktualität und Zugriffsrechte bekannt sind: Handbücher, Richtlinien, Produktwissen oder freigegebene Wissensartikel. Problematisch sind ungeprüfte Ablagen, Duplikate, eingescannte Dateien ohne saubere Texterkennung und Inhalte ohne Besitzer. RAG macht vorhandenes Wissen abrufbar; es repariert keine schlechte Informationspflege.

Braucht RAG immer eine Vektordatenbank?

Nein. Vektorsuche ist verbreitet, weil sie semantisch ähnliche Passagen finden kann. Je nach Bestand können klassische Stichwortsuche, strukturierte Datenbankabfragen, Wissensgraphen oder eine Kombination besser passen. Entscheidend ist, dass die Suche für die realen Fragen relevante, erlaubte und nachvollziehbare Quellen liefert. Die Datenbanktechnik ist Mittel zum Zweck.

AUS DER PRAXIS
Bei RAG teste ich zuerst die Suche, nicht die schönste Antwort. Ein System ist nur dann belastbar, wenn es die richtige Passage findet, Berechtigungen einhält und offen stoppen kann, sobald belastbare Quellen fehlen.
RAG-Anwendungsfall prüfen
DATENBLATT
BEGRIFFRAG
STEHT FÜRRetrieval-Augmented Generation
CLUSTERKI & Sprachmodelle
LESEZEIT~4 Min
STAND07/2026
HYPE-FAKTOR
2/5 — PRAKTISCH, ABER KEIN WAHRHEITSFILTER