Pipeline bauen
GraphRAG-Pipeline vom Dokument zur Antwort
Eine Pipeline extrahiert Einheiten, löst Identitäten, baut Beziehungen, ruft Teilgraphen ab und erzeugt Antworten mit Belegen.
Dokument und Chunk versionieren
Jeder Chunk behält Dokument-ID, Offset, Zeitpunkt und Parser-Version. Eine spätere Neuaufteilung darf alte Antwortprotokolle nicht unlesbar machen.
Entitäten und Relationen extrahieren
Der Extraktor liefert Textspanne, Typ, Konfidenz und Modellversion. Relationen benötigen Subjekt, Prädikat, Objekt sowie die Passage, die genau diese Aussage trägt.
Identitäten kontrolliert auflösen
Sichere Schlüssel werden automatisch verbunden; unsichere Namensvarianten gehen in Review. Ein falsches Merge kann mehr Antworten beschädigen als eine fehlende Kante.
Zwischenstände beobachtbar halten
Chunking, Extraktion, Resolution, Graphaufbau, Retrieval und Generation schreiben getrennte Manifeste. So kann eine fehlerhafte Antwort auf ihre erste abweichende Stufe zurückgeführt werden.
edge provenance als Pflichtdatensatz
Eine Kante ohne Passage wird nicht publiziert.
edge_id: e-204
subject: org-17
predicate: operates
object: plant-7
source_chunk: doc-31#p2
span: 144..203
extractor: rel-v5
review_status: approvedEigenständiges Prüfartefakt ohne erfundene Messwerte oder Anbieterwertung.
Entscheidungsregel
Speichere Zwischenstände und Herkunft jeder Kante.
Quellen zu diesem Beitrag
Primärquellen auf Artikelebene, geprüft am 18.09.2026.
- Microsoft GraphRAG indexing
Offizielle Dokumentation des Indexing-Flows. - W3C PROV-O
Standard für Provenienz.