Files
chemenu/kb/concepts/RAG.md
T
torben a35c94e2d9 feat: Link-Taxonomie u3 - kb/concepts/ vollstaendig gelabelt
Files changed:
- kb/concepts/Ambient Environment Dependency.md
- kb/concepts/Anti-Cramming Heuristic.md
- kb/concepts/Audit Trail.md
- kb/concepts/BM25.md
- kb/concepts/Bulk Operations.md
- kb/concepts/CI Integration.md
- kb/concepts/CPPC.md
- kb/concepts/Checkpoint Audit.md
- kb/concepts/Claude Code Auto Mode.md
- kb/concepts/Command Round-Trip Integrity.md
- kb/concepts/Confidence Scoring.md
- kb/concepts/Consolidation Tiers.md
- kb/concepts/Content Quality Control.md
- kb/concepts/Context Isolation.md
- kb/concepts/Contradiction Resolution.md
- kb/concepts/Cross-platform Agent Skills.md
- kb/concepts/Crystallization.md
- kb/concepts/Delete Rather Than Anonymize.md
- kb/concepts/Denylist over Allowlist.md
- kb/concepts/Detect-Repair Asymmetry.md
- kb/concepts/Diff-Reviewable Agent Edits.md
- kb/concepts/Dual Licensing by File Plan.md
- kb/concepts/Entity Extraction.md
- kb/concepts/Episodic Memory.md
- kb/concepts/Event-Driven Automation.md
- kb/concepts/Filter on Ingest.md
- kb/concepts/Forgetting.md
- kb/concepts/Graph Traversal.md
- kb/concepts/Green Suite Blind Spot.md
- kb/concepts/Hooks.md
- kb/concepts/Hybrid Search.md
- kb/concepts/Implementation Spectrum.md
- kb/concepts/Index Scaling.md
- kb/concepts/Issue Label Scheme.md
- kb/concepts/Iteration and Cost Limits.md
- kb/concepts/KB Migration.md
- kb/concepts/KB Stack Versioning.md
- kb/concepts/Knowledge Compounding.md
- kb/concepts/Knowledge Graph.md
- kb/concepts/LLM Wiki Pattern.md
- kb/concepts/Lint Workflow.md
- kb/concepts/MCP-Leseserver.md
- kb/concepts/Mass-Update Gate.md
- kb/concepts/Memory Lifecycle.md
- kb/concepts/Mesh Sync.md
- kb/concepts/Modbus.md
- kb/concepts/Multi-Agent Collaboration.md
- kb/concepts/Naming Convention Conflict.md
- kb/concepts/OKF Compatibility.md
- kb/concepts/Optional Instance Context File.md
- kb/concepts/Personalization Plane.md
- kb/concepts/Privacy and Governance.md
- kb/concepts/Procedural Memory.md
- kb/concepts/Publish-Remote Gate.md
- kb/concepts/Quality Scoring.md
- kb/concepts/Quality and Self-Correction.md
- kb/concepts/RAG.md
- kb/concepts/Reciprocal Rank Fusion.md
- kb/concepts/SSD TRIM.md
- kb/concepts/Scale Ceiling.md
- kb/concepts/Self-Healing.md
- kb/concepts/Semantic Lint Automation.md
- kb/concepts/Semantic Memory.md
- kb/concepts/Session Orientation.md
- kb/concepts/Shared vs Private.md
- kb/concepts/Split Merge Reclassify.md
- kb/concepts/Split Threshold.md
- kb/concepts/Structural Enforcement over Documented Rule.md
- kb/concepts/Stub Threshold.md
- kb/concepts/Supersession.md
- kb/concepts/Three-Layer Architecture.md
- kb/concepts/Token Economics.md
- kb/concepts/Typed Relationships.md
- kb/concepts/User Management.md
- kb/concepts/Vector Search.md
- kb/concepts/Work Coordination.md
- kb/concepts/Workflow Extraction.md
- kb/concepts/Workflow Orchestration.md
- kb/concepts/Working Memory.md
- kb/concepts/Write-Once Frontmatter Fields.md
- kb/log.md
- work/link-taxonomy-migration/glossary.md
2026-09-02 22:56:04 +02:00

4.3 KiB

type, concept_type, tags, created, modified, related, sources, confidence, confidence_base, provenance, summary
type concept_type tags created modified related sources confidence confidence_base provenance summary
types/concept.md architecture
ai
retrieval
generation
knowledge-management
2026-07-26 2026-08-29
see-also
LLM Wiki Pattern
see-also
NotebookLM
see-also
ChatGPT
Source - LLM Wiki Pattern
0.90 0.90 sourced Architekturmuster, bei dem LLMs die Generierung um Dokumente aus einer Wissensbasis anreichern.

RAG

Typ: Architecture (Retrieval Augmented Generation)

Definition

RAG (Retrieval Augmented Generation) ist ein KI-Architekturmuster, bei dem ein großes Sprachmodell (LLM) relevante Informationen aus einer Knowledge Base abruft, bevor es eine Antwort generiert. Dies ermöglicht dem LLM, Antworten bereitzustellen, die in externen Dokumenten verankert sind, anstatt sich ausschließlich auf seine Trainingsdaten zu verlassen.

Kernpunkte

Wie RAG funktioniert

  1. Indexierung: Dokumente werden verarbeitet und für die Suche indexiert
  2. Abruf: Bei jeder Abfrage werden relevante Chunks aus dem Index abgerufen
  3. Augmentation: Abgerufene Chunks werden zum LLM-Kontext/Prompt hinzugefügt
  4. Generierung: LLM generiert eine Antwort basierend auf seinem Wissen und den abgerufenen Chunks

Traditionelle RAG-Systeme

Beispiele sind:

  • NotebookLM (Google)
  • ChatGPT Datei-Uploads (OpenAI)
  • Die meisten kommerziellen RAG-Implementierungen

Begrenzungen von traditionellem RAG

Laut dem LLM Wiki Pattern-Artikel:

  1. Keine Knowledge Accumulation: Wissen wird bei jeder Abfrage von Grund auf neu abgeleitet
  2. Keine persistente Synthese: Verbindungen zwischen Dokumenten werden nicht aufrechterhalten
  3. Keine Querverweise: Keine expliziten Links zwischen verwandten Konzepten über Quellen hinweg
  4. Keine Widerspruchserkennung: Konfliktinformationen werden nicht gekennzeichnet
  5. Kein Compounding: Das Hinzufügen neuer Quellen baut nicht auf vorherigem Verständnis auf
  6. Ineffizient für komplexe Abfragen: Subtile Fragen, die eine Synthese mehrerer Dokumente erfordern, müssen jedes Mal neu abgeleitet werden

Wann RAG geeignet ist

  • Bei einfachen, einmaligen Fragen
  • Für schnelle Informationssuche
  • Wenn Persistenz und Compounding nicht erforderlich sind
  • Wenn der Aufwand für Wiki-Wartung nicht gerechtfertigt ist

Wann über RAG hinausgehen

Das LLM Wiki Pattern in Betracht ziehen, wenn:

  • Wissen im Laufe der Zeit angesammelt werden soll
  • Persistente Querverweise benötigt werden
  • Widersprüche zwischen Quellen gekennzeichnet werden sollen
  • Wissen benötigt wird, das zusammengesetzt wird, wenn neue Quellen hinzugefügt werden
  • Komplexe Abfragen, die Multi-Dokument-Synthese erfordern, häufig vorkommen

RAG vs. LLM-Wiki-Pattern

Aspekt RAG LLM-Wiki-Pattern
Knowledge Accumulation Nein Ja
Persistente Querverweise Nein Ja
Widerspruchserkennung Nein Ja
Knowledge Compounding Nein Ja
Wartung Automatisch LLM-gepflegt
Abfrage-Geschwindigkeit Schnell Schnell (nach Kompilierung)
Setup-Komplexität Niedrig Mittel
Am besten für Einmalige Abfragen Laufende Knowledge Accumulation

Implementierungen

RAG-Varianten

  • Naive RAG: Einfache Ähnlichkeitssuche
  • Vector RAG: Embedding-basierter Abruf
  • Hybrid RAG: Kombiniert Schlüsselwort- und Vector-Suche
  • Graph RAG: Verwendet Knowledge Graphs für Abruf

LLM-Wiki-Pattern als verbessertes RAG

Das LLM Wiki Pattern kann als eine Verbesserung zu RAG angesehen werden, die hinzufügt:

  • Persistenz-Schicht (das Wiki)
  • Automatische Querverweise
  • Widerspruchserkennung
  • Knowledge Compounding
  • Menschliche Kuratierung in der Schleife

Tools, die RAG verwenden

  • NotebookLM
  • ChatGPT (mit Datei-Uploads)
  • Viele unternehmensweite Knowledge-Management-Systeme
  • Verschiedene Open-Source-RAG-Frameworks (LangChain, LlamaIndex, etc.)

Geschichte

  • [2020] - Frühe RAG-Papers und -Implementierungen
  • [2023] - Kommerzielle RAG-Systeme entstehen (NotebookLM, ChatGPT Datei-Uploads)
  • [2023-2024] - LLM-Wiki-Pattern entwickelt als Verbesserung zu RAG
  • [2026-07-26] - Konzeptseite erstellt

Siehe auch

Beziehungen