a35c94e2d9
Files changed: - kb/concepts/Ambient Environment Dependency.md - kb/concepts/Anti-Cramming Heuristic.md - kb/concepts/Audit Trail.md - kb/concepts/BM25.md - kb/concepts/Bulk Operations.md - kb/concepts/CI Integration.md - kb/concepts/CPPC.md - kb/concepts/Checkpoint Audit.md - kb/concepts/Claude Code Auto Mode.md - kb/concepts/Command Round-Trip Integrity.md - kb/concepts/Confidence Scoring.md - kb/concepts/Consolidation Tiers.md - kb/concepts/Content Quality Control.md - kb/concepts/Context Isolation.md - kb/concepts/Contradiction Resolution.md - kb/concepts/Cross-platform Agent Skills.md - kb/concepts/Crystallization.md - kb/concepts/Delete Rather Than Anonymize.md - kb/concepts/Denylist over Allowlist.md - kb/concepts/Detect-Repair Asymmetry.md - kb/concepts/Diff-Reviewable Agent Edits.md - kb/concepts/Dual Licensing by File Plan.md - kb/concepts/Entity Extraction.md - kb/concepts/Episodic Memory.md - kb/concepts/Event-Driven Automation.md - kb/concepts/Filter on Ingest.md - kb/concepts/Forgetting.md - kb/concepts/Graph Traversal.md - kb/concepts/Green Suite Blind Spot.md - kb/concepts/Hooks.md - kb/concepts/Hybrid Search.md - kb/concepts/Implementation Spectrum.md - kb/concepts/Index Scaling.md - kb/concepts/Issue Label Scheme.md - kb/concepts/Iteration and Cost Limits.md - kb/concepts/KB Migration.md - kb/concepts/KB Stack Versioning.md - kb/concepts/Knowledge Compounding.md - kb/concepts/Knowledge Graph.md - kb/concepts/LLM Wiki Pattern.md - kb/concepts/Lint Workflow.md - kb/concepts/MCP-Leseserver.md - kb/concepts/Mass-Update Gate.md - kb/concepts/Memory Lifecycle.md - kb/concepts/Mesh Sync.md - kb/concepts/Modbus.md - kb/concepts/Multi-Agent Collaboration.md - kb/concepts/Naming Convention Conflict.md - kb/concepts/OKF Compatibility.md - kb/concepts/Optional Instance Context File.md - kb/concepts/Personalization Plane.md - kb/concepts/Privacy and Governance.md - kb/concepts/Procedural Memory.md - kb/concepts/Publish-Remote Gate.md - kb/concepts/Quality Scoring.md - kb/concepts/Quality and Self-Correction.md - kb/concepts/RAG.md - kb/concepts/Reciprocal Rank Fusion.md - kb/concepts/SSD TRIM.md - kb/concepts/Scale Ceiling.md - kb/concepts/Self-Healing.md - kb/concepts/Semantic Lint Automation.md - kb/concepts/Semantic Memory.md - kb/concepts/Session Orientation.md - kb/concepts/Shared vs Private.md - kb/concepts/Split Merge Reclassify.md - kb/concepts/Split Threshold.md - kb/concepts/Structural Enforcement over Documented Rule.md - kb/concepts/Stub Threshold.md - kb/concepts/Supersession.md - kb/concepts/Three-Layer Architecture.md - kb/concepts/Token Economics.md - kb/concepts/Typed Relationships.md - kb/concepts/User Management.md - kb/concepts/Vector Search.md - kb/concepts/Work Coordination.md - kb/concepts/Workflow Extraction.md - kb/concepts/Workflow Orchestration.md - kb/concepts/Working Memory.md - kb/concepts/Write-Once Frontmatter Fields.md - kb/log.md - work/link-taxonomy-migration/glossary.md
73 lines
4.1 KiB
Markdown
73 lines
4.1 KiB
Markdown
---
|
|
type: types/concept.md
|
|
concept_type: architecture
|
|
tags: [tokens, cost, efficiency]
|
|
created: 2026-08-04
|
|
modified: 2026-09-01
|
|
related:
|
|
- see-also: Cross-platform Agent Skills
|
|
- see-also: Scale Ceiling
|
|
- see-also: Context Isolation
|
|
sources: [Source - Copilot Skill Restructure Instructions, Source - Conversation - AGENTS.md Skill Restructuring Session 2026-08-04]
|
|
confidence: 0.60
|
|
confidence_base: 0.60
|
|
provenance: mixed
|
|
summary: Kosten- und Effizienzüberlegungen zum Tokenverbrauch von LLMs - die genannten Werte 5-8x/61%/100% sind unbestätigt, keine gesicherten Fakten
|
|
---
|
|
# Token Economics
|
|
|
|
**Typ:** architecture
|
|
|
|
## Definition
|
|
|
|
Token Economics bezieht sich auf Kosten- und Effizienzüberlegungen zur Nutzung des LLM-Kontextfensters, insbesondere darauf, wie die Menge der geladenen Anweisungen und des Kontexts Leistung, Kosten und Qualität beeinflusst[^s-copilot-skill-restructure-instructions].
|
|
|
|
## Kernpunkte
|
|
|
|
- **Kostenmultiplikator:** Eine vollständige Aufnahme gegen ein kompiliertes Wiki liest mehr Token als eine Abfrage, weil die Aufnahme viele Seiten berührt, während eine Abfrage normalerweise nur eine Handvoll liest - dies ist grundsätzlich korrekt, aber die spezifische „~5-8x die Quellen-Token-Anzahl"-Zahl aus der Anweisungsmenge, die dieses Konzept einführte, hat **keine auffindbaren Quelle** und sollte nicht als Fakt wiederholt werden[^s-conversation-agents-md-skill-restructuring-session-2026-08-04].
|
|
- **Abfrage-Effizienz**: Eine Abfrage gegen nur einen Index plus 2-4 Seiten kostet einen Bruchteil der vollständigen Aufnahmekosten[^s-copilot-skill-restructure-instructions]
|
|
- **Monolithischer Overhead**: Das Laden eines vollständigen Anweisungssatzes (wie AGENTS.md) bei jedem Task zahlt auch für einfache Abfragen den höheren Preis[^s-copilot-skill-restructure-instructions]
|
|
- **Kontextisolations-Vorteil**: Diskrete Skills, die nur bei Aufruf geladen werden, reduzieren die Token-Nutzung erheblich
|
|
|
|
## Allgemeine Hinweise (unbelegt)
|
|
|
|
Die „RTFM/Abruf-Schicht"-Statistik unten (61% Token-Reduktion, 100%-Lösungsquote auf einem 8.260-Datei-Korpus) konnte während der Faktenprüfung nicht auf eine auffindbaren Quelle zurückgeführt werden und sollte als illustrativer, unverifizierter Aussage statt als bestätigter Fakt behandelt werden[^s-conversation-agents-md-skill-restructuring-session-2026-08-04].
|
|
|
|
## Beispiele
|
|
|
|
- Das Chemenu-Repository mit monolithischem AGENTS.md (ursprünglich ~745 Zeilen), das bei jeder Operation geladen wird - **direkt bestätigt**: 745 Zeilen, gemessen über `grep`, vollständig unabhängig von der Task angehängt, bevor es am 2026-08-04 in 5 Skills aufgeteilt wurde[^s-conversation-agents-md-skill-restructuring-session-2026-08-04].
|
|
- ~~Der RTFM/Abruf-Schicht-Ansatz, der die Token-Nutzung um 61% auf einem 8.260-Datei-Korpus reduzierte~~ **unverifiziert** - keine Quelle für diese Statistik gefunden[^s-conversation-agents-md-skill-restructuring-session-2026-08-04].
|
|
|
|
## Wann zu verwenden
|
|
|
|
Token Economics in Betracht ziehen, wenn:
|
|
- Der Anweisungssatz das Kontextfenster des LLM überschreitet
|
|
- Sie eine Qualitätsverschlechterung bemerken, wenn das Wiki über ~100-200 Seiten wächst
|
|
- Einfache Abfragen unverhältnismäßig lange oder kostspielig werden
|
|
- Sie Zuständigkeiten in diskrete, unabhängig aufrufbare Vorgänge trennen können
|
|
|
|
## Wann NICHT zu verwenden
|
|
|
|
Token Economics ist weniger entscheidend, wenn:
|
|
- Das Wiki klein (<100 Seiten) ist und bequem in den Kontext passt
|
|
- Die Workflows inhärent gekoppelt sind und nicht getrennt werden können
|
|
- Der Entwicklungsaufwand der Kontextoptimierung die Vorteile übersteigt
|
|
|
|
## Siehe auch
|
|
|
|
- [[Source - Copilot Skill Restructure Instructions]]
|
|
- [[Source - Conversation - AGENTS.md Skill Restructuring Session 2026-08-04]]
|
|
|
|
## Fußnoten
|
|
|
|
[^s-copilot-skill-restructure-instructions]: [[Source - Copilot Skill Restructure Instructions]]
|
|
[^s-conversation-agents-md-skill-restructuring-session-2026-08-04]: [[Source - Conversation - AGENTS.md Skill Restructuring Session 2026-08-04]]
|
|
|
|
<!-- wikitool:links -->
|
|
## Beziehungen
|
|
|
|
- **see-also:** [[Cross-platform Agent Skills]]
|
|
- **see-also:** [[Scale Ceiling]]
|
|
- **see-also:** [[Context Isolation]]
|
|
<!-- /wikitool:links -->
|