MetaMetaMeta / PATTERNS.md
smlflg's picture
Initial public upload from Projekte/MetaMetaMeta
3bc7cb3 verified
|
Raw History Blame Contribute Delete
5.36 kB

PATTERNS — Was funktioniert, was nicht

Pattern-Katalog auf Basis von 100+ Sessions, Retrospektiven und Sidecar-Evolution. Zweck: Scannable, actionable — keine Theorie, nur belegte Muster.


Erfolgreiche Patterns

1. Eval-Driven Development

  • V1 Evaluation mit 179 pytest Tests, 100% Accuracy auf allen Feature-Gruppen
  • Binäre Metriken statt subjektiver Bewertung
  • Source: RETROSPEKTIVE_100_SESSIONS

2. Plan → Implementation → Verification

  • Plan-Mode als Kontrollpunkt etabliert
  • Gibt Struktur und verhindert spontane Feature-Expansion
  • Source: RETROSPEKTIVE_100_SESSIONS

3. Parallel Scout Agents

  • 8+ Explore-Scouts parallel für Codebase-Analyse
  • Effizient für breite Recherche, schützt Haupt-Kontext
  • Source: RETROSPEKTIVE_100_SESSIONS

4. Critical Review Before Implementation

  • Session a25399f3: 4 kritische Bugs in Skill-Routing Plan gefunden BEVOR Code geschrieben
  • Review ist billiger als Debugging
  • Source: RETROSPEKTIVE_100_SESSIONS

5. Keyword-First Pre-Filter (Sidecar-NG)

  • Deterministisch, 0ms, $0
  • First-match-wins statt 49 paralleler Mechanisms
  • Covers 60–70% der Prompts ohne LLM
  • Source: SIDECAR_EVOLUTION

6. Stateless over Stateful

  • V1–V7: Stateful Daemons, 5.8 GB State-Risiko
  • NG: Stateless Script, ~450 LOC, kein State zu korrumpieren
  • Source: SIDECAR_EVOLUTION

7. Measurement from Day 1

  • inject_log.jsonl + eval_ab.py von Tag 1
  • Nicht bauen-und-hoffen sondern bauen-und-messen
  • Source: SIDECAR_EVOLUTION

8. Fail-Open Design

  • Hook-Fehler → Exit 0, Prompt geht unmodifiziert durch
  • Sidecar darf Claude Code NIE blockieren
  • Source: Sidecar-NG ARCHITECTURE

9. Just-in-Time Injection

  • 1 Satz additionalContext statt 280 Zeilen CLAUDE.md
  • Situativ relevant, geht nicht im Rauschen unter
  • Source: Harness-Analyse

10. Cost-Optimized Delegation

  • Opus orchestriert, Sonnet implementiert, Haiku für Background
  • /crew ($0.60/1M) vs SubAgents ($3/1M) = 85% Kostenreduktion
  • Source: ORCHESTRATION_GUIDE, ANALYSE_KOMPLETT

Gescheiterte Patterns

1. Mehr Regeln = Mehr Compliance

  • Realität: Jede Regel schwächt alle anderen (Attention Budget)
  • 280 Zeilen CLAUDE.md → 50% ignoriert
  • 15 Anti-Patterns gleichzeitig → Analyse-Paralyse
  • Source: Harness-Analyse

2. Fire-and-Forget Sessions

  • 74 Sessions gestartet, <20 beendet (27%)
  • 71 Zombie-Prozesse nie aufgeräumt
  • Kein Session-Hygiene-System
  • Source: ANALYSE_KOMPLETT, FINAL_SYNTHESIS

3. Hyperfocus ohne Verification

  • 10 Features in einem Tag, 0 E2E Tests
  • Verification Score: 2/10
  • Unit Tests ≠ Integration Tests
  • Source: TAGESANALYSE_2026-03-09

4. Post-hoc Planung

  • Plans nachträglich generiert um Builds zu rechtfertigen
  • "Plan before build" — Regel existiert, wird nicht befolgt
  • Source: FORENSIK

5. 49 Parallel Mechanisms (V7)

  • Jeder Mechanism votiert, gewichteter Durchschnitt
  • Realität: Kein Mechanism konnte Opus zuverlässig beeinflussen
  • 45K LOC für ein Problem das 450 LOC lösen
  • Source: SIDECAR_EVOLUTION

6. Delegation ohne Verständnis

  • SidecarDashboard: delegiert gebaut, kann nicht debuggt werden
  • "Delegation ≠ Understanding"
  • Source: RETROSPEKTIVE_100_SESSIONS

7. Meta-Arbeit als Prokrastination

  • 25 .md Files erstellt statt Code zu schreiben
  • 8-Wochen-Plan nie abgeschlossen
  • Dokumentation als Ersatz für Execution
  • Source: ANALYSE_KOMPLETT

8. Tool Rejection Pattern

  • Fast jede Session beginnt mit "User rejected tool use"
  • Interrupts vor Abschluss → ineffiziente Feedback-Loops
  • Source: RETROSPEKTIVE_100_SESSIONS

9. Scope-Drift durch offene Fragen

  • Open-ended Fragen → Claude interpretiert als Green Light
  • Session 750f07: Start als Plan-Continuation → 3 neue Tasks + Selbstzweifel-Spirale
  • Source: FORENSIK, RETROSPEKTIVE

10. Unbegrenztes Memory-Wachstum

  • MEMORY.md wächst ohne Limit (12 KB vs Hermes 800 Token Cap)
  • Alte Einträge veralten, werden nie gelöscht
  • Memory-Pollution statt Memory-Curation
  • Source: Harness-Analyse (Hermes-Vergleich)

Anti-Patterns (Kill-Liste)

Anti-Pattern Warum schlecht Alternative
CLAUDE.md > 200 Zeilen Attention Budget additionalContext JIT
Alle Skills immer injizieren Context Pollution On-Demand via Keyword
Stateful Daemon State Corruption Risk Stateless Script
Mehr Mechanisms hinzufügen Diminishing Returns Messen + Reduzieren
Session ohne Recap starten Kein Drift-Bewusstsein /check-state pflicht
/auto (zu viel Magic) Unkontrollierbar Explizite Delegation
Parallel WebSearch Token-Verschwendung /research (Gemini)
Commit ohne Tests Regressions pytest vor Commit
Plan after Build Rationalisierung Plan → Review → Build
Memory ohne Expiry Veraltete Einträge Hard Cap + Curation

Kompensations-Mechanismen (ADHS-spezifisch)

Kompensation Wirkt gegen Status
Plan-Mode Impulsives Bauen aktiv
Sidecar-NG Injection Regel-Vergessen aktiv
/quickwin Task Paralysis aktiv
/focus Scope-Drift aktiv
/checkpoint Verlust-Angst aktiv
Session Recaps Cross-Session Drift inkonsistent
Eval-Framework Belief-driven Development aktiv
Coaching Hooks Vergessene Regeln aktiv
fear-map.md Angst-getriebene Entscheidungen aktiv