Alle Projekte
Eigenes Werkzeug · Context Engineering2026OPEN SOURCE

Harness Creator

Eine durchsuchbare Bibliothek aus über 25.000 Claude-Code-Bausteinen, aus der sich ein Agent genau das holt, was ein Projekt braucht – ohne sein Kontextfenster zu füllen.

25.655
Bausteine aus 14 Repos
21 MB → 5,6 KB
Kontext beim Einstieg
0
Externe Abhängigkeiten
19
Routing-Evals

Meine Rolle

Konzept, Doktrin, Umsetzung von CLI, Extractor, Hooks, Evals und Wissensbank – eigenes Werkzeug, öffentlich auf GitHub

Art

Eigenentwicklung – Konzept, Umsetzung und Betrieb in Eigenregie.

Ausgangslage

Das Problem

Es gibt inzwischen dutzende Repos voller guter Claude-Code-Bausteine. Der naheliegende Weg – alle klonen und den Agenten draufloslassen – funktioniert nicht: Der katalogisierte Bestand umfasst über 25.000 Bausteine. Ein Agent, der die durchliest, hat sein Kontextfenster voll, bevor er die erste Zeile Projektcode gesehen hat. Er trifft dann keine bessere Auswahl, sondern gar keine. Das Problem ist kein Suchproblem, sondern ein Budgetproblem: Kontext ist die knappe Ressource.

Lösung

Der Ansatz

Der Katalog ist in drei Ebenen geschnitten. Ebene 1 ist eine Einstiegsdatei von rund hundert Zeilen, die der Agent komplett liest. Ebene 2 sind zwölf Domänen-Kataloge von 10 bis 60 KB, von denen er gezielt einen öffnet. Ebene 3 ist der 21-MB-Index, den niemand liest außer dem CLI: Es filtert und gibt zwanzig Zeilen zurück. Damit das im fremden Projekt auch gilt, schreibt die Installation einen idempotenten Regelblock in dessen CLAUDE.md und ein Manifest mit Commit und Prüfsumme je Baustein. Die Zugriffsregel ist nicht nur Prosa: Ein Hook blockt jeden Lesezugriff auf den Rohindex. Repos mit über 2.000 Bausteinen gelten als Massen-Repos und bleiben aus der Standardsuche draußen, Bausteine ohne brauchbare Beschreibung landen in Quarantäne. Sechs Rezepte je Projekttyp sagen, womit man anfängt, und eine Wissensbank mit rund 7.600 Zeilen begründet jede Entscheidung – auch die verworfenen.

Ergebnis

Was dabei herauskam

Ein neues Projekt bekommt mit einem Satz („bau mir das Harness") eine begründete, zur Bestätigung vorgelegte Auswahl aus 25.655 Bausteinen, ohne dass der Agent den Katalog je gesehen hat. Die Qualität ist gemessen: 19 Routing-Evals mit Pflichtfällen laufen nach jedem Katalog-Neubau, und ein Update, das die Suche verschlechtert, gilt als gescheitert. Drei Kommandos liefern CI-taugliche Exit-Codes – für Evals, für die Wissensbank und für Drift zwischen Zielprojekt und Katalog. Die Bibliothek wendet ihre Regeln auf sich selbst an und ließ ihre eigenen Behauptungen von einem Prüf-Agenten gegenlesen, der vier echte Fehler fand. Entstanden in 17 Tagen, öffentlich auf GitHub.

Funktionen

Was drin steckt

01

Drei Ebenen statt ein Kontextfenster

Einstiegsdatei von rund hundert Zeilen, zwölf Domänen-Kataloge von 10 bis 60 KB, darunter der 21-MB-Index. Der Agent liest die erste Ebene ganz, die zweite gezielt und die dritte nie. Ebene 1 und 2 werden bei jedem Katalog-Neubau erzeugt, nicht gepflegt – auch die Befehlsliste kommt aus dem Dispatcher des CLI.

02

Das CLI filtert, nicht der Agent

Ein Hook blockt jeden Lese-, Grep- und Glob-Zugriff auf den Rohindex und die geklonten Quellen. Die Regel stand vorher an acht Stellen als Text – so viel wiederholte Prosa war selbst der Beleg, dass sie bruchgefährdet ist. Bewusst nicht auf Bash ausgeweitet: Ein Hook, der legitime Aktionen blockt, wird abgeschaltet und schützt dann gar nichts mehr.

03

Der Regelblock im Zielprojekt

Ein dreistufiger Index nützt nichts, wenn der Agent im fremden Projekt nicht weiß, dass er ihn benutzen soll. Deshalb schreibt die Installation einen über Marker idempotenten Regelblock in dessen CLAUDE.md und ein Manifest, das je Baustein Herkunfts-Repo, Commit und Prüfsumme festhält.

04

Absicht statt Stichwort

Dreizehn hinterlegte Absichten wie „prüfen", „absichern" oder „ausliefern" bündeln Suchen und Ankerbausteine. Ein Glossar aus 39 deutsch-englischen Fachbegriffspaaren und Flexions-Matching sorgen dafür, dass „Sicherheit prüfen" den Security-Reviewer findet – der Eval-Fall dazu war vorher rot.

05

Massen-Repos ausgeblendet

Ein einzelnes Repo liefert 24.500 Rechts-Skills und würde jede Suche dominieren. Repos über 2.000 Bausteinen gelten als Massen-Repos: katalogisiert, aber nur über Repo, Domäne oder ausdrückliches Alles erreichbar. Im Standardzugriff bleiben 1.104 Bausteine.

06

Quarantäne und gehärteter Extractor

Bausteine ohne wortinhaltliche Beschreibung fallen aus der Suche, bleiben aber sichtbar samt Grund. Der Extractor verwirft React-Hooks, die als Claude-Hooks durchgingen, und Übersetzungsstümpfe, die Originale überschrieben. Die Quarantäne sank von 15 auf 8, nachdem Beschreibungen auch aus JSDoc, Docstrings und JSON gelesen werden.

07

Evals als Sperre für Updates

19 Routing-Fälle, davon 13 Pflichtfälle, laufen nach jedem Katalog-Neubau mit Rangvergleich gegen den letzten Lauf. Der Update-Befehl hängt seinen Exit-Code daran: Ein Update, das die Suche verschlechtert, ist kein erfolgreiches Update. Die Begründung steht im Testdatensatz selbst: Suchqualität driftet still.

08

Drift zwischen Projekt und Katalog

Der Befehl check vergleicht das Manifest des Zielprojekts mit dem heutigen Katalog und meldet je Baustein aktuell, geändert, entfernt oder lokal verändert – mit Exit 1 bei Brüchen, CI-tauglich. Ältere Manifeste ohne Prüfsumme erscheinen ausdrücklich als ungeprüft: Schweigen heißt dort nicht unverändert.

09

Rezepte und begründete Wissensbank

Sechs Rezepte je Projekttyp nennen ein Kern-Set zum Kürzen, Erweiterungen mit Bedingung und Bewusst Weggelassenes. Acht Wissensdateien plus Protokoll begründen jede Entscheidung, tragen Quellen und Verfallsdatum im Frontmatter und führen ein eigenes Kapitel für verworfene Vorschläge – samt Grund.

10

Herkunft statt Kopie

Das Repo enthält keinen fremden Baustein, nur Katalog, Werkzeug und Begründungen. Jedes Quell-Repo steht mit Commit-Hash und einer Vertrauensstufe im Katalog. Ein Vertrauens-Tiebreaker in der Suche wurde gebaut und wieder verworfen, weil er beschreibungslose Einträge nach oben hob: Fachliche Passung schlägt Herkunft.

11

Die Bibliothek prüft sich selbst

Ihre eigene CLAUDE.md trägt denselben Regelblock, den sie in jedes Zielprojekt schreibt. Ein Prüf-Agent mit Standardhaltung „ablehnen" liest Ergebnisse gegen, nicht Begründungen – und fand vier echte Fehler, darunter eine ODER-Suche, die als UND gedacht war, und eine Wissensdatei, die das Gegenteil des tatsächlichen Verhaltens behauptete.

12

Zahlen, die sich selbst kontrollieren

Drei Dateien trugen einmal drei verschiedene Bestandszahlen. Seitdem prüft lint jede Zahl gegen den Katalog, Zeilennummern sind in der Doku verboten, und jeder Katalog-Neubau schreibt Hygiene-Kennzahlen als Zeitreihe ins Changelog – inklusive des offen ausgewiesenen verfehlten Ziels für die Auffang-Domäne.

Technik

Eingesetzter Stack

Werkzeug

Node.js, nur StandardbibliothekCLI mit 15 Kommandos4.280 Zeilenkeine package.json

Harness

3 Skills5 Subagenten2 Hooks (PreToolUse, Stop)settings.json

Katalog

14 Quell-Repos12 Domänen-Kataloge13 Absichten (intents.yaml)index.json 21 MB

Qualität

19 Routing-Evalslint, check, eval mit Exit-CodesHygiene-Kennzahlen im ChangelogWissensbank mit Verfallsdatum

Weitere Projekte

Ähnliches Vorhaben? Schreib mir.

Ob SaaS-Plattform, KI-Integration oder ein internes Werkzeug, das jemandem den Tag zurückgibt – ich bringe Ideen schnell und professionell zum Laufen.