Zum Inhalt springen
Methodik

Harness engineering

Harness engineering — Methodik. Kategorie: Engineering-Praxis zum Aufbau von Vertrauen in Coding-Agenten · Definition: Deterministische Kontrollschicht, Leitplanken, Strukturierung der in die KI eingespeisten Informationen und Überprüfung des erzeugten Codes · dominanter_zeitraum: 2026

Drei Ingenieure bei OpenAI, später sieben, produzierten in fünf Monaten rund eine Million Zeilen Code, ohne eine einzige Zeile von Hand zu schreiben; Codex-Agenten öffneten, bewerteten und mergten etwa 1,500 Pull Requests, im Durchschnitt 3.5 pro Ingenieur und Tag. Die Methodik hinter dieser Zahl, harness engineering, behandelt die Umgebung um das Modell als das eigentliche Engineering-Objekt: Repository-Struktur, CI-Konfiguration, ein striktes Modell von Abhängigkeitsschichten, eigene Linter, deren Fehlermeldungen Korrekturanweisungen direkt in den Kontext des Agenten einspeisen, sowie wiederkehrende Garbage-Collection-Aufgaben, die automatisch gemergte Refactoring-PRs eröffnen.

Viv Trivedys Gleichung, von Addy Osmani am 19. April 2026 zitiert, liefert dem Feld seinen Slogan: "Agent = Model + Harness. If you're not the model, you're the harness." Osmani verweist auf Terminal Bench 2.0, wo Claude Opus 4.6 innerhalb von Claude Code schlechter abschneidet als dasselbe Modell in einem eigens entwickelten Harness, sowie auf Trivedys Team, das einen Coding-Agenten allein durch eine Änderung des Harness von Platz 30 auf Platz 5 brachte.

Birgitta Böckeler unterteilt die Praxis in zwei Bereiche: guides, die vorausschauenden Kontrollen (Konventionen, Spezifikationen, Skills, MCP-Server), und sensors, die rückkoppelnden Kontrollen (Linter, Tests, statische Analyse). Jede von beiden kann algorithmisch oder inferenzbasiert sein. Der Verhaltens-Harness bleibt ihrer Darstellung nach ungelöst, weil KI-generierte Testsuiten noch nicht zuverlässig genug sind, um zu prüfen, ob eine Anwendung das tut, was sie soll.

Bei BFM Business datierte Rémi Jacquet von Cast Software am 5. Mai 2026 den Wendepunkt: prompt engineering im Jahr 2024, Context Engineering im Jahr 2025, harness engineering im Jahr 2026. Seine Warnung lief dem Optimismus des Segments zuwider: Je stärker die KI wird, desto mehr lässt die Wachsamkeit nach.

Typ
Methodik
Kategorie
Engineering-Praxis zum Aufbau von Vertrauen in Coding-Agenten
Definition
Deterministische Kontrollschicht, Leitplanken, Strukturierung der in die KI eingespeisten Informationen und Überprüfung des erzeugten Codes
dominanter_zeitraum
2026
Relationen
10
Zitiert in
4 fiches

Nachbarschaft

Capteurs feedback Guides feedforward Contraintes architec… Ingénierie de contexte Viv Trivedy Cast Software Garbage collection (… ratchet principle Context engineering

→ verwendet

Capteurs feedback CONCEPT hohe Konfidenz zeitlos Quelle ↗
Guides feedforward CONCEPT hohe Konfidenz zeitlos Quelle ↗

→ basiert auf

Contraintes architecturales CONCEPT hohe Konfidenz zeitlos Quelle ↗
Ingénierie de contexte CONCEPT hohe Konfidenz zeitlos Quelle ↗
Garbage collection (code) CONCEPT hohe Konfidenz zeitlos Quelle ↗
ratchet principle CONCEPT hohe Konfidenz zeitlos Quelle ↗

← hat erschaffen

Viv Trivedy PERSONNE hohe Konfidenz stabil Quelle ↗

← empfiehlt

Cast Software ORGANISATION hohe Konfidenz dynamisch Quelle ↗

→ ist eine Variante von

Context engineering METHODOLOGIE hohe Konfidenz zeitlos Quelle ↗

→ ersetzt

Context Engineering METHODOLOGIE hohe Konfidenz stabil Quelle ↗

Zitiert in (4)