# sfeir-code-review-anneau-contraintes-2026-07-30

## Veille

Episode „Phase 5 · Review“ der SFEIR-Serie über den augmentierten SDLC, veröffentlicht **am selben Tag** wie Addy Osmanis LinkedIn-Beitrag, den sie in eine Phasenspezifikation übersetzt. These: **Qualität hat die Adresse gewechselt** — sie wird nicht mehr im Code gelesen (Agenten produzieren mehr davon, als irgendjemand reviewen kann), sondern in **dem Ring von Constraints, der den Agenten umgibt**. Osmanis Ring (sieben Dimensionen — Correctness, Security, Performance, Accessibility, Maintainability, **wirtschaftliche Effizienz**, **Verständlichkeit** — verbunden durch die **Back-Pressure**-Regel: „einer Loop wird nur die Autonomie zugestanden, die man günstig und zuverlässig verifizieren kann, keinen Zentimeter mehr“) wird neu gezeichnet, übersetzt und an Phase 5 des 11-Phasen-Zyklus von SFEIR angehängt. Das strukturierende Korollar: **der Flaschenhals war nie die Generierung, sondern die Verifikation** — „Generierung ist ein weiter Trichter, Verifikation ein enger Hals; wer den Trichter beschleunigt, verdickt den Stau am Hals.“ **Die interessanteste Design-Entscheidung ist eine Wahl der Zyklusarchitektur**: Review liegt bewusst **außerhalb der drei menschlichen Gates** (Define, Plan, Ship), denn das Gate auf Review zu legen würde bedeuten, menschliche Aufmerksamkeit — eine endliche Ressource — als Kontrollpunkt einer Generierungskapazität zu setzen, die selbst skaliert: „man hätte eine Pipeline gebaut, deren maximaler Durchsatz der Anzahl an Diffs entspricht, die ein Senior bis Feierabend lesen kann.“ Daher die Aufteilung: **Review instrumentiert, Ship entscheidet** — Review liefert einen *anfechtbaren Beweiskörper*, Ship entscheidet anhand der Beweise, nicht anhand des vollständigen Diffs. Eine Position gegen Monperrus (dessen Diagnose SFEIR übernimmt — die menschliche Inspektion jedes Diffs hält der agentischen Geschwindigkeit nicht stand —, dessen Schlussfolgerung sie aber zurückweist: Abnahme kann nicht delegiert werden). Die benannte Falle ist die **zirkuläre Validierung** (der Agent, der den Code schreibt, schreibt auch die Tests, die ihn validieren: „man hat einen Spiegel gebaut, keinen Ring“), mit fünf von Anthropic entlehnten Gegenmaßnahmen (unabhängige Gates in getrennten Context-Windows, deterministisch + agentisch ersetzen sich niemals gegenseitig, Shadow Mode, risikobasierte Abstufung, Logging ins SIEM) sowie der Warnung von Compare the Market (**AST-Graph ~70 % vs. Vector-RAG ~58 %**, RAG schneidet *schlechter ab als gar kein Kontext*). Die eigene Erweiterung der Firma ist **die Ratsche**: „jedes Entkommen wird zum Constraint“ — ein Fehler, der den Ring durchbrochen hat, wird *innerhalb des Rings* wieder geschlossen (Test, Lint-Regel, Rubrik, Harness-Guardrail), bei Compound-1, „das einzige Asset in der Kette, das an Wert gewinnt, während Modelle an Wert verlieren“ (ein internes, nicht auditiertes Maß: **− 30 % weniger Korrekturiterationen nach zehn Zyklen**). Der Artikel schließt mit einer Neuformulierung der Frage: „Ist dieser Code gut?“ lässt sich nicht mehr beantworten; was bleibt, ist **„Was lässt mein System nicht durch?“**

## Titre Article

Code review dans le SDLC augmenté : l'anneau de contraintes autour des agents

## Date

2026-07-30

## URL

https://www.sfeir.com/articles/sdlc-ai-review-anneau-contraintes/

## Keywords

Ring von Constraints, Constraints um Agenten, Review-Phase, Phase 5, augmentierter SDLC, SFEIR-11-Phasen-Zyklus, menschliche Gates, Define Plan Ship, Review instrumentiert Ship entscheidet, anfechtbarer Beweiskörper, Back-Pressure, Autonomie ≤ Verifizierbarkeit, günstige Verifizierbarkeit, Verifikations-Flaschenhals, weiter Trichter enger Hals, mehr Code als man lesen kann, Addy Osmani, Harness, Harness Engineering, Software Factories Light and Dark, dunkle Fabrik, dunkle Fabrik, sieben Constraint-Dimensionen, Correctness, Property Testing, Mutation Testing, Green/Red-Oracle, Security, SAST, DAST, Dependency Scanning, Secrets Detection, Performance, Performance-Budget, Load Testing, SLO, Accessibility, axe, Kontrast, Tastaturnavigation, Maintainability, Coverage, Komplexität, Blast Radius, Komponentengrenzen, architektonische Schuld, wirtschaftliche Effizienz, Token-Budget, Kosten pro Änderung, FinOps Token, TCO, CapEx OpEx, Verständlichkeit, Comprehension Debt, Comprehension Debt, Decision Log, an den PR angehängtes Decision Log, Intention geht nicht verloren sie wird weggeworfen, Martin Monperrus, Ende des Code Reviews, trügerisches Sicherheitsgefühl, vom Ersteller zum Prüfer, zirkuläre Validierung, zirkuläre Validierung, Spiegel, Augment Code, Paula Hingel, DORA 2025, Durchsatz vs. Stabilität, Anthropic, Jason Clinton, 80 % des gemergten Codes, unabhängige Gates, getrennte Context-Windows, deterministisch und agentisch, Shadow Mode, Shadow Mode, Red Team, risikobasiert abgestufte Codebasis, risikogewichtetes Sampling, SIEM-Logging, 16 % bis 54 %, ein Drittel der Incidents, was würden wir scannen wenn es fast nichts kosten würde, Compare the Market, Context Retrieval, struktureller Knowledge Graph, AST-Analyse, 70 % vs. 58 %, 79 Merge Requests, Vector-RAG, strukturelles Verständnis, Aufrufer Signaturen Hierarchien, Ratsche, Ratsche, jedes Entkommen wird zum Constraint, ein zweimal gesehener Bug ist ein Loch im System, Compound-1, Kapitalisierung statischer Lektionen, in Plan neu geladenes Gedächtnis, − 30 % der Korrekturiterationen, zehn Zyklen, wo der Schalter zu setzen ist, Licht aus, günstige hochfrequente schwer zu umgehende unmittelbare nicht driftende Kontrolle, kurze Loops, drei bis zehn Schritte, Context-Akkumulation, Authentifizierung Billing öffentlicher API-Vertrag, Ausführungsergebnis vs. Behauptung des Agenten, Constraints denen das Modell nicht widersprechen kann, was lässt mein System nicht durch

## Authors

SFEIR (voix éditoriale du cabinet, article non signé individuellement) — construit sur Addy Osmani (Google) ; cite Martin Monperrus, Paula Hingel (Augment Code), DORA/Google Cloud, Jason Clinton (Anthropic), l'équipe Engineering de Compare the Market

## Ton

**Profil**: ein Artikel operativer Doktrin, eine Episode einer nummerierten Serie („Phase 5 · Review“). Zielgruppe: Engineering-Führungskräfte, Architekten, CISOs, die bereits Agenten toolen und nach Ansatzpunkten für Kontrollen suchen. Professionelles, dichtes Register, geschliffenes Französisch, kein undefinierter Jargon, kein im Original unübersetzter Anglizismus (*back-pressure* und *comprehension debt* werden beibehalten, aber erläutert).

**Stil**: der **zugespitzte Ein-Satz-Schluss** am Ende jedes Absatzes ist der Motor des Textes und fast immer ein konkretes Bild statt einer Abstraktion — „Generierung ist ein weiter Trichter, Verifikation ein enger Hals; wer den Trichter beschleunigt, verdickt den Stau am Hals“; „man hat einen Spiegel gebaut, keinen Ring von Constraints“; „eine dunkle Fabrik tilgt diese Schuld nicht, sie geht sie mit Vollgas ein, Tests grün“; „Intention geht nicht verloren, sie wird weggeworfen“; „eine ausufernde Loop versteckt ihre Fehler in den Ecken“; „ein statischer Ring ist ein undichter Ring.“ Trichterförmige rhetorische Architektur: ein entlehntes Diagramm → seine Übersetzung in eine zweispaltige Tabelle (mechanisierbar / irreduzibel menschlich) → der benannte Fehlermodus → die eigene Erweiterung der Firma → fünf Selbstdiagnosefragen → eine Schlussfrage, die die Eingangsfrage ersetzt. Zwei für das Genre ungewöhnliche Sorgfaltsmerkmale: **jede externe Behauptung trägt eine nummerierte Fußnote** mit Status-Label (*Industry · Anthropic*, *Measured · SFEIR*), und das zentrale Diagramm wird **explizit kreditiert** („SFEIR-Diagramm nach dem Diagramm von Addy Osmani, © Addy Osmani, neu gezeichnet, übersetzt und an Phase 5 angehängt“).

**Epistemische Position**: als präskriptiv angelegt, jedoch mit zwei Gesten der Redlichkeit. Die erste ist die **explizite, begründete Meinungsverschiedenheit** mit Monperrus: SFEIR übernimmt seine Diagnose, weist seine Schlussfolgerung zurück und begründet dies (Abnahme kann nicht delegiert werden — das ist das Ship-Gate), statt sie zu ignorieren oder zu karikieren. Die zweite ist der **in Erinnerung gerufene Nutzungsvorbehalt zu den Anthropic-Zahlen** („die Zahlen stammen von Anthropic über sich selbst“), bereits in der Notiz vom 26. Juli festgehalten. Die Begrenzung des Textes spiegelt seine Stärke: **er wird am selben Tag veröffentlicht wie der Osmani-Beitrag, den er kommentiert**, was wenig Raum für die Bewährungsprobe der Zeit oder für Widerspruch lässt — und seine einzige eigene Zahl (− 30 % der Iterationen nach zehn Zyklen) ist hauseigen, nicht auditierbar, ohne Beschreibung von Protokoll oder Geltungsbereich. Der abschließende CTA („Instrumentieren Sie Ihre Review-Phase, bevor Sie die agentischen Schleusen öffnen“) erinnert daran, dass die Doktrin auch ein Angebot ist.

## Pense-betes

- **Art der Notiz**: Dies ist ein **Framing-Artikel**, keine Primärquelle für Ergebnisse. Der eigene Wert des Textes beschränkt sich auf drei Punkte, alles andere ist sourced Synthese: (1) **Review außerhalb der menschlichen Gates** und die Aufteilung „Review instrumentiert / Ship entscheidet“; (2) **die Verknüpfung der Ratsche mit Compound-1** als der dafür zuständigen Phase; (3) die eigene Zahl der Firma von − 30 %. Die Zahlen von Anthropic oder Compare the Market nicht über diese Notiz nachzitieren: auf die Quellnotizen zurückgreifen.
- ⚠️ **Zwei zitierte Osmani-Quellen sind NICHT im Korpus** und die besten Kandidaten für eine Ergänzung nach dieser Notiz: *Set the constraints around your agents* (LinkedIn, **30. Juli 2026** — dies ist das Original-Diagramm) und vor allem ***Software Factories, Light and Dark*** (addyosmani.com, Juli 2026), das allein **drei** der hier aufgegriffenen strukturierenden Konzepte trägt — das Back-Pressure-Prinzip, die operationalisierte *Comprehension Debt* sowie die praktikable Länge von Loops (3 bis 10 Schritte, ab etwa zwanzig verliert man den Faden). Das Korpus enthält *Comprehension Debt* über [[osmani-cognitive-surrender-comprehension-debt-2026-05-05]] und die *Ratsche* über [[osmani-agent-harness-engineering-2026-04-19]], jedoch nicht den Essay, der sie mit der Metapher der beleuchteten/unbeleuchteten Fabrik verknüpft.
- ⚠️ **Zu beachtende Zitierabweichung**: SFEIR verweist auf Monperrus unter dem Titel „The End of Code Review: How AI Agents Supersede Human Code Review.“ Der von der Korpus-Notiz getragene Titel (arXiv 2606.13175) lautet „The End of Code Review: Coding Agents Supersede Human Inspection.“ Gleicher Artikel, gleiches Datum (11. Juni 2026); es ist die Formulierung von SFEIR, die abweicht. Für die formale Zitierung den arXiv-Titel verwenden.
- **Das Raster Dimension für Dimension ist wiederverwendbares Asset Nr. 1** — eine zweispaltige Tabelle, direkt übertragbar in eine Review-Phasenspezifikation, Dimension → mechanisierbarer Constraint → residuales menschliches Urteil:
- **Correctness**: Unit-, Property-, Mutation-Testing, Green/Red-Oracle → *funktionale Abnahme*
- **Security**: SAST/DAST, Dependency-Scanning, Secrets-Detection, dediziertes agentisches Review → *Abwägung des Restrisikos*
- **Performance**: Performance-Budget, Load-Testing, gemessene Regression → *SLO-Definition*
- **Accessibility**: axe, Kontrast, Tastaturnavigation → *das tatsächlich erlebte Nutzererlebnis*
- **Maintainability**: Coverage, Komplexität, Blast Radius, Komponentengrenzen → *anerkannte architektonische Schuld*
- **Understandability**: Der Agent protokolliert, was er versucht hat **und was er verworfen hat**, ein an den PR angehängtes Decision Log → *Rekonstruktion der Intention*
- **Wirtschaftliche Effizienz**: Token-/Compute-Budget pro Task, Kosten pro Änderung → *TCO und der CapEx/OpEx-Trade-off*
- **Back-Pressure** (die Regel, die alle sieben verbindet): Autonomie ≤ günstige Verifizierbarkeit → *wo der Schalter zu setzen ist*
- **Das stärkste Architekturargument, wörtlich in einem Gremium wiederverwendbar**: Trüge Review das menschliche Gate, wäre „der Kontrollpunkt des Systems die menschliche Aufmerksamkeit, eine endliche, nicht skalierende Ressource, die einer selbst skalierenden Generierungskapazität gegenübersteht“ — also **würde sich der Hals nie weiten**, und „man hätte eine Pipeline gebaut, deren maximaler Durchsatz der Anzahl an Diffs entspricht, die ein Senior bis Feierabend lesen kann.“ Dies ist das Argument, das rechtfertigt, das Gate zu Ship zu *verschieben*, statt den Menschen zu *entfernen*.
- **Zu merkende operative Unterscheidung**: Review hat ein **Deliverable** (einen anfechtbaren Beweiskörper), Ship hat eine **Entscheidung** — „und diese Entscheidung fällt anhand der Beweise, nicht anhand des vollständigen Diffs.“
- **Die vergessene Dimension, und warum**: **Understandability** wird systematisch ausgelassen, „weil sie die CI nicht bricht.“ Die Abhilfe ist die günstigste im Raster und die am wenigsten angewandte — den Agenten aufzufordern niederzuschreiben, was er versucht und verworfen hat, denn „das Review eines agentischen PR ist der erste Moment, in dem ein Mensch das *Warum* rekonstruiert.“ Bemerkenswerter Satz: **„Intention geht nicht verloren, sie wird weggeworfen.“**
- **Zirkuläre Validierung, ein vor einem Team zu benennender Fehlermodus**: Der Agent schreibt den Code, derselbe Agent schreibt die Tests, die CI ist grün → „ein Spiegel, kein Ring.“ Begriff entlehnt von Augment Code ([[hingel-augment-how-ai-changes-sdlc-six-stages-2026-06-08]]); die Messung des Phänomens stammt aus DORA 2025 (KI-Adoption korreliert **positiv mit Durchsatz** und **negativ mit Stabilität**, wenn die Grundlagen nicht mithalten). Diagnosefrage Nr. 2 des Artikels, die ergiebigste der fünf: *„Werden Ihre Tests von demselben Agenten geschrieben, der den Code schreibt?“*
- **Qualifizierungskriterien für eine autonome Loop** (wiederverwendbare Fünf-Punkte-Checkliste): Die Kontrolle muss **günstig, hochfrequent, schwer zu umgehen, unmittelbar und nicht driftend** sein. Qualifizierende Beispiele: Green/Red-Oracle, Type-Gate, Property-Tests, ein agentischer Reviewer mit einer echten Rubrik. Nicht zu verlierendes Korollar: **kurze Loops verifizieren besser als lange** (ein Agent hält sich 3 bis 10 Schritte lang, verliert ab etwa zwanzig den Faden) — „eine ausufernde Loop versteckt ihre Fehler in den Ecken.“
- **Wo das Licht anzulassen ist**: subtile, für Tests unsichtbare Bugs, große Blast Radii, Entscheidungen, die ein Jahr Arbeit strukturieren — nämlich **Authentifizierung, Billing, öffentliche API-Verträge**. Und die Governance-Warnung: „das eigentliche Risiko besteht darin, jeden Schalter gleich zu setzen“ (alle aus → vier Monate später demontiert; alle an → es wird nichts mehr geshippt).
- **Die Ratsche, die eigene Erweiterung von SFEIR**: „**jedes Entkommen wird zum Constraint**“ — ein Fehler, der den Ring durchbrochen hat, wird nicht nur im Code behoben, er **schließt sich innerhalb des Rings wieder** (Test, Lint-Regel, Review-Rubrik, Harness-Guardrail), bei **Compound-1**, mit einem in der Plan-Phase des nächsten Zyklus neu geladenen Gedächtnis. Dies ist Osmanis *Ratchet Principle* (jeder Fehler wird zu einer Regel, vgl. [[osmani-agent-harness-engineering-2026-04-19]]) **verdrahtet mit einer Phase des Zyklus, die explizit dafür zuständig ist** — genau hier und nirgendwo sonst fügt das Framework von SFEIR dem entlehnten Diagramm etwas hinzu. Zwei Sätze: „eine Checkliste wird einmal geschrieben und veraltet, der Ring verdickt sich mit jedem Zyklus“ und „**ein zweimal gesehener Bug ist kein Bug, es ist ein Loch im System**.“
- ⚠️ **Mit Vorsicht zu behandelnde Zahl**: **− 30 % weniger Korrekturiterationen nach zehn Zyklen** ist als *Measured · SFEIR* gekennzeichnet, hauseigenes Material von 2026 — **es wird kein Protokoll, kein Geltungsbereich, keine Stichprobengröße und keine Definition von „Korrekturiteration“ angegeben**. Es ist die einzige eigene Zahl des Artikels und stützt seine kommerziell nützlichste These (der Ring als wertsteigerndes Asset). Nicht ohne Einschränkung gegenüber Kunden weiterverwenden.
- **Bemerkenswerter ökonomischer Aphorismus**: der Ring ist „das einzige Asset in der Kette, das **an Wert gewinnt, während Modelle an Wert verlieren**“ — ein Investitionsargument (das Harness überlebt Modellwechsel), zu verknüpfen mit der Harness-Engineering-Doktrin.
- **Wirtschaftliche Effizienz in einem *Qualitäts*-Raster**: der Punkt ist theoretisch interessant und in einem einzigen Satz begründet — „ein Token-Budget pro Task ist ein Constraint auf derselben Stufe wie ein Performance-Budget, und es erzeugt dieselbe Tugend, **die Autonomie durch die Kosten ihrer Verifikation zu begrenzen**.“ Dies ist die Schnittstelle FinOps ↔ Qualität, komplementär zum Blickwinkel „risikobasierte Abstufung = FinOps-Policy“ in der Notiz vom 26. Juli.
- **Metadaten**: veröffentlicht am **30. Juli 2026**, unsigniert (Firmenstimme), Site-Tags `sdlc`, `ia-agentique`, `software-factory`, `harness-engineering`, `code-review`. Acht nummerierte Quellen mit Status-Labels. **Am selben Tag veröffentlicht wie der kommentierte Osmani-Beitrag** — ein bemerkenswerter Umlauf, der an sich schon als Tech-Watch-Fakt gelten kann (die Firma verfolgt Osmanis LinkedIn-Thread in Echtzeit und wandelt ihn in eine Serienepisode um). Der Artikel verweist auf einen **im Korpus fehlenden** SFEIR-Text: *Code review in the age of AI: from creator to verifier* (1. April 2026) — Kandidat für eine Ergänzung, bereits in der Notiz vom 26. Juli markiert.
- **Verknüpfungen im Tech-Watch-Dossier**:
- **Hauseigenes Framework, zuerst zu lesen**: [[sfeir-sdlc-ia-cycle-11-phases-2026-06-16]] (die 11 Phasen und die 3 Gates — unverzichtbar, um „Phase 5, zwischen Verify und Compound-1“ einzuordnen) und [[sfeir-sdlc-pdlc-articulation-2026-07-22]].
- **Zwillingsnotiz, dieselbe Woche**: [[sfeir-anthropic-sdlc-ai-native-securise-2026-07-26]] — die hier aufgegriffenen fünf Anti-Zirkularitäts-Mechanismen sind ihr Thema; diese Notiz trägt die *Phasenspezifikation*, jene die *Möglichkeitsbedingung des Zyklus*.
- **Quelle der Anthropic-Zahlen**: [[clinton-anthropic-secure-ai-native-sdlc-2026-07-21]] (16 % → 54 %, ein Drittel der Incidents, Shadow Mode, risikobasierte Abstufung, SIEM).
- **Osmani, konzeptuelle Grundlage**: [[osmani-agent-harness-engineering-2026-04-19]] (Harness, *Ratchet Principle*) und [[osmani-cognitive-surrender-comprehension-debt-2026-05-05]] (*Comprehension Debt*, PRs von ~100 Zeilen, Review nach Junior-Standard) — die „Understandability“-Dimension des Rings ist genau der strukturelle Guardrail, den Cognitive Surrender einforderte.
- **Bewusst eingenommene antagonistische Position**: [[monperrus-end-of-code-review-agents-supersede-2026-06-11]] — SFEIR übernimmt die Diagnose, weist die Schlussfolgerung zurück.
- **Benachbartes Framework, zum Vergleich der Gate-Anzahl**: [[williams-adlc-2-two-human-gates-2026-06-12]] (**zwei** menschliche Gates) gegenüber den **drei** von SFEIR; [[williams-adlc-4-prosecution-not-code-review-2026-06-12]] (Review als Anklageschrift, dieselbe Verschiebung hin zu Beweisen); [[williams-adlc-3-tests-are-the-spec-2026-06-12]] (der Test als eine Sprache, der der Builder nicht widersprechen kann — Osmanis Formulierung über „Constraints, denen das Modell nicht widersprechen kann“ ist ihr Gegenstück); [[williams-adlc-6-lifecycle-gets-cheaper-2026-06-12]] (der Zyklus, der sich mit jedem Durchlauf verbessert = die Ratsche).
- **Zirkuläre Validierung und der Spiegeleffekt**: [[hingel-augment-how-ai-changes-sdlc-six-stages-2026-06-08]], [[dora-report-2025-ai-software-dev-2025-09-23]], [[dora-google-cloud-roi-ai-assisted-software-development-j-curve-2026-04-21]].
- **Kontext für einen KI-Reviewer**: [[comparethemarket-context-retrieval-ai-code-review-gkg-rag-2026-03-06]] — die Quelle der Zahlen ~70 % (AST-Graph) vs. ~58 % (RAG) über 79 MRs; vor dem Aufbau eines agentischen Reviews auf Vector-RAG zu lesen.
- **Fabrik-Metapher**: [[mccarthy-strongdm-software-factory-agentic-moment-2026-02-06]] und [[wescale-usine-logicielle-augmentee-juge-strategique-2026-05-03]] — „die dunkle Fabrik“ (lights-out factory) stammt aus *Software Factories, Light and Dark*.
- **Token-FinOps (Dimension wirtschaftliche Effizienz)**: [[tokenomics-foundation-linux-finops-token-economics-about-2026-06-03]], [[gupta-token-budget-wars-marginal-token-utility-2026-05-28]], [[beck-starving-genies-usage-limits-ai-coding-2026-04-03]].
- **Der Wandel vom Ersteller zum Prüfer**: [[exit-vibe-coding-place-vibe-reviewing-mogere-2025-07-07]].

## RésuméDe400mots

Fünfte Episode der SFEIR-Serie über den augmentierten SDLC, gewidmet der Review-Phase, veröffentlicht am selben Tag wie Addy Osmanis LinkedIn-Beitrag, den sie in eine Phasenspezifikation überführt.

Die Ausgangsbeobachtung: Qualität wurde früher im Code gelesen; Agenten produzieren heute mehr davon, als irgendjemand reviewen kann. Sie hat daher **die Adresse gewechselt** — sie lebt in **dem Ring von Constraints**, der den Agenten umgibt, also im Harness. Sieben Dimensionen bilden diesen Ring (Correctness, Security, Performance, Accessibility, Maintainability, wirtschaftliche Effizienz, Verständlichkeit), verbunden durch die **Back-Pressure**-Regel: einer Loop wird nur die Autonomie zugestanden, die man günstig und zuverlässig verifizieren kann. Das Korollar stellt die vorherrschende Intuition auf den Kopf: Der Flaschenhals war nie die Generierung, sondern die Verifikation — „Generierung ist ein weiter Trichter, Verifikation ein enger Hals; wer den Trichter beschleunigt, verdickt den Stau am Hals.“

Daher die zentrale Architekturentscheidung: Im Elf-Phasen-Zyklus ist **Review bewusst kein menschliches Gate**. Die drei unantastbaren Gates sind Define, Plan und Ship. Das Gate auf Review zu legen würde menschliche Aufmerksamkeit — eine endliche Ressource — als Kontrollpunkt einer Generierung setzen, die selbst skaliert: der Hals würde sich nie weiten. **Review instrumentiert, Ship entscheidet**; Review erzeugt einen anfechtbaren Beweiskörper, und die Entscheidung fällt anhand der Beweise, nicht anhand des vollständigen Diffs. SFEIR übernimmt von Monperrus, dass die menschliche Inspektion jedes Diffs der agentischen Geschwindigkeit nicht standhält, weist aber seine Schlussfolgerung zurück: Abnahme kann nicht delegiert werden.

Die operative Übersetzung ist eine Tabelle Dimension für Dimension, die trennt, was mechanisierbar ist, von irreduzibel menschlichem Urteil. Die systematisch vergessene Dimension ist **Verständlichkeit**, „weil sie die CI nicht bricht“ — daher die günstigste Abhilfe im Raster: den Agenten protokollieren zu lassen, was er versucht und verworfen hat, denn „Intention geht nicht verloren, sie wird weggeworfen.“

Der benannte Fehlermodus ist die **zirkuläre Validierung**: Der Agent, der den Code schreibt, schreibt auch die Tests, die ihn validieren, die CI ist grün — „man hat einen Spiegel gebaut, keinen Ring.“ Fünf Gegenmaßnahmen sind von Anthropic entlehnt (unabhängige Gates, deterministisch + agentisch, Shadow Mode, risikobasierte Abstufung, SIEM-Logging), und Compare the Market warnt, dass ein auf Vector-RAG aufgebauter Reviewer das Review verschlechtert (~70 % bei einem AST-Graphen gegenüber ~58 %).

Die eigene Erweiterung der Firma ist **die Ratsche**, angehängt an Compound-1: Jedes Entkommen wird zum Constraint. Der Ring verdickt sich mit jedem Zyklus — „das einzige Asset in der Kette, das an Wert gewinnt, während Modelle an Wert verlieren“ (− 30 % weniger Korrekturiterationen nach zehn Zyklen, ein internes Maß). Nur eine Frage bleibt: **Was lässt mein System nicht durch?**

## GrapheDeConnaissance

- SFEIR —affirme_que→ la qualité logicielle ne se lit plus dans le code mais dans l'anneau de contraintes qui entoure l'agent (AFFIRMATION, 0.98)
- anneau de contraintes —est_basé_sur→ Addy Osmani (PERSONNE, 0.97)
- SFEIR —affine→ anneau de contraintes (CONCEPT, 0.96)
- anneau de contraintes —fait_partie_de→ cycle SFEIR à 11 phases (METHODOLOGIE, 0.95)
- back-pressure —fait_partie_de→ anneau de contraintes (CONCEPT, 0.96)
- Addy Osmani —affirme_que→ "on ne confie à une boucle que l'autonomie qu'on sait vérifier à faible coût et de façon fiable, pas un pouce de plus" (CITATION, 0.96)
- SFEIR —affirme_que→ le goulot n'a jamais été la génération mais la vérification : accélérer la génération ne fait qu'épaissir le tas au col de la vérification (AFFIRMATION, 0.97)
- phase Review (SDLC) —fait_partie_de→ cycle SFEIR à 11 phases (METHODOLOGIE, 0.97)
- SFEIR —affirme_que→ "Review instrumente. Ship décide." — Review livre un faisceau de preuves opposable, Ship décide sur les preuves et non sur le diff intégral (CITATION, 0.97)
- SFEIR —affirme_que→ placer le gate humain sur Review ferait de l'attention humaine le point de contrôle d'une génération qui scale, plafonnant le débit au nombre de diffs qu'un senior peut lire dans une journée (AFFIRMATION, 0.96)
- SFEIR —s_oppose_à→ The End of Code Review: Coding Agents Supersede Human Inspection (DOCUMENT, 0.93)
- Martin Monperrus —affirme_que→ le modèle hybride "l'agent écrit, l'humain relit" est intenable et générateur d'une fausse sécurité (AFFIRMATION, 0.95)
- validation circulaire —est_instance_de→ mode d'échec de la revue agentique (CONCEPT, 0.95)
- Augment Code —référence→ validation circulaire (CONCEPT, 0.94)
- DORA 2025 —mesure→ "l'adoption de l'IA est corrélée positivement au débit de livraison et négativement à la stabilité quand les fondations ne suivent pas" (MESURE, 0.93)
- compréhensibilité —réduit→ comprehension debt (CONCEPT, 0.94)
- journal de décision —permet→ reconstruction de l'intention derrière une PR agentique (CONCEPT, 0.95)
- SFEIR —affirme_que→ "l'intention n'est pas perdue, elle est jetée" (CITATION, 0.95)
- budget de tokens par tâche —est_instance_de→ contrainte de qualité au même titre qu'un budget de performance (CONCEPT, 0.93)
- cliquet de l'anneau —est_basé_sur→ ratchet principle (CONCEPT, 0.95)
- cliquet de l'anneau —fait_partie_de→ Compound-1 (CONCEPT, 0.94)
- SFEIR —recommande→ toute échappée devient une contrainte : un défaut qui a franchi l'anneau se referme dans l'anneau sous forme de test, de règle de lint, de rubrique de revue ou de garde-fou de harnais (AFFIRMATION, 0.97)
- SFEIR —affirme_que→ "l'anneau s'épaissit à chaque cycle, et c'est le seul actif de la chaîne qui s'apprécie pendant que les modèles se déprécient" (CITATION, 0.95)
- SFEIR —mesure→ "− 30 % d'itérations de correction après dix cycles" (mesure interne first-party, protocole non publié) (MESURE, 0.78)
- Compare the Market —mesure→ "le graphe de connaissance structurel construit par analyse de l'AST place un commentaire en ligne pertinent dans environ 70 % des cas contre 58 % pour le RAG vectoriel, sur 79 merge requests" (MESURE, 0.92)
- graphe de connaissance structurel —surpasse→ RAG vectoriel (TECHNOLOGIE, 0.93)
- SFEIR —recommande→ qualifier une boucle pour l'autonomie sur cinq critères de contrôle — peu coûteux, à haute fréquence, difficile à contourner, immédiat et non dérivant (AFFIRMATION, 0.95)
- boucles courtes —améliore→ vérifiabilité d'un agent (CONCEPT, 0.92)
- SFEIR —recommande→ garder la revue humaine sur l'authentification, la facturation et les contrats d'API publics, et réviser chaque interrupteur à chaque Compound (AFFIRMATION, 0.94)
- SFEIR —recommande→ remplacer la question "ce code est-il bon ?" par "qu'est-ce que mon système refuse de laisser passer ?" (AFFIRMATION, 0.96)

---
Canonical: https://www.thekb.eu/de/fiches/sfeir-code-review-anneau-contraintes-2026-07-30/
