Saltar al contenido

root / tags / comprehension-debt

#comprehension debt

3 fiches

Calidad y Seguridad Traducción verificada automáticamente

Code review dans le SDLC augmenté : l'anneau de contraintes autour des agents

Episodio «Fase 5 · Review» de la serie de SFEIR sobre el SDLC aumentado, publicado **el mismo día** que la publicación de Addy Osmani en LinkedIn que traduce en una especificación de fase. Tesis: **la calidad ha cambiado de dirección** — ya no se lee en el código (los agentes producen más código del que nadie puede revisar) sino en **el anillo de restricciones que rodea al agente**. El anillo de Osmani (siete dimensiones — corrección, seguridad, rendimiento, accesibilidad, mantenibilidad, **eficiencia económica**, **comprensibilidad** — enlazadas por la regla de **back-pressure**: «un bucle solo recibe la autonomía que puede verificarse de forma barata y fiable, ni un ápice más») se redibuja, se traduce y se adjunta a la fase 5 del ciclo de 11 fases de SFEIR. El corolario estructurante: **el cuello de botella nunca ha sido la generación, es la verificación** — «la generación es una boca ancha, la verificación un cuello estrecho; acelerar la boca engrosa la pila en el cuello». **La decisión de diseño más interesante es una elección de arquitectura del ciclo**: Review queda deliberadamente **fuera de las tres puertas humanas** (Define, Plan, Ship), porque convertir Review en la puerta pondría la atención humana — un recurso finito — como el punto de control de una capacidad de generación que a su vez escala: «habrías construido un pipeline cuyo rendimiento máximo es el número de diffs que un senior puede leer antes de que acabe el día». De ahí la separación: **Review instrumenta, Ship decide** — Review entrega un *cuerpo de evidencia oponible*, Ship decide sobre la evidencia, no sobre el diff completo. Una postura enfrentada a Monperrus (de quien SFEIR conserva el diagnóstico — la inspección humana de cada diff no puede resistir la velocidad agéntica — pero rechaza la conclusión: la aceptación no puede delegarse). La trampa señalada es la **validación circular** (el agente que escribe el código escribe los tests que lo validan: «has construido un espejo, no un anillo»), con cinco contramedidas extraídas de Anthropic (puertas independientes en ventanas de contexto separadas, determinista + agéntico que nunca se sustituyen entre sí, modo sombra, categorización por riesgo, registro en el SIEM) y la advertencia de Compare the Market (**grafo AST ~70% frente a RAG vectorial ~58%**, con el RAG rindiendo *peor que sin contexto alguno*). La extensión propia de la firma es **el trinquete**: «cada fuga se convierte en una restricción» — un defecto que ha cruzado el anillo se cierra *dentro del anillo* (test, regla de lint, rúbrica de revisión, guardrail del harness) en Compound-1, «el único activo de la cadena que se revaloriza mientras los modelos se deprecian» (una medición interna no auditada: **−30% de iteraciones de corrección tras diez ciclos**). Cierra reformulando la pregunta: «¿es bueno este código?» se ha vuelto una pregunta sin respuesta; lo que queda es **«¿qué se niega a dejar pasar mi sistema?»**

#anillo de restricciones#restricciones alrededor de los agentes#fase Review

SFEIR (voix éditoriale du cabinet, article non signé individuellement) — construit sur Addy Osmani (Google) ; cite Martin Monperrus · Paula Hingel (Augment Code) · DORA/Google Cloud · Jason Clinton (Anthropic) · l'équipe Engineering de Compare the Market

Agentes de codificación IA y Skills Traducción verificada automáticamente

Using Claude Code: The Unreasonable Effectiveness of HTML

Artículo de estilo manifiesto de **Thariq Shihipar** (Ingeniero y emprendedor serial, equipo de Claude Code en Anthropic) que anuncia un **cambio en el formato de salida por defecto para agentes**: sustituir **Markdown por HTML**. Tesis: Markdown ha sido el formato dominante entre humanos y agentes (simple, portátil, editable, legible), pero se ha convertido en **un cuello de botella** a medida que los agentes producen artefactos más largos y ricos (specs, planes, informes, revisión de código). Más allá de ~100 líneas, nadie vuelve a leer ya un archivo Markdown. HTML resuelve seis limitaciones a la vez: **densidad de información** (tablas, CSS, SVG, scripts, canvas, imágenes), **claridad visual** (diseño navegable, responsive para móvil), **facilidad para compartir** (un enlace S3 abrible directamente en un navegador), **interactividad bidireccional** (sliders, mandos, botones "copy as JSON/prompt" para reinyectar en Claude Code), **ingesta contextual nativa** (Claude Code lee el codebase + MCP Slack/Linear + historial git + Chrome) y **disfrute** (el autor afirma explícitamente que *"es placentero"*). Se detallan cinco usos canónicos: (1) **specs/planes/exploración** en una cuadrícula comparativa, (2) **revisión de PR** con diff anotado en línea, (3) **diseño y prototipos** con sliders de animación, (4) **informes/investigación/aprendizaje** (el autor generó un explicador sobre prompt-caching a partir del historial git), (5) **editores desechables a medida** (drag-and-drop de tickets de Linear, editores de feature flags, prompt-tuner lado a lado) que producen una exportación reinyectable "copy as markdown/diff/JSON". Antipatrón explícito: *"me da un poco de miedo que la gente lea este artículo y lo convierta en una skill /html"* — el autor **rechaza la skill-ificación prematura**, y recomienda partir de un prompt desde cero ("haz un archivo HTML"). FAQ pragmática: coste en tokens absorbido por el contexto de 1MM de **Opus 4.7**, generación 2-4× más lenta, diffs HTML ruidosos (un inconveniente real), estilo mantenido bajo control mediante un design system HTML de referencia.

#HTML#Markdown#formato de salida

Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)

Filosofía y Sociedad Traducción verificada automáticamente

Cognitive Surrender

Artículo doctrinal de Addy Osmani (Google) que establece una distinción fundacional para el debate de 2026 sobre la IA y la cognición: **Cognitive Offloading** (saludable — delegar el *cómo* manteniendo el juicio sobre los resultados) frente a **Cognitive Surrender** (tóxico — aceptar la salida de la IA en bloque sin formar un razonamiento paralelo, *"tomar prestada la confianza del modelo como sustituto de la comprensión personal"*). Base científica sólida: el estudio de **Shaw & Nave (Wharton/UPenn)** con 1.372 participantes — **el 73% acepta respuestas de la IA demostrablemente incorrectas**, con una confianza que aumenta pese a una tasa de error del 50%. **MIT *Your Brain on ChatGPT*** — conectividad neuronal reducida entre los escritores asistidos por IA. **Anthropic Skill-Formation** — los ingenieros que usan IA para generar código obtienen una puntuación **un 17% inferior** en comprensión frente a quienes la usan para la indagación conceptual. Cuatro ejemplos concretos de surrender (revisar PRs de 600 líneas basándose en señales superficiales, depuración superficial, decisiones arquitectónicas tomadas sin razonamiento, aprendizaje degradado). Cinco heurísticas personales (pregenerar expectativas, revisión al estándar de un ingeniero junior, prompting adversarial, conciencia de la fatiga, verificación del origen de la confianza). Seis salvaguardas estructurales (criterios de salida de verificación, tablas antirracionalización, **PRs de ~100 líneas como máximo**, modo interrogativo sobre modo generativo, fricción escalonada, **tiempo regular de teclado en solitario**). Dos conceptos nuevos: ***Comprehension Debt*** (la brecha creciente entre el volumen total de la base de código y la comprensión humana) y ***Mutual Amplification*** (un bucle cooperativo de prompt-refinamiento, frente a la delegación propia del surrender). Tesis pivote: ***"la elección entre pensar con la IA o no pensar en absoluto sigue siendo enteramente humana"***. Un contrapeso estructural y operativo a *"coding is solved"* (Cherny 2026-05) y un complemento analítico a Frizzo (2026-05-05).

#Addy Osmani#cognitive surrender#cognitive offloading

Addy Osmani (Software Engineer at Google, Cloud + Gemini, ex-Chrome — déjà au dossier veille avec *Agent Harness Engineering* 2026-04-19, *How to write a good spec for AI agents* 2026-01-13, *Conductors to Orchestrators* 2025-11-01).