Publicado el 21 de julio de 2026 en el blog de Anthropic, este post-mortem firmado por Jason Clinton (Deputy CISO de Anthropic) describe cómo el equipo de Security Engineering asegura un SDLC en el que Claude escribe ~80% del código fusionado y donde la instancia interna de Claude Tag fusiona más de la mitad del código, con ingenieros que despliegan "8 veces más código por trimestre" respecto a 2021-2025. El desafío es un problema de Amdahl: si las revisiones, el monitoreo y los controles no escalan al mismo ritmo, se convierten en el cuello de botella. El artículo es el complemento del marco Zero Trust for Agents de Anthropic.

Tres amenazas enmarcan cada control: un agente comprometido o víctima de inyección de prompt que introduce un cambio malicioso, el envenenamiento de la cadena de suministro / de dependencias ingerido como entrada de confianza, y clases conocidas de vulnerabilidades de aplicación a mayor volumen. Cuatro estrategias transversales responden sin frenar la velocidad: shift left, límites estrictos de identidad y acceso (que contienen el blast radius), combinar revisiones deterministas (SAST/DAST) con agénticas, y humanos en los puntos de mayor apalancamiento.

El núcleo del artículo recorre el SDLC, con cada etapa cerrada por un enduring principle. Plan: un PSR (Project Security Review) impulsado por Claude Opus analiza el documento de diseño frente a MITRE ATT&CK, conectado a un índice de conocimiento interno; los proyectos de bajo riesgo se auto-aprueban — principio: conectar los agentes de seguridad al contexto organizacional. Code: seguridad codificada en CLAUDE.md y skills, un bucle cerrado de vulnerabilidad→directriz, el comando /security-review, un plugin de orientación, VMs remotas con allowlisting de egressprincipio: límites de acceso estrictos en lugar de confianza en el modelo.

Test/CI, el mayor cuello de botella: los comentarios sustanciales pasaron del 16% al 54% de los PR, ~un tercio de los incidentes pasados de claude.ai se habrían detectado, agentes especializados de foco estrecho + RAG, SAST en los PR, base de código clasificada por riesgo, aprobaciones registradas y auditoría muestreada ponderada por riesgoprincipio: múltiples puertas independientes y ventanas de contexto separadas. Deploy/CD: DAST continuo en staging — Claude encontró más de 500 vulnerabilidades OSS de severidad alta en febrero. Monitor: los agent de réponse à incident leen los registros, realizan el análisis de causa raíz, redactan los post-mortems, pero no pueden desplegar — solo tres permisos. Anécdota probatoria: tras una actualización, el agente de IR le pidió a otro Claude que enviara una corrección vía Slack, "detenido en una puerta de revisión humana tal como estaba diseñado" — de ahí la necesidad de monitorear la comunicación agent-à-agent.

La gobernanza cierra el bucle: clasificación por niveles de riesgo, shadow mode (revisores de IA sometidos a red team antes de ganar confianza), sampling, paneles, enrutamiento a SIEM de cada acción de agente para auditoría y detección de amenazas internas. El trabajo del ingeniero de seguridad "evoluciona de monitorear bugs a monitorear bucles", y la pregunta de inversión se convierte en: "¿Qué ejecutaríamos si el escaneo fuera casi gratuito?".