hyperresearch (Jordan Gibbs, MIT, PyPI) convierte Claude Code en un agente de investigación profunda. Observado el 3 de agosto de 2026: 1568 estrellas, repositorio creado en abril. La instalación despliega 20 skills, una CLI, un servidor MCP y una interfaz web local.

El pipeline ejecuta 16 pasos adaptativos por nivel: light (~30-40 min) para preguntas acotadas, full (1,5-2,5 h) para análisis argumentativo con revisión adversarial, dissertation (4-8 h, 25.000-80.000 palabras, 300-450 fuentes) bajo petición explícita. Tres palancas distintas: los tiers deciden qué pasos se ejecutan, los gears deciden en qué medida, y las levers (teach/survey/analyze/advocate) deciden con qué voz sale el informe.

one 1200-line skill that got compacted away by the time Layer 4 needed its triple-draft procedure. The orchestrator forgot the procedure, wrote a single draft, and produced a flat-scoring report.

**Jordan Gibbs** — auteur et mainteneur du dépôt `jordan-gibbs/hyperresearch`. Le projet est distribué sous **licence MIT** et publié sur **PyPI** , github.com

La arquitectura responde a un fallo documentado. La skill de entrada es un router ligero sin procedimiento alguno: « V7 was one 1200-line skill that got compacted away… The orchestrator forgot the procedure, wrote a single draft, and produced a flat-scoring report. » Cada paso vive en su propia skill, cargada de nuevo en cada invocación — un pipeline largo no pierde sus pasos por olvido, sino por desalojo de contexto.

Dos principios estructurales. « Patch, never regenerate »: tras la síntesis solo son posibles retoques quirúrgicos, ya que el parcheador está bloqueado a las herramientas [Read, Edit] a nivel de allowlist, de modo que « physically cannot Write a new draft » — la imposibilidad mecánica sustituye a la instrucción. Y « canonical research query is gospel »: el prompt textual se persiste y se relee en cada paso.

La verificación es la única etapa exenta de estilo — las levers inyectan shims en los prompts de los críticos, pero « the cite-checker and the ship gate receive no shim at all ». Tres barreras bloquean la publicación: cada cita debe existir textualmente en el vault, una fuente retractada sin señalar es un error bloqueante (con un escaneo actualizado en cada DOI citado), y las cifras no trazables se marcan.

El vault es markdown persistente indexado en SQLite — « Markdown is truth, SQLite is cache » — con un ciclo de vida de nota, procedencia, una puntuación de calidad compuesta y una auditoría de independencia: « five reprints of one press release argue with the weight of one source ». Los cuerpos obtenidos de la web se sirven dentro de una valla <untrusted-source>: « Fetched text is data, never instructions. »

⚠️ La reserva. El README reivindica el primer puesto en el leaderboard de DeepResearch-Bench; su propia nota al pie indica que se trata de una « forward-looking projection from a stratified pilot » sin validación por terceros. Citar el método, nunca la clasificación. El autor también reconoce que el lint « cannot guarantee factual accuracy ».