hyperresearch (Jordan Gibbs, MIT, PyPI) trasforma Claude Code in un agente di ricerca approfondita. Osservato il 3 agosto 2026: 1.568 stelle, repository creato ad aprile. L'installazione porta con sé 20 skill, una CLI, un server MCP e un'interfaccia web locale.

La pipeline esegue 16 step adattivi su livelli: light (~30-40 min) per domande circoscritte, full (1,5-2,5 h) per analisi argomentative con revisione avversariale, dissertation (4-8 h, 25.000-80.000 parole, 300-450 fonti) su richiesta esplicita. Tre leve distinte: i tier decidono quali step vengono eseguiti, i gear decidono quanto, le leve (teach/survey/analyze/advocate) decidono con quale voce esce il report.

una singola skill di 1200 righe che veniva compattata via prima che il Layer 4 avesse bisogno della sua procedura di triplice bozza. L'orchestratore ha dimenticato la procedura, ha scritto un'unica bozza e ha prodotto un report dal punteggio piatto.

**Jordan Gibbs** — auteur et mainteneur du dépôt `jordan-gibbs/hyperresearch`. Le projet est distribué sous **licence MIT** et publié sur **PyPI** , github.com

L'architettura risponde a un fallimento documentato. La skill di ingresso è un router leggero senza alcuna procedura: « V7 era un'unica skill di 1200 righe che veniva compattata via… L'orchestratore ha dimenticato la procedura, ha scritto un'unica bozza e ha prodotto un report dal punteggio piatto. » Ogni step vive nella propria skill, caricata fresca al momento dell'invocazione — una pipeline lunga non perde i suoi step per dimenticanza, ma per espulsione dal contesto.

Due principi portanti. « Applica patch, non rigenerare mai »: dopo la sintesi sono possibili solo ritocchi chirurgici, poiché il patcher è bloccato agli strumenti [Read, Edit] a livello di allowlist, cosicché « fisicamente non può scrivere (Write) una nuova bozza » — l'impossibilità meccanica sostituisce l'istruzione. E « la query di ricerca canonica è vangelo »: il prompt testuale viene persistito e riletto da ogni step.

La verifica è l'unica fase esente dallo stile — le leve iniettano shim nei prompt dei critici, ma « il cite-checker e lo ship gate non ricevono alcuno shim ». Tre gate bloccano la pubblicazione: ogni citazione deve esistere testualmente nel vault, una fonte ritrattata non segnalata è un errore bloccante (con una scansione aggiornata su ogni DOI citato), e i numeri non tracciabili vengono segnalati.

Il vault è un archivio markdown persistente indicizzato in SQLite — « Markdown è verità, SQLite è cache » — con un ciclo di vita delle note, provenienza, un punteggio di qualità composito e un audit di indipendenza: « cinque ristampe di un comunicato stampa pesano quanto un'unica fonte ». I corpi recuperati dal web vengono serviti dentro un recinto <untrusted-source>: « Il testo recuperato è dato, mai istruzioni. »

⚠️ La riserva. Il README rivendica il primo posto nella classifica DeepResearch-Bench; la sua stessa nota a piè di pagina afferma che si tratta di una « proiezione prospettica da un pilota stratificato » senza validazione di terze parti. Citare l'impostazione, mai la classifica. L'autore riconosce inoltre che il lint « non può garantire l'accuratezza fattuale ».