Breve nota di Simon Willison (weblog) che riporta due consigli ascoltati durante una *Fireside Chat* all'AIE con Cat Wu e Thariq Shihipar (team Claude Code): **lasciare che il modello (Fable, e in parte Opus) eserciti il proprio giudizio invece di dettargli delle regole** — illustrato con la decisione se scrivere o meno i test. Secondo consiglio, di Jesse Vincent: per **risparmiare i preziosi token di Fable** (in vista di un imminente aumento dei prezzi), chiedere a Fable di **delegare piccoli compiti a modelli meno potenti**, lasciandogli giudicare quale scegliere. Willison mostra il prompt esatto utilizzato (« *use your judgement to decide an appropriate lower power model and run that in a subagent* ») e il **file di memoria** che Claude Code ha scritto in risposta. Dominio: prompt engineering, agenti di codifica, economia dei token, orchestrazione multi-modello.
#Giudizio del modello#delega ai subagenti#model override
Post del blog di **Anthropic / claude.com** di **Thariq Shihipar** (Member of Technical Staff, team Claude Code), pubblicato il **3 giugno 2026**, che sintetizza l'**esperienza interna** di Anthropic nella progettazione e nell'uso delle **Skills**. **Tesi di inquadramento**: una Skill non è un semplice file markdown ma una **cartella** (istruzioni + script + risorse + configurazione + hook) che l'agente **esplora e manipola**; *« You should think of the entire file system as a form of context engineering and progressive disclosure. »* L'articolo apporta due contributi strutturanti. **(A) Una tassonomia di 9 categorie di skill** osservate in Anthropic: (1) **Library/API Reference** (documentazione per librerie/CLI interne con *gotchas* — es. `billing-lib`, `internal-platform-cli`, `sandbox-proxy`); (2) **Product Verification** (test/verifica tramite Playwright o tmux — `signup-flow-driver`, `checkout-verifier`, `tmux-cli-driver`); (3) **Data Fetching & Analysis** (accesso a stack di dati/monitoraggio — `funnel-query`, `cohort-compare`, `grafana`, `datadog`); (4) **Business Process Automation** (workflow ripetitivi — `standup-post`, `weekly-recap`, `create-<ticket>-ticket`); (5) **Code Scaffolding** (boilerplate di framework — `new-migration`, `create-app`); (6) **Code Quality & Review** (`adversarial-review`, `code-style`, `testing-practices`); (7) **CI/CD & Deployment** (`babysit-pr`, `deploy-<service>`, `cherry-pick-prod`); (8) **Runbooks** (diagnostica multi-tool — `<service>-debugging`, `oncall-runner`, `log-correlator`); (9) **Infrastructure Operations** (manutenzione con guardrail — `<resource>-orphans`, `cost-investigation`). **(B) Un insieme di best practice**: non ripetere l'ovvio (*« Claude already knows how to code and can read your codebase »* → puntare su ciò che **contraddice il comportamento predefinito**); curare la **sezione Gotchas** (*« the highest-signal content in any skill »*); **progressive disclosure** tramite l'albero dei file (indirizzare verso file di riferimento a seconda della situazione anziché caricare tutto in anticipo); **descrizioni scritte per il modello** (*« the description field is not a summary, it's a description of when to trigger this skill »*); **flussi di setup** (configurazione in `config.json`, altrimenti richiesta tramite `AskUserQuestion`); **memoria persistente** (log append-only / JSON tramite la variabile `${CLAUDE_PLUGIN_DATA}`); **script helper** (*« lets Claude spend its turns on composition… rather than reconstructing boilerplate »*); **hooks conditionnels** (attivati solo per la durata della skill — es. un hook di sicurezza che blocca comandi distruttivi). **Distribuzione in Anthropic**: le skill sono conservate in `./.claude/skills`, condivise informalmente via Slack in una cartella sandbox, poi promosse tramite **PR** nel **marketplace** interno una volta acquisita trazione; **misurazione dell'utilizzo** tramite un **hook PreToolUse** che registra le invocazioni (rivelando le skill popolari rispetto a quelle sottoutilizzate). Seguito diretto della fiche [[shihipar-claude-code-html-unreasonable-effectiveness-markdown-2026-05-10]] (stesso autore) e complemento concreto alle fiche sulle Skills di Anthropic/Willison/Vincent e all'*harness engineering*.
#skills#Claude Code#Anthropic
**Thariq Shihipar** (Member of Technical Staff chez Anthropic, équipe **Claude Code** ; @trq212 / @trq sur X, thariqs.github.io) · pour le blog **claude.com**. Même auteur que la fiche *Using Claude Code: The Unreasonable Effectiveness of HTML* (2026-05-10). Publié le **3 juin 2026**.
Articolo in stile manifesto di **Thariq Shihipar** (Ingegnere e imprenditore seriale, team Claude Code di Anthropic) che annuncia un **cambiamento nel formato di output predefinito per gli agenti**: la sostituzione di **Markdown con HTML**. Tesi: Markdown è stato il formato dominante tra umani e agenti (semplice, portabile, modificabile, leggibile) ma è diventato **un collo di bottiglia** man mano che gli agenti producono artefatti più lunghi e ricchi (specifiche, piani, report, code review). Oltre le ~100 righe, nessuno legge più un file Markdown. HTML risolve sei limiti contemporaneamente: **densità informativa** (tabelle, CSS, SVG, script, canvas, immagini), **chiarezza visiva** (layout navigabile, responsive per mobile), **facilità di condivisione** (un link S3 apribile direttamente nel browser), **interattività bidirezionale** (slider, manopole, pulsanti "copy as JSON/prompt" per il rientro in Claude Code), **ingestione contestuale nativa** (Claude Code legge la codebase + MCP Slack/Linear + cronologia git + Chrome) e **piacere** (l'autore afferma esplicitamente *"it's joyful"*). Cinque usi canonici approfonditi: (1) **specifiche/piani/esplorazione** in una griglia comparativa, (2) **PR review** con diff annotato inline, (3) **design e prototipi** con slider di animazione, (4) **report/ricerca/apprendimento** (l'autore ha fatto generare un explainer sul prompt caching a partire dalla cronologia git), (5) **editor usa e getta personalizzati** (drag-and-drop di ticket Linear, editor di feature flag, prompt-tuner affiancati) che producono un export "copy as markdown/diff/JSON" re-iniettabile. Anti-pattern esplicito: *"I'm a little bit afraid that people will read this article and turn it into a /html skill"* — l'autore **rifiuta la skill-ificazione prematura**, raccomandando di scrivere il prompt da zero ("make a HTML file"). FAQ pragmatica: costo in token assorbito dal contesto da 1MM di **Opus 4.7**, generazione 2-4× più lunga, diff HTML rumorosi (uno svantaggio reale), stile tenuto sotto controllo tramite un design system HTML di riferimento.
#HTML#Markdown#formato di output
Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)