Zum Inhalt springen

root / tags / thariq-shihipar

#Thariq Shihipar

3 Fiches

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

Fable's judgement

Kurze Notiz von Simon Willison (Weblog), die zwei Tipps wiedergibt, die während eines *Fireside Chat* bei AIE mit Cat Wu und Thariq Shihipar (Claude Code Team) zu hören waren: **das Modell (Fable, und in gewissem Maße Opus) sein eigenes Urteilsvermögen ausüben lassen, statt ihm Regeln zu diktieren** — veranschaulicht anhand der Entscheidung, ob Tests geschrieben werden sollen. Zweiter Tipp, von Jesse Vincent: um **wertvolle Fable-Tokens zu sparen** (angesichts einer bevorstehenden Preiserhöhung), Fable bitten, **kleine Aufgaben an weniger leistungsfähige Modelle zu delegieren**, wobei es selbst beurteilt, welches geeignet ist. Willison zeigt den genauen verwendeten Prompt (« *use your judgement to decide an appropriate lower power model and run that in a subagent* ») sowie die **Memory-Datei**, die Claude Code daraufhin schrieb. Bereich: Prompt Engineering, Coding Agents, Token-Ökonomie, Multi-Modell-Orchestrierung.

#Modellurteilsvermögen#Delegation an Subagents#Model Override

Simon Willison

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

Lessons from building Claude Code: How we use skills

Blogbeitrag von **Anthropic / claude.com** von **Thariq Shihipar** (Member of Technical Staff, Claude Code-Team), veröffentlicht am **3. Juni 2026**, der Anthropics **interne Erfahrung** bei der Konzeption und Nutzung von **Skills** destilliert. **Rahmenthese**: Ein Skill ist keine einfache Markdown-Datei, sondern ein **Ordner** (Anweisungen + Skripte + Ressourcen + Konfiguration + Hooks), den der Agent **entdeckt und bearbeitet**; *« Man sollte das gesamte Dateisystem als eine Form von Context Engineering und progressiver Offenlegung betrachten. »* Der Artikel liefert zwei strukturierende Beiträge. **(A) Eine Taxonomie von 9 bei Anthropic beobachteten Skill-Kategorien**: (1) **Library/API Reference** (Dokumentation für interne Bibliotheken/CLIs mit *Gotchas* — z. B. `billing-lib`, `internal-platform-cli`, `sandbox-proxy`); (2) **Product Verification** (Testing/Verifikation via Playwright oder tmux — `signup-flow-driver`, `checkout-verifier`, `tmux-cli-driver`); (3) **Data Fetching & Analysis** (Zugriff auf Daten-/Monitoring-Stacks — `funnel-query`, `cohort-compare`, `grafana`, `datadog`); (4) **Business Process Automation** (wiederkehrende Workflows — `standup-post`, `weekly-recap`, `create-<ticket>-ticket`); (5) **Code Scaffolding** (Framework-Boilerplate — `new-migration`, `create-app`); (6) **Code Quality & Review** (`adversarial-review`, `code-style`, `testing-practices`); (7) **CI/CD & Deployment** (`babysit-pr`, `deploy-<service>`, `cherry-pick-prod`); (8) **Runbooks** (Multi-Tool-Diagnosen — `<service>-debugging`, `oncall-runner`, `log-correlator`); (9) **Infrastructure Operations** (Wartung mit Schutzmechanismen — `<resource>-orphans`, `cost-investigation`). **(B) Eine Reihe von Best Practices**: Nicht das Offensichtliche wiederholen (*« Claude weiß bereits, wie man programmiert, und kann die Codebasis lesen »* → auf das zielen, was dem Standardverhalten widerspricht); den **Gotchas-Abschnitt** verfeinern (*« der Inhalt mit dem höchsten Signalwert in jedem Skill »*); **progressive Offenlegung** über den Dateibaum (je nach Situation auf Referenzdateien verweisen, statt alles im Voraus zu laden); **für das Modell geschriebene Beschreibungen** (*« das Beschreibungsfeld ist keine Zusammenfassung, sondern eine Beschreibung, wann dieser Skill ausgelöst werden soll »*); **Setup-Abläufe** (Konfiguration in `config.json`, andernfalls Abfrage via `AskUserQuestion`); **persistenter Speicher** (Append-only-Logs / JSON über die Variable `${CLAUDE_PLUGIN_DATA}`); **Hilfsskripte** (*« erlaubt es Claude, seine Turns auf Komposition zu verwenden … statt Boilerplate neu zu konstruieren »*); **hooks conditionnels** (nur für die Dauer des Skills aktiviert — z. B. ein Sicherheits-Hook, der destruktive Befehle blockiert). **Verbreitung bei Anthropic**: Skills werden in `./.claude/skills` gespeichert, informell über Slack in einem Sandbox-Ordner geteilt und dann per **PR** in den internen **Marketplace** überführt, sobald sie an Zugkraft gewinnen; **Nutzungsmessung** über einen **hook PreToolUse**, der Aufrufe protokolliert (und so populäre gegenüber wenig genutzten Skills sichtbar macht). Direkte Fortsetzung der Fiche [[shihipar-claude-code-html-unreasonable-effectiveness-markdown-2026-05-10]] (gleicher Autor) und konkrete Ergänzung zu den Skills-Fiches von Anthropic/Willison/Vincent sowie zum Harness Engineering.

#Skills#Claude Code#Anthropic

**Thariq Shihipar** (Member of Technical Staff chez Anthropic, équipe **Claude Code** ; @trq212 / @trq sur X, thariqs.github.io) · pour le blog **claude.com**. Même auteur que la fiche *Using Claude Code: The Unreasonable Effectiveness of HTML* (2026-05-10). Publié le **3 juin 2026**.

KI-Coding-Agenten & Skills Automatisch geprüfte Übersetzung

Using Claude Code: The Unreasonable Effectiveness of HTML

Manifest-artiger Artikel von **Thariq Shihipar** (Engineer & Serial Entrepreneur, Claude Code Team bei Anthropic), der eine **Änderung des Standard-Ausgabeformats für Agenten** ankündigt: die Ablösung von **Markdown durch HTML**. These: Markdown war das dominante Format zwischen Menschen und Agenten (einfach, portabel, editierbar, lesbar), ist aber zu **einem Engpass** geworden, da Agenten längere und reichhaltigere Artefakte produzieren (Specs, Pläne, Berichte, Code-Reviews). Jenseits von ca. 100 Zeilen liest niemand mehr eine Markdown-Datei. HTML löst sechs Einschränkungen gleichzeitig: **Informationsdichte** (Tabellen, CSS, SVG, Skripte, Canvas, Bilder), **visuelle Klarheit** (navigierbares, mobil-responsives Layout), **einfaches Teilen** (ein S3-Link, direkt im Browser öffenbar), **bidirektionale Interaktivität** (Schieberegler, Regler, „Copy as JSON/Prompt“-Buttons zur Rückkopplung in Claude Code), **native kontextuelle Aufnahme** (Claude Code liest die Codebasis + MCP Slack/Linear + Git-Historie + Chrome) und **Freude an der Nutzung** (der Autor stellt ausdrücklich fest: *„it's joyful“*). Fünf kanonische Anwendungen im Detail: (1) **Specs/Pläne/Exploration** in einem vergleichenden Raster, (2) **PR-Review** mit inline annotiertem Diff, (3) **Design & Prototypen** mit Animations-Schiebereglern, (4) **Berichte/Recherche/Lernen** (der Autor ließ einen Prompt-Caching-Explainer aus der Git-Historie generieren), (5) **maßgeschneiderte Wegwerf-Editoren** (Drag-and-Drop von Linear-Tickets, Feature-Flag-Editoren, Side-by-Side-Prompt-Tuner), die einen re-injizierbaren „Copy as Markdown/Diff/JSON“-Export erzeugen. Explizites Anti-Pattern: *„I'm a little bit afraid that people will read this article and turn it into a /html skill“* — der Autor **lehnt eine vorschnelle Skill-ifizierung ab** und empfiehlt stattdessen Prompting von Grund auf („make a HTML file“). Pragmatisches FAQ: Token-Kosten werden durch den 1-Mio.-Kontext von **Opus 4.7** absorbiert, 2-4× längere Generierungszeit, verrauschte HTML-Diffs (ein realer Nachteil), Stil wird über ein HTML-Referenz-Designsystem im Zaum gehalten.

#HTML#Markdown#Ausgabeformat

Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)