Saltar al contenido

root / tags / exploration

#exploration

2 fiches

Agentes de codificación IA y Skills Traducción verificada automáticamente

BYO Agent with M5Stack Stick 3

Artículo de trasteo dominical de **Mark Dembo** (Head of Solutions, Developer Platform & AI en **Cloudflare**) publicado el **7 de junio de 2026** en su blog personal. **Narrativa**: inspirado por **Steve Ruiz**, el autor compra un pequeño dispositivo **M5Stack Stick 3** (~30 €) y, aprovechando el lanzamiento de **Opus 4.8**, se construye un **agente de IA DIY** «por pura curiosidad, sin ningún objetivo». **Iteración 1 (45 min)**: pasa la documentación del dispositivo a **Claude Code**, que genera scripts en Python (~200 LOC, *«zero blast radius»*) que muestran el tiempo en Múnich, luego en varias ciudades; un backend de **Cloudflare Workers + Workers AI** añade **texto a voz (TTS)**, **push-to-talk** (voz a texto) y un **small LLM** central para responder preguntas. **Iteración 2 (un agente real)**: cambio de los endpoints REST a transporte **WebSocket** mediante el **Cloudflare Agents SDK** + **Dynamic Worker execution** → el patrón ***«Code Mode»*** (el agente escribe y ejecuta código para llevar a cabo su tarea). El agente responde entonces a preguntas sobre datos públicos (11! = factorial, el ganador de la Champions League mediante `fetch()` en Wikipedia, el tiempo en cualquier ciudad). **Iteración 3 (poderes reales)**: conexión a **Todoist** mediante un flujo **MCP OAuth** → 50 herramientas de golpe, de donde surgen dos problemas: **sobrecarga de contexto** y **riesgo real de daño**. La solución se apoya en el **MCP Server Portal** de Cloudflare + los ajustes de conectores de Claude: por herramienta, **Always allow / Ask for approval / Disable** (las herramientas *Disabled* nunca entran en el contexto; un **clasificador LLM** solo acepta autorizaciones «allow» explícitas y **deniega por defecto**). **Postura declarada**: reduce su papel al de ***«generador de ideas, ejecutor y juez»*** (y, en raras ocasiones, guía técnico), un flujo «human-in-the-loop» que considera poco *«2026»* (copiar y pegar en UIFlow). **Lo que NO hizo**: ninguna optimización de latencia/streaming, ninguna llamada LLM optimista, ningún eval, ***«Ni siquiera miré el código una sola vez.»*** **Asombro**: 30 € + una ventana de sesión de Anthropic + unos céntimos de inferencia de Cloudflare → un objeto que escucha y habla, gobernado en lenguaje natural; *«el verdadero desbloqueo está en lo accesible que es.»* Marcado contraste con [[thomas-pragdave-failing-faster-code-rot-ai-velocity-2026-06-06]] (aquí *«zero blast radius»* justifica no mirar nunca el código); ilustra concretamente *Code Mode* / *«el agente simplemente escribiendo y ejecutando código,»* el patrón **MCP** ([[claude-skills-bigger-than-mcp-willison-2025-10-16]]), la gobernanza de herramientas al estilo *Ask for approval* (uber-engineering-agent-identity-crisis-zero-trust-spire-2026-05-21), y la doctrina de los *sistemas en torno al modelo* de dropbox-okumura-beyond-code-generation-engineering-productivity-ai-agents-2026-05-28.

#BYO agent#trae tu propia IA#trasteo

**Mark Dembo** (@darkmembo / @mdembo) · **Head of Solutions – Developer Platform & AI** chez **Cloudflare** (auparavant auteur sur le blog Cloudflare). Billet personnel publié sur son blog *markpauldembo.com* le **7 juin 2026** (description : *« Thoughts about tinkering on a Sunday »*).

Agentes de codificación IA y Skills Traducción verificada automáticamente

Using Claude Code: The Unreasonable Effectiveness of HTML

Artículo de estilo manifiesto de **Thariq Shihipar** (Ingeniero y emprendedor serial, equipo de Claude Code en Anthropic) que anuncia un **cambio en el formato de salida por defecto para agentes**: sustituir **Markdown por HTML**. Tesis: Markdown ha sido el formato dominante entre humanos y agentes (simple, portátil, editable, legible), pero se ha convertido en **un cuello de botella** a medida que los agentes producen artefactos más largos y ricos (specs, planes, informes, revisión de código). Más allá de ~100 líneas, nadie vuelve a leer ya un archivo Markdown. HTML resuelve seis limitaciones a la vez: **densidad de información** (tablas, CSS, SVG, scripts, canvas, imágenes), **claridad visual** (diseño navegable, responsive para móvil), **facilidad para compartir** (un enlace S3 abrible directamente en un navegador), **interactividad bidireccional** (sliders, mandos, botones "copy as JSON/prompt" para reinyectar en Claude Code), **ingesta contextual nativa** (Claude Code lee el codebase + MCP Slack/Linear + historial git + Chrome) y **disfrute** (el autor afirma explícitamente que *"es placentero"*). Se detallan cinco usos canónicos: (1) **specs/planes/exploración** en una cuadrícula comparativa, (2) **revisión de PR** con diff anotado en línea, (3) **diseño y prototipos** con sliders de animación, (4) **informes/investigación/aprendizaje** (el autor generó un explicador sobre prompt-caching a partir del historial git), (5) **editores desechables a medida** (drag-and-drop de tickets de Linear, editores de feature flags, prompt-tuner lado a lado) que producen una exportación reinyectable "copy as markdown/diff/JSON". Antipatrón explícito: *"me da un poco de miedo que la gente lea este artículo y lo convierta en una skill /html"* — el autor **rechaza la skill-ificación prematura**, y recomienda partir de un prompt desde cero ("haz un archivo HTML"). FAQ pragmática: coste en tokens absorbido por el contexto de 1MM de **Opus 4.7**, generación 2-4× más lenta, diffs HTML ruidosos (un inconveniente real), estilo mantenido bajo control mediante un design system HTML de referencia.

#HTML#Markdown#formato de salida

Thariq Shihipar (Engineer & serial entrepreneur, équipe Claude Code chez Anthropic — site : thariqs.github.io/html-effectiveness ; X : @trq212)