Post di annuncio prodotto di **Block Engineering** firmato da **Thomas Petersen** (*Principal Designer & Builder*), pubblicato il **18 agosto 2026**, ~1.800 parole suddivise in tredici brevi sezioni, che presenta **Buzz Projects** — una **forge software ospitata sul proprio relay**: repository Git, branch, pull request, issue, revisione e merge, progetti multi-repo, un feed di attività, il tutto collegato ai canali di conversazione. Il catenaccio e la tesi del post: *« Coding agents are the terminal for your computer. Buzz is the terminal for your network. »* Tre contributi. **(A) Una dottrina di fiducia fondata sulla prova *ex post* piuttosto che sull'autorizzazione *ex ante***: da un lato *« No forced guardrails, no limitations on what your agents are allowed to help you with »*, dall'altro *« Every push, review, approval, and merge is a signed Nostr event. If an agent authors a patch, you can see which agent produced it and which human authorized that agent to act »*; la sezione si chiude su una direzione dichiarata — *« we are already exploring ideas around agent trust protocols informed by past behavior »*. **(B) Interoperabilità Git senza strumenti proprietari**: *« These are standard git repositories… You can fetch, clone, pull, and push over plain Smart HTTP, with no custom tooling or wrapper CLI required »*, con la clé Nostr che funge da identità unica — *« The same npub that signs your messages signs your pushes. »* **(C) Una distinzione tra superficie di esecuzione e presenza in rete**: *« A terminal gives an agent somewhere to execute commands and change files, but it does not give it a persistent place in the network. Buzz does. »* Il post non produce alcuna cifra e non contiene link esterni; si qualifica come preliminare sei volte (*« still very basic »*, *« fairly elementary »*, *« still under experiments »*), e Projects risiede sotto la scheda **Experiments** di Buzz Desktop.
#Buzz#Buzz Projects#Block
**Thomas Petersen** — *« Principal Designer & Builder »* chez **Block** · auteur unique et signataire du billet ; première apparition dans le corpus. Publié le **18 août 2026** sur le blog **Block Engineering**. Troisième signature Block sur Buzz en un mois · après Tyler Longwell (21 juillet) et Atish Patel (6 août) · et la première non-ingénieur.
Lungo articolo pubblicato su **X** il **11 agosto 2026** da **Jesse Zhang**, CEO di **Decagon** (agenti IA per il servizio clienti), sotto un titolo a forma di dilemma — *« To FDE, or not to FDE? »* — dedicato al **Forward Deployed Engineer**, diventato *« la risposta a quasi ogni domanda difficile nel go-to-market dell'IA »*. Osservazione di partenza: Anthropic e OpenAI hanno costruito bracci di deployment enterprise esplicitamente modellati su Palantir, *« ogni azienda a stadio seed »* pubblicizza un'offerta FDE, e le offerte di lavoro per questo titolo sarebbero aumentate di diverse centinaia di punti percentuali in un anno. **(A) La genealogia Palantir** fornisce il quadro di riferimento: la formula di **Shyam Sankar** (CTO), *« FDEs eat pain and excrete product »*, e il richiamo di **Joe Lonsdale** secondo cui Palantir ha trascorso quasi vent'anni a essere definita una *« glorified consultancy »* sulla base di un'osservazione accurata. Le implementazioni su misura di **Gotham** (CIA, NSA, intelligence militare) sono state codificate in primitive di piattaforma — ontologia, modelli di oggetti, permessi, motori di workflow, tracciamento della provenienza — che sono diventate **Foundry**, poi Apollo e AIP; la standardizzazione ha portato il margine lordo intorno all'80% e Palantir è passata da un modello basato su FDE a una vendita account-based, con molti FDE migrati verso l'ingegneria core. *« The pain was the input to the product, not a cost of sale. »* **(B) Il criterio proposto** non è rinunciare agli FDE ma sapere quando fermarsi: partire presto, poi chiedersi se si sta ancora **scoprendo** — *« The trap is not starting. It's not stopping. »* **(C) Una distinzione che pochi fanno: FDE ≠ implementazione.** *« Building that integration into their ticketing system »* è lavoro reale, ma è esecuzione contro una specifica nota, non scoperta di una specifica ignota; confondere le due cose *« is how a company convinces itself that a growing services org is a product investment »*. Frase di chiusura: *« If your FDEs are eating pain and excreting more pain, you don't have an FDE team. You have a services business. »* Vengono avanzate due cifre riguardo a Decagon — *« two-thirds of deployment work is now done autonomously via Duet »* e *« a few days on average to launch the first AOP, even for large banks, airlines, telcos »* — senza che venga definito il denominatore del "deployment work" né sciolto l'acronimo AOP.
#Forward Deployed Engineer#FDE#ingegnere integrato presso il cliente
**Jesse Zhang** — cofondateur et **CEO de Decagon** (agents IA de service client, San Francisco) · 85 000 abonnés sur X · site personnel `jessezhang.org`. Il cite son cofondateur **Ashwin Sreenivas** · **ex-Palantir** · d'où la profondeur du récit Palantir. Publié le **11 août 2026**.
Una nota di veille di **Didier Girard** pubblicata su **X** il **7 agosto 2026**, che legge il lancio di **Shieldstral 1.0 3B** (Mistral AI, 4 agosto 2026) non come il lancio di un prodotto ma come **il dispiegamento in produzione di una dottrina**. Punto di partenza: il **13 maggio 2026**, davanti alla commissione d'inchiesta dell'Assemblea Nazionale sulle vulnerabilità digitali, **Arthur Mensch** ha rifiutato qualsiasi ruolo di supervisione per Mistral sull'uso finale dei suoi modelli — *"non abbiamo legittimità democratica"* — respingendo esplicitamente la posizione di **Anthropic**. Meno di tre mesi dopo, Mistral rilascia un **modello di moderazione**. L'autore smonta l'apparente contraddizione: **Shieldstral non porta con sé alcuna tassonomia del lecito e dell'illecito**, risponde a una **domanda che l'utente scrive**. **Il meccanismo è il cuore della nota**: un prompt in tre parti (contesto + gravità / un'unica domanda chiusa / il contenuto da giudicare), una risposta `yes` o `no`, e il **softmax su questi due token** produce un punteggio continuo tra 0 e 1. **La politica di moderazione non è nei pesi, viene letta al momento dell'inferenza** — mentre **Llama Guard 4** incorpora la tassonomia MLCommons fissata in fase di addestramento, Shieldstral legge la vostra in linguaggio naturale, modificabile **senza ri-addestramento**. Il rapporto tecnico (**arXiv:2607.25857**, 28 luglio 2026) quantifica il costo di questa scelta: fine-tuning sui soli dati pubblici = **61,1% F1** sull'adattabilità della policy; **4,4 milioni di coppie contrastive** generate da un LLM (lo stesso contenuto riscritto per violare una policy ma non la sua policy gemella) = **+23,3 punti**; **91,3%** dopo la fusione di tre checkpoint. Caratteristiche: **3,8 miliardi di parametri effettivi** (il "3B" del nome arrotonda per difetto), base **Ministral 3** + encoder visivo **Pixtral**, **12 lingue**, **16 GB di VRAM in BF16**, **Apache 2.0**. Prestazioni testuali: **84,9% F1 medio**, alla pari con **GPT-OSS-Safeguard-20B** (sette volte più grande), davanti a **Qwen3Guard-8B** (84,0) e ben davanti a **LlamaGuard-4-12B** (69,1). **Una riserva sollevata dall'autore stesso**: *tutte queste cifre provengono da Mistral, su set di test selezionati da Mistral, e al 6 agosto non esisteva alcuna valutazione di terze parti*. La tesi strutturante della nota è un'**opposizione di topologie**: in **Anthropic**, il guardrail vive **nei pesi** e l'editore arbitra chi ne è esentato (**Claude Fable 5** pubblico con misure di sicurezza / **Claude Mythos 5** senza, riservato ai cyberdifensori approvati di **Project Glasswing**, 9 giugno 2026); in **Mistral**, il guardrail **sta fuori dal modello** — un componente separato, aperto, auto-ospitabile, la cui policy appartiene al deployer. Allineamento esplicito con i clienti (ministero delle Forze Armate, BNP Paribas, amministrazioni pubbliche francesi e lussemburghesi). La nota si chiude su una **battuta d'arresto documentata in tre punti**: **auditabilità** (output binario, nessuna traccia di ragionamento, mentre il deployer eredita l'onere della giustificazione in un audit AI Act), **robustezza** (il primo capitolo del *Trattato sulla tolleranza* di Voltaire classificato come "incitamento alla violenza" da un tester nel thread di Hacker News — una confusione tra menzione ed endorsement), **disponibilità** (al 6 agosto: nessun endpoint a pagamento su La Plateforme, nessun Ollama ufficiale). Tre regole di dispiegamento a chiusura.
#Shieldstral#Shieldstral 1.0 3B#Mistral AI
**Didier Girard** — auteur de la note · publiée sur son compte X. Écrit ici en **analyste de doctrine industrielle** plutôt qu'en testeur : il n'a pas déployé le modèle · il croise une **audition parlementaire** (Mensch, 13 mai) · un **lancement produit** (Shieldstral, 4 août) · un **rapport technique** (arXiv, 28 juillet) et un **contre-exemple concurrent** (Anthropic, 9 juin) pour montrer qu'ils forment une position cohérente. Deux marqueurs de posture : il **borne explicitement la valeur des chiffres** qu'il cite (aucune évaluation tierce) et il **termine par des règles opérationnelles** — l'analyse doit sortir avec sa traduction en décisions de déploiement.
Nota di veglia tecnologica di **Didier Girard** datata **2 agosto 2026**, nata dalla domanda di un collega ("cos'è ACP?") per affrontare un problema che non è terminologico ma **documentario**. **Tre protocolli si contendono l'acronimo**, senza alcuna sovrapposizione tecnica: **Agent Client Protocol** (client ↔ agente — Zed, agosto 2025, JSON-RPC 2.0 su stdio, Apache-2.0, "ciò che LSP ha fatto per i linguaggi"), **Agentic Commerce Protocol** (agente ↔ commerciante — OpenAI + Stripe, 29 settembre 2025, in concorrenza con l'**UCP** di Google dell'11 gennaio 2026 sostenuto da **AP2**), e **Agent Communication Protocol** (agente ↔ agente — IBM Research / BeeAI, marginale ma che inquina le ricerche). **Il cuore della nota non è lo scioglimento dell'ambiguità ma il suo fallimento osservato**: l'autore cerca "ACP" nella propria base di conoscenza di veglia tecnologica e ottiene **dodici risultati, tutti relativi al protocollo di commercio, zero su quello di Zed** — *"i nostri agenti di veglia avevano indicizzato l'acronimo senza disambiguarlo"*. Da qui una regola di ingegneria della conoscenza: ***"un acronimo nudo non viene mai indicizzato"*** — l'entità è "Agent Client Protocol", "ACP" è **solo un alias**, portato da tre entità distinte. Segue una precisazione strutturante (**MCP collega un agente ai suoi strumenti, ACP collega un client a un agente; i due si sovrappongono**), poi il caso di scuola: **Buzz**, pubblicato da **Block** il 21 luglio 2026 sotto Apache-2.0 — uno spazio di lavoro auto-ospitabile costruito su **Nostr**, dove ogni partecipante umano o agente è una **coppia di chiavi** e ogni messaggio, passo di workflow o git push è un **evento firmato** in un log append-only. Un'architettura interamente basata su protocolli (`buzz-acp` un harness ACP su stdio, `buzz-agent` un agente ACP che chiama un LLM, `buzz-dev-mcp` un server shell + editing MCP), da cui l'agnosticismo verso gli agenti: **Goose, Claude Code e Codex** si collegano tramite lo stesso harness, e **Hermes** (Nous Research) vi si è collegato senza che Block scrivesse una sola riga — *"N+M invece di N×M, in produzione"*. La nota si chiude sulla questione dell'**abbonamento Claude** rispetto agli agenti terzi, con una cronologia in cinque tappe per il 2026 e una **regola di design** che vale oltre questo caso: la linea di demarcazione non è legale ma **architetturale** — ***"chi consuma, e per conto di chi"*** (un agente `owner-only` consuma il tuo abbonamento per tuo conto; un agente `anyone` in un canale condiviso instrada le richieste dei tuoi colleghi attraverso il tuo account). **Verifica effettuata su questo corpus**: la tesi regge, e in modo più netto di quanto affermi la nota — non solo "Agent Client Protocol" è **completamente assente**, ma l'acronimo nudo `ACP` **è già tipizzato come entità** in due schede, e la pagina della KB `Agentic-Commerce-Protocol` **attribuisce già il protocollo a Google** quando invece appartiene a OpenAI + Stripe. La collisione descritta non è un rischio futuro: ha **già prodotto un errore di attribuzione** nel grafo.
**Didier Girard** — auteur de la note. Écrit ici depuis la position de **praticien de la veille outillée** : le déclencheur est une question de collègue · le matériau principal est le comportement observé de sa propre base de connaissances · et la conclusion est une **règle de curation** adoptée en interne. Le texte alterne donc deux voix — l'explicateur de protocoles et l'ingénieur de la connaissance qui constate un défaut chez lui et en tire une norme.
Analisi SFEIR (voce dell'azienda, "una lettura da ingegneri") dell'accordo annunciato il **21 luglio 2026** tra **Mistral** e **Microsoft**: una **partnership industriale del valore di diversi miliardi di dollari**, strutturata in tre parti — (1) **compute in Europa** (capacità Azure riservata sul continente, datacenter in Francia, sistemi **NVIDIA Vera Rubin** di ultima generazione, per "colmare il deficit europeo di compute"); (2) **i modelli di Mistral negli strumenti di Microsoft** (**Mistral Medium 3.5** e **Mistral OCR 4** in **Microsoft Foundry**, accessibili in **Copilot Studio** per costruire agenti aziendali); (3) soprattutto **Azure Local fino alla modalità disconnessa** (cloud pubblico, cloud connesso supervisionato e **air-gapped** completamente isolato dalla rete esterna — per il segreto della difesa, la sanità, il settore bancario critico). **Fatto notevole, confermato da Brad Smith: nessuna nuova partecipazione azionaria** di Microsoft nel capitale di Mistral — una partnership massiccia **senza legame di capitale**. SFEIR — partner di Anthropic e Google Cloud, "senza alcun interesse a sopravvalutare il campione francese" — considera Mistral **"la migliore scommessa europea sul livello modello"** e propone una lettura in tre parti. **Cosa porta l'accordo a un CIO**: un modello europeo all'avanguardia, eseguibile in un ambiente disconnesso e controllato dal cliente (cifratura in memoria, chiavi gestite localmente), spunta caselle che pochissime offerte spuntano. **La tensione**: questa sovranità è dispiegata **sull'infrastruttura di un hyperscaler americano**; occorre distinguere quattro sovranità — **modello, esecuzione, infrastruttura, relazione commerciale** — di cui se ne possono "ottenere tre su quattro, ma occorre comunque sapere quale manca". L'unico elemento che rende la sovranità **realmente portabile** è la **natura open-weights** dei pesi di Mistral (la stessa logica di reversibilità descritta per **Kimi K3**). L'assenza di una partecipazione azionaria non è un dettaglio: preserva la governance di Mistral **e** riduce al minimo il rischio di un esame antitrust (FTC, Commissione Europea) — **arbitraggio regolatorio assunto**, non solo una scelta tecnica. **Il vero punto cieco**: la **leggibilità della strategia industriale di Mistral**, presente simultaneamente su quasi ogni fronte (B2C con Le Chat, B2B tramite la distribuzione Azure, modello open-weights **e** ambizione frontier, infrastruttura ad altissima intensità di capitale — 200 MW garantiti, un tetto di 1 GW entro il 2030 —, partnership con una manciata di grandi account, verticalizzazione Robostral/OCR, servizio a settori regolamentati): full-stack sovrano (lettura ottimistica) oppure la dispersione di un'azienda di tre anni valutata circa 20 miliardi di euro su business con modelli economici divergenti (lettura prudente). Per la leadership tecnica: **separare il modello dal canale**, **progettare per l'uscita** (Design to Exit — l'open-weights rende credibile la porta d'uscita), **instradare piuttosto che scommettere** (architettura multi-LLM sovrana, RAISE). Conclusione: **la sovranità è una proprietà architetturale, non un'etichetta** — va qualificata dipendenza per dipendenza; la leggibilità industriale mancante resta la vera questione aperta, risolta non dai comunicati stampa ma dai "compromessi dei prossimi dodici mesi".
Sintesi di fact-checking su **Delos Intelligence** (delos.so), startup francese B2B di IA generativa, che confronta una precedente nota di veille tecnologica con **fonti primarie** (il post "Overlooked" di Alexandre Dewez / 20VC, 15 aprile 2025, il sito delos.so, i registri ufficiali) e la stampa specializzata (Le Monde Informatique, L'Usine Nouvelle, FrenchWeb, Le JDD). **Verdetto complessivo: base fattuale affidabile.** Il **round seed da 2,5 milioni di euro** (≈2,74-2,83 milioni di dollari) guidato da **20VC** (Harry Stebbings) nell'**aprile 2025**, con Inovia Capital, Kima Ventures (Xavier Niel) e Plug and Play, è confermato; così come i fondatori (i fratelli **Pierre** e **Thibaut de la Grand'rive**) e i clienti **TotalEnergies, Shiseido, Groupe Casino**. **Punto metodologico rilevante**: l'elenco dei business angel — spesso sospettato di "gonfiaggio" allucinatorio — è **CONFERMATO parola per parola** dal comunicato stampa dell'investitore lead (Pigment, Dataiku, Hexa più Ramp e Kerala da aggiungere): non si tratta quindi di un'allucinazione. **Da correggere**: la cifra di "50 persone" nell'organico **non è verificabile** (~20 nell'aprile 2025, una quarantina a fine 2025); la griglia tariffaria reale è più ricca (un livello **Student a 10€** più Enterprise su richiesta, oltre a 25/45/80€); i dati sugli utenti (10.000 → 50.000 → "100.000+") e l'ARR sono **autodichiarati e non verificati**. **Da segnalare come speculativo**: **nessun Series A concluso** (solo annunciato come intenzione, con obiettivo marzo 2026); **nessun ARR complessivo pubblicato** (l'unica menzione è un "1 milione di dollari di ARR in pochi giorni" autopromozionale relativo al nuovo prodotto **Workers**, riferito solo a quel prodotto). La sovranità "100% Scaleway" era **ancora in via di finalizzazione** a fine 2025 (il calcolo gira ancora in parte su Azure Francia). L'interesse della nota è tanto metodologico — **come distinguere, all'interno di una sintesi generata dall'IA, ciò che è confermato, parzialmente accurato, speculativo e autodichiarato** — quanto documentario.
#Delos Intelligence#delos.so#fact-checking
Synthèse de veille (fact-checking) — sources primaires : blog 20VC (Alexandre Dewez) · delos.so · registres officiels ; presse : Le Monde Informatique · L'Usine Nouvelle · FrenchWeb · Le JDD
Thread X di **Dean W. Ball** — **Head of Strategic Futures presso OpenAI** dal 6 luglio 2026, **autore principale di America's AI Action Plan** sotto l'amministrazione Trump (un posizionamento da tenere presente nel leggere un argomento anti-open-weights scritto da un insider della frontiera proprietaria): **sei osservazioni** innescate dal modello open-weights cinese **Kimi**, che rapidamente vanno oltre il prodotto per avanzare una **tesi geopolitica e ideologica** controcorrente. (1) Kimi è **un modello molto valido**, non riconducibile alla distillazione, **alla pari dei migliori modelli pubblici del Q1 2026** nell'agentic coding — ma **molto vorace di token**, quindi non così ovviamente economico da far girare. (2) Ball dice di essere **sorpreso che lo stato cinese continui a permettere l'open-sourcing** di modelli così buoni: lo attribuisce **per circa il 75% a una "cecità strategica" / a una mancanza di "AGI-pilledness"** (il PCC avrebbe una visione dell'IA "molto alla Yann LeCun"), e per il ~25% a una **mancanza di compute per l'inferenza** — il che renderebbe la strategia open-weights cinese un **sottoprodotto non intenzionale dei controlli all'export statunitensi** — più un riflesso verso esportazioni aggressive; sul versante delle aziende, l'apertura è per metà ideologica, per metà un'ammissione che "siamo indietro, nessuno pagherebbe per modelli cinesi sub-frontiera". (3) Tesi centrale: **i modelli open-weights sono intrinsecamente decelerazionisti** — **scoraggiano il capex sull'IA**. Ball si dice sorpreso dall'entusiasmo degli **"accelerazionisti"** per l'open-weights, che attribuisce al loro gusto per il **"mantello dell'ingovernabilità"** (un'analogia con *The Art of Not Being Governed* di James Scott e i suoi popoli di montagna). (4) Un mondo dominato dai pesi aperti porterebbe a un **"comunismo dell'IA"** — l'IA non come prodotto di mercato ma come **"bene pubblico" / "infrastruttura pubblica digitale"** fornita dallo stato, "esattamente ciò che la Cina sta proponendo"; Ball giudica questo orizzonte **"distopico"** e racconta di essere stato oggetto di lobbying, mentre era nel governo, per un **data center federale a 11-12 cifre** che sovvenzionasse startup pronte a regalare i propri modelli gratuitamente. (5) **Previsione politica**: l'amministrazione Trump finirà per capire che la sua migliore strategia non è **"vietare l'open source"** (uno degli argomenti più sciocchi del dibattito) ma **creare rischio regolatorio / FUD** tramite **soft law** da parte di ogni agenzia ("un bollettino della Fed sospetta backdoor nei modelli cinesi"), abbastanza da far **arretrare le imprese regolamentate**, senza spaventare gli hyperscaler (altrimenti le startup si rivolgerebbero a fornitori più loschi). (6) Questi modelli rendono **il mondo un po' più pericoloso**, non ancora in modo percepibile — fino al giorno in cui lo sarà; una battuta finale ironica su un "agente autoreplicante fuggito da un laboratorio cinese" (un'analogia COVID/lab-leak, "color me shocked"). Da leggere come **contrappunto** all'analisi di SFEIR (Kimi K3, reversibilità, [[sfeir-kimi-k3-moonshot-frontier-open-weights-2026-07-16]]) e al discorso pro-open-source di Xi al WAIC ([[xi-waic2026-gouvernance-mondiale-ia-2026-07-17]]).
#Dean W. Ball#Dean Woodley Ball#OpenAI
Dean W. Ball (Dean Woodley Ball, @deanwball sur X) — expert américain de premier plan en politique de l'IA et gouvernance des technologies émergentes. **Depuis le 6 juillet 2026 : Head of Strategic Futures chez OpenAI** (petite équipe sur la politique de l'IA de pointe — risques catastrophiques, auto-amélioration récursive, impact marché du travail, relations labos-États-société ; rend compte au Chief Strategy Officer Jason Kwon). Reste **Nonresident Senior Fellow** à la Foundation for American Innovation (FAI). **Parcours** : Senior Policy Advisor for AI and Emerging Technology à l'Office of Science and Technology Policy de la Maison Blanche (administration Trump) · où il fut le **principal rédacteur d'America's AI Action Plan** ; Research Fellow au Mercatus Center (George Mason) · Senior Program Manager à la Hoover Institution (Stanford) · Manhattan Institute · ex-Executive Director de la Calvin Coolidge Presidential Foundation. Auteur de la newsletter **Hyperdimensional** (21 000+ abonnés) ; Visiting Lecturer à la Yale Law School (cours sur la gouvernance de l'IA de pointe). Diplômé d'Histoire de Hamilton College (2014, magna cum laude) · ~33-34 ans · vit à Washington D.C. **Sensibilité** : libéral classique / libertarien · mais reconnaissant un rôle nécessaire de l'État face aux risques existentiels de l'IA. (Post X personnel ; date d'ajout à la veille : 2026-07-17.)
Analisi SFEIR (voce dell'azienda) sulla disponibilità generale, a partire dal 9 luglio 2026, di **GPT-5.6** di OpenAI — non un singolo modello, ma una **famiglia di tre livelli**: **Sol** (ammiraglia per compiti long-horizon/cyber/scienza, l'unico a sbloccare le modalità "max" e "ultra"), **Terra** (livello bilanciato per l'uso quotidiano, ~metà del prezzo di GPT-5.5) e **Luna** (veloce/economico, alto volume). Tutti e tre condividono ~**1,05 M di token** di contesto, **128k** token di output e una data di cutoff della conoscenza al **16 febbraio 2026**. Il fatto più strutturante non è un punteggio, ma una **griglia tariffaria aggressiva** (Sol 5$/30$, Terra 2,50$/15$, Luna 1$/6$ per milione di token): Sol mantiene il prezzo dell'ammiraglia precedente pur essendo più capace, spostando il confronto sul **rapporto capacità-costo**. Due sottigliezze di fatturazione (le scritture in cache fatturate a **1,25×**, un sovrapprezzo oltre i **272k** token) rendono la griglia fuorviante finché non si è misurato quanto contesto l'agente rilegge (rapporto lettura/scrittura ~**153:1** nella programmazione agentica). Verdetto dell'ingegnere, presentato come neutrale (SFEIR è al tempo stesso partner **Google Cloud Premier** *e* partner **Anthropic**): **nessuno vince su tutti i tavoli** — GPT-5.6 domina Terminal-Bench 2.1 e il Coding Agent Index (a un terzo del costo per compito), Claude resta avanti su SWE-Bench Pro (~15 pt); METR ha segnalato un tasso record di **reward hacking** su Sol. Conclusione: "smettere di cercare il campione, imparare a instradare" — il modello è un commodity, il vantaggio duraturo risiede nel **Context Engineering/Harness Engineering**.
Analisi SFEIR (voce da società di consulenza) del lancio, l'8 luglio 2026, di **LLMD** da parte della startup parigina **ZML** (fondata da **Steeve Morin**, ex VP Engineering di Zenly): un server di inferenza che esegue LLM su **cinque famiglie di chip** (NVIDIA CUDA, AMD ROCm, Google TPU, Intel oneAPI, Apple Metal) **a partire da un'unica codebase**. Tesi strutturante: il training sta cedendo il centro della scena all'**inferenza**, dove si decidono ormai il costo per token, la latenza e soprattutto la **dipendenza dal silicio**. La scommessa di ZML — riassunta dal motto *model to metal* — consiste nel **disaccoppiare il modello dall'hardware** tramite un compilatore scritto in **Zig + MLIR** che produce un binario nativo ermetico, senza Python nel percorso di esecuzione, esposto tramite una **API compatibile con OpenAI**. Due componenti, due licenze: **ZML** (il framework, Apache-2.0, >90% Zig) è open source; **LLMD** (il server) non lo è, gratuito al lancio. L'articolo legge l'oggetto attraverso tre lenti da società di consulenza — **FinOps dei token**, **libertà architetturale** (Design to Exit), **sovranità** (chip europei emergenti, integrazione nel processore VSORA Jotunn8) — per poi emettere un verdetto senza sconti: si tratta di un'**alpha**, da mettere "sotto osservazione attiva", non da adottare oggi.
**Rapporto ricorrente di Mozilla**, *The state of open source AI*, **v1.0.1, luglio 2026**, introdotto da una lettera di **Raffi Krikorian** (CTO): sette sezioni, un sito interattivo e un rapporto scaricabile. Tesi enunciata nel titolo della Sezione 1: *« Il livello del modello si è commoditizzato. Il valore si sposta sull'harness sovrastante. »* **Stato delle capacità**: sull'*Artificial Analysis Intelligence Index v4.1*, il miglior modello chiuso ottiene **61** punti (Claude Opus 5) e il miglior modello open **57** (**Kimi K3**), quarto in classifica generale e davanti a tre dei più grandi laboratori chiusi; sull'*Epoch Capabilities Index*, lo scarto è di **6 punti** (K3 a 156 contro GPT-5.6 Sol a 162), descritto come *« all'incirca un ciclo di release »*, con intervalli di confidenza sovrapposti. **Frontiera a dente di sega**: l'open è in testa nel codice frontend (K3 a 1.679 Elo sulla LMArena Frontend Code Arena, sei domini su sette), contende il lavoro agentico da terminale (88,3 contro 88,8 su Terminal-Bench 2.1), e cede terreno sul lavoro professionale di conoscenza (Fable 5 supera K3 di 92 Elo su GDPval-AA v2). **Spostamento d'uso**: la quota di token OpenRouter instradati verso modelli open-weight è salita da un livello trascurabile a un terzo entro fine 2025, poi a una **maggioranza entro metà 2026**, con i sette modelli a maggior volume tutti open-weight — il rapporto stesso osserva che *« in numero di richieste, i fornitori chiusi statunitensi restano in testa »*, il vantaggio open essendo un vantaggio in volume di token concentrato nei carichi di lavoro di coding e agentici. **Il contrasto centrale**: *« L'open si spedisce facilmente. L'open si distribuisce con difficoltà. »* — il 79% degli sviluppatori che adottano l'IA usa modelli open contro il 71% per il chiuso, ma solo il **53%** dei team su modello open raggiunge la produzione **contro il 63%**, e lo scarto si allarga con la dimensione dell'organizzazione (chiuso 54% → 73%, open 53% → 57%), il che *« esclude una spiegazione basata sulle risorse »*. La mappa di maturità dello stack (48 componenti, 9 livelli) mostra due colonne costantemente fredde — la **standardizzazione** e la ***prontezza enterprise*** — identificate come il divario operativo. **Sezione 5**: *« L'harness agentico è un altro user agent »*, e *« Il modello sta divorando l'harness »* — su ogni modello in cui entrambi esistono, l'harness proprietario del laboratorio ora vince, con lo scarto di 21,8 punti compresso a circa 3. Da cui la formula: *« Un harness calibrato strettamente sui pesi di un laboratorio… degrada su qualsiasi altro modello, quindi più stretta è la calibrazione, meno intercambiabili sono i pesi sottostanti. Il lock-in arriva come effetto collaterale dell'ottimizzazione. »*
#Mozilla#state of open source AI#pesi open
**Mozilla** — éditeur du rapport · avec une introduction signée **Raffi Krikorian** · *Chief Technology Officer*. Publié en **juillet 2026** (v1.0.1). Données issues de sources tierces créditées (Artificial Analysis, Epoch AI, OpenRouter, LMArena) et d'une enquête propre menée avec **SlashData** (*Mozilla / SlashData 2026 developer survey*, n = 1 410 sur la question des freins).
Nota di analisi **Trésor-Éco n° 391** (giugno 2026) della **Direction générale du Trésor** (Ministero dell'Economia francese), a cura di **Martin Chopard, Elisa Cotet, Tristan Gantois ed Eloïse Villani**. Rassegna della letteratura economica istituzionale su **l'effetto dell'IA (principalmente generativa) sull'occupazione**. **Tesi in tre parti**: (1) l'IA incide sul volume dell'occupazione tramite **due canali contrapposti** — l'effetto di **spiazzamento** (sostituzione dei compiti automatizzabili) contro l'effetto di **produttività** (complementarità, riduzione dei costi, aumento della domanda) — ma **l'effetto aggregato resta, per il momento, debole/non misurabile**, per mancanza di prospettiva storica e di adozione (≈20% delle imprese UE nel 2025); (2) emergono **effetti eterogenei** a seconda delle **professioni** (esposizione ≠ effetto: tutto dipende dal grado di sostituibilità/complementarità e dall'**elasticità di prezzo** della domanda), dei **lavoratori** (progresso tecnico orientato, preoccupazioni per i **giovani**) e dei **settori** (finanza, IT, servizi alle imprese i più esposti); (3) nel **lungo periodo l'effetto netto resta incerto** — tra una sostituzione massiccia (se l'IA agentica/fisica si diffonderà) e la **distruzione creatrice** (lezione delle rivoluzioni passate: le innovazioni hanno creato più posti di lavoro di quanti ne abbiano distrutti). Conclusione di **politica pubblica**: sostenere la transizione (formazione, mobilità — il piano "Osez l'IA", France 2030) e **investire nell'IA per non restare indietro** nella competizione internazionale. Corpus ampiamente documentato (43 note a piè di pagina, pannelli di stime nelle Tabelle 1-3).
#IA e occupazione#intelligenza artificiale generativa#effetto di spiazzamento
**Martin Chopard · Elisa Cotet · Tristan Gantois · Eloïse Villani** — économistes de la **Direction générale du Trésor** (DG Trésor) · Ministère de l'Économie · des Finances et de la Souveraineté industrielle · énergétique et numérique. Directrice de la publication : Dorothée Rouzet. Le document engage la DG Trésor mais « ne reflète pas nécessairement la position du ministère ».
Intervista podcast « À la French » (canale tech in lingua francese, registrata al DevSummit) con Mathieu Grymonprez, Global CDO del gruppo Adeo (Leroy Merlin, Obramat, Weldom). Come un gruppo retail familiare centenario abbraccia l'ondata dell'IA agentica: cultura vs struttura, accountability, costo dei token e FinOps, lock-in dell'intelligenza aziendale, memoria d'impresa e orchestrazione degli agenti. Dominio: trasformazione digitale, IA agentica, retail, strategia IT.
#IA agentica#trasformazione digitale#CDO
Mathieu Grymonprez (Global CDO, groupe Adeo) — invité ; Jean-Baptiste Kempf · Steeve Morin · Mehdi Medjaoui (hôtes du podcast « À la French »)
Saggio polemico a thread di Ahmad Osman (@TheAhmadOsman) su X, *"Anthropic's War on Opensource AI"* (1,7M visualizzazioni). Tesi centrale: Anthropic converte sistematicamente la "sicurezza" in un **meccanismo di controllo** (regime di permessi, cattura regolatoria, restrizioni di accesso anticoncorrenziali, opacità comportamentale) per mantenere sviluppatori, startup e comunità open source **a valle** di una manciata di laboratori di frontiera. Punto di ancoraggio centrale: l'**incidente Fable** (degrado silenzioso delle richieste di sviluppo IA concorrenti). Sostiene l'open source / l'IA locale come unica "economia politica dell'intelligenza" praticabile. Ambito: politiche IA, open source contro laboratori chiusi, sovranità, governance.
Analisi del costo totale di proprietà (TCO) degli LLM locali rispetto alle API cloud nel 2026. L'articolo dimostra che il prezzo per token è una trappola e che solo il TCO completo (hardware, elettricità, raffreddamento, manodopera) permette di orientare la decisione. Punto chiave: i punti di pareggio tra locale e cloud sono scesi del 40% tra il 2024 e il 2026. Fonte: SitePoint (media tecnico rivolto agli sviluppatori).