Aller au contenu

root / tags / verification

#vérification

5 fiches

Stratégie & Frameworks

When code is abundant

Essai de **Bill Staples**, directeur général de **GitLab**, publié le **24 août 2026** sur le blog about.gitlab.com : **31 minutes** de lecture annoncées, environ **39 000 caractères**, présenté comme la suite d'un mémo écrit au conseil d'administration en janvier 2026 et partiellement publié en mai sous le titre *GitLab Act 2*. Le texte se donne comme une réponse au playbook AI-native SDLC d'**Anthropic** paru trois jours plus tôt, dont il reprend la phrase d'ouverture — *« Code is no longer the bottleneck »* — pour poser la question qui l'occupe : qu'est-ce qui devient rare quand le code devient abondant. (A) Le diagnostic économique : l'unité utile n'est pas le coût par ligne mais le **coût par changement accepté**, qui agrège génération, environnement, contexte, vérification, revue, remédiation et gouvernance ; l'IA effondre le seul terme de génération, ce qui rend les autres proportionnellement plus lourds — une organisation dix fois plus rapide à générer *« will simply move the queue »*. (B) La réponse architecturale : quatre capacités — plateforme d'agents, exécution à l'échelle machine, contexte durable, gouvernance — formant une couche d'entreprise qui survit au modèle, *« The model should be replaceable. The agent should belong to the customer. »* (1) Trois modes coexistent durablement, du légataire piloté par l'humain au développement autonome, contre l'idée d'une courbe de maturité unique. (2) Le pipeline CI/CD devient le lieu où tourne la boucle interne, au lieu d'être une porte en fin de course. Les chiffres avancés sont ceux de **Stripe**, **Spotify** et **Amplitude** ; GitLab n'en produit qu'un, sur son propre contrôle de source. Le corpus tient déjà [[claxton-anthropic-ai-native-sdlc-playbook-2026-08-21]], la source à laquelle ce texte répond, et [[sfeir-sdlc-pdlc-articulation-2026-07-22]] sur l'articulation SDLC/PDLC que Staples reprend à son compte.

#abondance du code#coût par changement accepté#théorie des contraintes

Bill Staples · directeur général de GitLab (fonction non affichée par la page) · sur le blog about.gitlab.com.

Outils & Plateformes

ChatGPT Desktop & Claude Desktop vs versions web — Rapport « What ? — So What ? — Now What ? »

Rapport de recherche interne du **12 août 2026** (format *What ? — So What ? — Now What ?*, enquête menée les 11-12 août) sur une question simple : les applications **desktop** de ChatGPT et de Claude sont-elles meilleures que leurs versions **web** ? La réponse est en deux temps. **(A) Un consensus qualitatif solide et sourcé existe.** Le point de départ est incontestable : desktop et web appellent exactement les mêmes modèles cloud, l'application n'étant qu'une interface du service — le gain se situe donc intégralement dans l'enveloppe applicative (latence d'accès, stabilité en session longue, empreinte mémoire, intégrations système, fluidité du workflow). Ce qui distingue réellement le desktop, confirmé : côté OpenAI, raccourci global (Option/Alt + Espace), *companion window* toujours au premier plan, captures d'écran natives, et depuis juillet 2026 l'agentique **Codex/Work** intégrée à l'app ; côté Anthropic, **Quick Entry** (macOS), **Desktop Extensions** (installer un serveur **MCP** local devient *« as simple as clicking a button »*), accès aux fichiers locaux, **Cowork** et **Computer Use** (permissions Accessibilité et enregistrement d'écran). Le web garde deux atouts confirmés : multi-onglets / multi-fils, et universalité sans client à installer. **(B) La quasi-totalité des chiffres qui circulent pour étayer ce consensus ne résiste pas à la vérification.** L'audit critique du rapport (§1.5) classe **non confirmées** sept affirmations chiffrées largement reprises : le *cold start* « 2-3 s vs 8-12 s » (seule trace, un *« loads in about 3 seconds »* anecdotique sur Substack) ; la RAM « 200-700 Mo vs 1,2-2 Go », attribuée à un « Alibaba Product Insights » dont les pages renvoient **404** ; un *glitch rate* et une rétention de session introuvables ; un « Claude +10-20 % end-to-end » attribué à **Skywork**, qui avait en réalité benchmarké son propre agent Windows et non Claude contre le web ; une source « Cosmo Edge » introuvable ; des citations Zenken AI non confirmées ; et deux posts X non authentifiés, sans URL. Le contre-signal est documenté avec la même rigueur : Yuri Dvoinos décrit une app Claude Desktop qui *« makes me want to throw my laptop out the window »* — 68 % de CPU, lag de saisie sur MacBook Pro —, et le rapport rappelle que les deux apps sont des constructions **Electron** avec couches natives. D'où sa formule : *l'avantage desktop est une promesse d'implémentation, pas une loi de la nature.* **Le « So What »** : puisque le modèle est devenu le point commun, l'interface devient le champ de bataille — la fusion **Codex + ChatGPT** du 9 juillet 2026 et le tandem Cowork / Computer Use racontent la même histoire, *« l'app desktop n'est plus un client de chat, c'est un runtime d'agents avec accès à la machine »*. Trois conséquences : le gain est un gain de **friction**, non de puissance ; pour une DSI, le desktop **déplace la frontière de confiance** — Computer Use exige des permissions système sensibles et la fusion Codex place exécution de code, navigateur et connecteurs dans *« one expanded trust boundary »*, là où le navigateur reste gouvernable par SSO, DLP et CASB ; et pour qui publie, la fragilité des chiffres est en elle-même l'information. **Le « Now What »** livre des critères de bascule individuels, une checklist DSI (inventorier les permissions, désactiver Computer Use et Cowork par défaut, cadrer les extensions MCP autorisées, organiser distribution et mises à jour — sur Linux, hors dépôt apt, Claude Desktop ne se met pas à jour seul) et une consigne éditoriale : ne citer que les verbatims et dates confirmés.

#ChatGPT Desktop#Claude Desktop#version web

**Deep Research Veille Interne** — rapport non signé · produit par une enquête sourcée menée les **11-12 août 2026** et rendu le 12.

Stratégie & Frameworks

Loop Engineering for Product Managers

Essai long format de **Shubham Saboo** (X/Twitter) posant une thèse sur le métier de **Product Manager** à l'ère des agents : la prochaine compétence clé n'est **pas le prompt engineering** mais le **Loop Engineering** — concevoir un *système qui s'améliore à chaque exécution* plutôt qu'écrire le prompt parfait à chaque fois. Une **boucle** = un cycle répété : on modifie ce qui façonne le comportement de l'agent → on exécute → on évalue la sortie → on garde le changement si la qualité monte, on revient en arrière sinon → on **capitalise l'apprentissage** pour que la version suivante démarre en avance. Pour un PM, le point d'entrée n'est pas le code mais les **artefacts durables** qui encodent son jugement : skill de revue de PRD, *summarizer* d'appels clients, rubrique d'évaluation, checklist de lancement, workflow de recherche, `CLAUDE.md`, template de prompt, framework de priorisation. Parce qu'ils sont réutilisés, ces artefacts **composent dans les deux sens** — et **dérivent** silencieusement (CLAUDE.md qui s'allonge, checklist ignorée…) : le modèle n'a pas régressé, les artefacts ont dérivé sans surveillance. Une boucle a **5 parties** : trigger, action, **preuve**, mémoire, **condition d'arrêt** (la plus critique). Les **evals** deviennent du travail de PM (tester l'artefact contre des exemples connus : 3 bons / 3 mauvais PRD, 5 appels compris, 2 lancements passés). La **mémoire** vit sur **GitHub** (le repo devient « mémoire produit » : commits, diffs, résultats d'éval, journal de décision, rollback). Premier loop conseillé : un **weekly product signal loop** (chaque vendredi). Le goût reste central — mais il lui faut désormais une **preuve**. Cite Boris (créateur de Claude Code) : « il n'écrit plus de prompts, il écrit des boucles ».

#Loop Engineering#product management#PM augmenté

Shubham Saboo (@Saboo_Shubham_)