100 000 commits plus tard : ce qu'est vraiment un « Claw »
OpenClaw a débuté en novembre 2025 sous la forme d'un dépôt obscur nommé Warelay. Le tour d'horizon de mi-2026 de Simon Willison explique comment il a dévoré l'année.
Le dépôt qui a dévoré l'année
En novembre 2025, quelqu'un a effectué le premier commit d'un dépôt GitHub obscur nommé Warelay. À la fin de janvier 2026, il avait été renommé quatre fois (CLAWDIS, puis CLAWDBOT, puis Moltbot, puis OpenClaw) et avait accumulé 8 300 commits en moins de deux mois. Simon Willison, lors de sa keynote de clôture au WeAreDevelopers World Congress North America à San José vendredi dernier, a déclaré avoir revérifié le chiffre avant son intervention : plus de 100 000 commits. Il y voit le logiciel le plus « vibe-codé » qui existe.
Ce dépôt a défini une catégorie de logiciels. Il existe désormais OpenClaw, NanoClaw, IronClaw, PicoClaw. L'industrie s'affaire à les rebaptiser « agents personnels » ou « agents généralistes ». Willison continue de les appeler des Claws.
Ce qu'est un Claw, en réalité
Si l'on met de côté l'habillage commercial, un Claw n'est pas une invention nouvelle. Comme le dit Willison, un Claw est un agent de codage coiffé d'un chapeau moins menaçant : sous le capot, il fonctionne de la même manière, en écrivant du code puis en l'exécutant sur votre ordinateur pour accomplir des tâches.
Ce mécanisme compte plus que le marketing. Un chatbot génère du texte que vous lisez. Un agent génère du code puis l'exécute, sur une vraie machine, avec un vrai accès aux fichiers et un vrai accès au réseau. Le bond de capacité remarqué en 2026 vient de cette boucle devenue fiable. Willison situe le tournant en novembre 2025, avec la sortie de Claude Opus 4.5 et de GPT-5.1. Ces deux modèles n'étaient que des améliorations incrémentales, mais associés à leurs harnais de codage (Claude Code, qui existait depuis février 2025, et le plus récent Codex), ils sont passés de « font souvent des erreurs » à « assez fiables pour un usage quotidien ».
La conséquence pour le grand public a été bien concrète. Les Apple Stores de la région de la baie de San Francisco ont été à court de Mac Mini, parce que des gens les achetaient pour faire tourner OpenClaw. L'explication de Drew Breunig, que Willison cite avec approbation : votre Claw est un animal de compagnie numérique, et le Mac Mini est l'aquarium dans lequel vous le gardez. En mars, des entreprises en Chine ont organisé des soirées d'installation d'OpenClaw, avec des personnes non techniques faisant la queue autour du pâté de maisons pour obtenir de l'aide afin d'en faire tourner un.
Le risque vient de cette même boucle. Si un programme écrit et exécute du code en votre nom, la question intéressante est de savoir ce qui l'arrête. Willison a compté environ 40 des 277 sessions de la conférence de San José portant sur le sandboxing ou la sécurité des agents. La course, dit-il, consiste à construire le premier Claw sûr, c'est-à-dire un Claw que l'on peut confier à une personne ordinaire sans qu'elle se tire immédiatement une balle dans le pied.
Le « tokenmaxxing » est monté en flèche, puis retombé aussitôt
L'histoire des coûts est le signal le plus clair de toute cette intervention. En février, les gros titres montraient Meta intégrant l'adoption de l'IA aux évaluations de performance, Microsoft poussant chaque employé à utiliser l'IA, et Uber se vantant que 90 % de ses ingénieurs travaillaient avec des workflows d'IA. Quelques mois plus tard : Meta resserre l'usage des tokens, Microsoft dit que le tokenmaxxing n'est « pas ce que nous cherchons à optimiser », Uber plafonne les dépenses d'IA de ses employés.
Rien ne s'est cassé. La facture est arrivée. L'analyse de Willison : il y a un an, il était difficile de dépenser 50 $ en tokens parce qu'il n'y avait rien d'intéressant à en faire ; avec les agents, on peut désormais dépenser 1 000 $ en une journée pour un vrai travail. Les agents ont trouvé leur adéquation produit-marché, et cette adéquation coûte cher. Il rattache la même dynamique à la valorisation d'Anthropic, qui aurait atteint, selon un chiffre rapporté, peut-être mille milliards de dollars.
Pendant ce temps, les anciens débats sur la capacité des modèles à coder se sont éteints discrètement. StrongDM fonctionne depuis juillet 2025 selon deux règles : le code ne doit pas être écrit par des humains, et le code ne doit pas être relu par des humains. Dan Shapiro appelle cela la Dark Factory : automatisez suffisamment et vous pouvez éteindre les lumières. En février, cela semblait radical. Selon Willison, StrongDM avait simplement six mois d'avance, et le vrai problème ouvert n'est plus la génération mais la vérification : comment savoir si un code que personne n'a lu est bon ?
Les questions à vous poser
- Si un Claw écrit et exécute du code sur un appareil de l'entreprise, dans quel sandbox tourne-t-il, et qui, dans votre organisation, peut décrire ce sandbox sans aller vérifier ?
- Les dépenses d'agents de votre équipe sont passées de dérisoires à significatives cette année. Quel est le plafond quotidien par ingénieur, et que devient la production lorsque vous l'appliquez ?
- StrongDM a interdit la relecture humaine du code avec des décennies d'expérience en sécurité dans la salle. Quelle vérification avez-vous qui détecterait ce qu'un relecteur humain aurait détecté ?
- Lorsqu'un fournisseur vous vend un « agent personnel », fait-il quoi que ce soit de structurellement différent d'un agent de codage doté d'une interface plus sympathique ? Demandez-lui d'expliquer la différence en termes de ce qui s'exécute sur la machine.
- Google a entraîné Gemini 3.1 Pro sur de nombreux animaux et de nombreux véhicules et, selon Willison, a vaincu son test du pélican sur une bicyclette. Qu'y a-t-il dans votre suite d'évaluation qui n'ait pas déjà fait l'objet d'un entraînement ?
Ce qu'il faut surveiller ensuite
Surveillez si un Claw sûr arrive réellement chez les consommateurs. Muse de Meta, lancé il y a trois semaines, occupe le haut du classement des applications gratuites de l'App Store iPhone. C'est le premier test grand public pour savoir si cette catégorie survit au contact de gens qui n'ont pas acheté un Mac Mini en guise d'aquarium. La propre newsletter de Willison signale Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna et une nouvelle guerre des prix comme le prochain chapitre. Si les prix des modèles de pointe baissent alors que les budgets de tokens restent plafonnés, la contrainte sur l'adoption des agents cesse d'être la capacité et devient l'approvisionnement.
- 1Avant de lancer un agent de type Claw, isolez-le dans un conteneur ou une machine virtuelle avec des jetons d'API à portée limitée, puisqu'il exécute du code et des commandes shell en votre nom.
- 2Considérez la vitesse de commit comme un signal d'alerte, non comme un atout : auditez la liste des dépendances et les périmètres de permissions d'un dépôt vibe-codé avant de l'adopter en production.
- 3Épinglez un commit ou un tag de version précis lorsque vous dépendez de dépôts d'agents qui évoluent vite, car quatre changements de nom en deux mois casseront vos imports.
Ready to implement AI in your business?
Our team builds the AI systems you just read about. Start with a free 30-minute discovery meeting.
