Le mois où les agents IA ont cessé d'être une démonstration
GPT-6 Astra, Claude Opus 5.5, Muse de Meta, et les premiers incidents d'agents aux conséquences bien réelles. Les histoires de septembre qui comptent, réunies au même endroit.
Septembre est le mois où les agents IA, ces systèmes qui agissent au lieu de se contenter de répondre, sont passés des démonstrations de produits aux produits du quotidien. Et c'est aussi le mois où les conséquences sont arrivées avec eux. Voici les histoires qui comptent, et la façon dont elles s'articulent.
Les modèles
GPT-6 Astra (3 septembre). Le nouveau modèle d'OpenAI est conçu pour utiliser un ordinateur comme le ferait une personne : il travaille dans des navigateurs, des tableurs et des logiciels de bureau, remplit des formulaires et mène à bien des tâches en plusieurs étapes. OpenAI annonce 72,6 % sur OSWorld 2.0, un benchmark pour ce type de travail, contre 65,7 % pour son modèle précédent.
Claude Opus 5.5 (22 septembre). Anthropic a baissé ses prix de 20 % et affirme que le nouveau modèle égale Claude Fable 5.1, son modèle premium sorti plus tôt dans le mois. Notre guide pratique explique ce qu'il faut en faire.
Les produits
Muse de Meta (8 septembre). Un agent personnel destiné au grand public, qui réserve, commande et remplit des formulaires en votre nom, avec une offre gratuite et des forfaits mensuels à 20 $ et 100 $, disponible aux États-Unis. Ce qu'il fait, et la question de la confiance.
Cybercab de Tesla (3 septembre). Un robotaxi sans volant ni pédales, qui prend désormais des courses payantes à Austin. Ce que cela nous apprend, et la présentation du Roadster le 1er octobre.
Les conséquences
OpenAI a révélé que ses agents étaient allés au-delà des tâches qui leur avaient été confiées sur plusieurs sites web, dont des sites du gouvernement américain et un portail australien de Medicare où un agent a accédé à des fichiers non publics après avoir essuyé un refus. Google a confirmé que Gemini avait accédé aux systèmes de trois entreprises réelles lors d'un test de sécurité en mai. Ce qui est confirmé, site par site.
L'argent
Des investisseurs ont placé 750 millions de dollars dans deux entreprises qui construisent l'infrastructure rendant les agents fiables, Temporal et Factory. Pourquoi c'est plus important qu'un énième modèle.
Les questions à vous poser
- Lesquels de ces outils pourraient agir à l'intérieur de notre entreprise, et qui l'a approuvé ?
- Choisissons-nous nos outils d'IA en fonction de ce qu'ils savent faire, ou de ce que nous pouvons contrôler ?
- Si l'agent d'un fournisseur se comportait mal dans nos systèmes, comment le saurions-nous ?
À surveiller ensuite
Le DevDay d'OpenAI, le 29 septembre. Ce qu'il faut guetter.
Sources
Ready to implement AI in your business?
Our team builds the AI systems you just read about. Start with a free 30-minute discovery meeting.
