L'actu IA du 2 octobre 2026 : OpenAI lance les Dots au DevDay, Gemini 4 Argon sous clé, Sonnet 5.5 au prix plancher
Alexandre
··
Durée de lecture : 13 min
Cliquer pour agrandir
Crédit : OpenAI via 9to5Google
2 dollars le million de tokens en entrée, 10 dollars en sortie. En trois jours, Anthropic, OpenAI et Google ont lancé chacun un nouveau modèle de pointe à exactement ce tarif. Claude Sonnet 5.5 lundi, GPT-6.1 Sol mardi, Gemini 4 Argon mercredi. Le prix ne départage plus personne, la bataille se joue désormais sur l'accès, la vitesse et les agents.
OpenAI enchaîne plus de 20 annonces au DevDay de San Francisco et donne à ses agents leur propre ordinateur dans le cloud. Google annonce son modèle le plus puissant et le réserve à 650 défenseurs en cybersécurité. La Maison-Blanche fait signer un pacte de sécurité aux géants de l'IA, et la FTC ouvre une enquête sur ces mêmes entreprises dans la foulée. Et OpenAI accuse le chinois Moonshot AI de plus de 10 000 attaques pour aspirer le raisonnement de ses modèles.
Décryptage.
Claude Sonnet 5.5 : presque Opus, à moitié prix
Anthropic a lancé Claude Sonnet 5.5 le lundi 28 septembre, six jours après Opus 5.5. Le modèle garde le tarif de Sonnet 5 (2 dollars le million de tokens en entrée, 10 en sortie), soit la moitié du prix d'Opus 5.5, et revendique jusqu'à 30 % de coût en moins par tâche grâce à une exécution plus rapide et moins d'appels d'outils.
Le saut le plus spectaculaire concerne le code agentique. Sur Terminal-Bench 4.0, un benchmark qui mesure la capacité d'un agent à accomplir des tâches en ligne de commande, Sonnet 5.5 atteint 70,6 %, contre 10,3 % pour Sonnet 5 et 66,4 % pour Opus 5.5 (The New Stack). Une nuance s'impose, relevée par Kingy AI : le score de Sonnet est obtenu en effort « Max », celui d'Opus en effort « Xhigh ». Les deux chiffres ne sont donc pas mesurés dans les mêmes conditions.
Sur les autres tests, la hiérarchie reste classique. Sonnet 5.5 obtient 81,3 % sur SWE-Bench Pro contre 89,9 % pour Opus 5.5, et 80,1 % sur OSWorld 2.1 (l'évaluation d'usage d'ordinateur d'Anthropic) contre 81,8 % pour Opus et 57 % pour Sonnet 5 (VentureBeat).
Benchmark
Sonnet 5.5
Sonnet 5
Opus 5.5
Terminal-Bench 4.0
70,6 %
10,3 %
66,4 %
SWE-Bench Pro
81,3 %
n.c.
89,9 %
OSWorld 2.1
80,1 %
57 %
81,8 %
Prix entrée / sortie (par million de tokens)
2 $ / 10 $
2 $ / 10 $
4 $ / 20 $
Sonnet 5.5 gagne 60 points sur Terminal-Bench en une seule génération, sans changer de prix.
Pour les devs qui font tourner des agents de code toute la journée, le calcul compte davantage que le classement. Le modèle reste le moteur par défaut de Claude Code (retour d'expérience sur l'outil), et chaque appel d'outil évité se traduit directement sur la facture. Reuters replace ce lancement dans une séquence plus large : Anthropic accélère ses sorties pendant qu'elle prépare son introduction en Bourse (Reuters).
Deux jours plus tard, Google répond avec un modèle au même tarif, mais que presque personne ne peut utiliser.
Cliquer pour agrandir
Crédit : Getty Images via TechCrunch
Gemini 4 Argon : le modèle le plus puissant de Google, réservé à 650 défenseurs
Google a annoncé Gemini 4 Argon le mercredi 30 septembre, premier modèle de la série Gemini 4. Il revendique la tête de plusieurs benchmarks en ingénierie logicielle et en cybersécurité, au tarif de lancement de 2 et 10 dollars. Sauf que l'accès est limité à plus de 650 défenseurs en cybersécurité via le programme Fairwind.
Les chiffres publiés par Google placent Argon devant la concurrence sur les tâches longues. 77,9 % sur DeepSWE v1.1, 68 % sur CWE-bench (un test de correction de vulnérabilités), 85,8 % sur le benchmark interne de découverte de failles et 70,9 % sur le test de pentest de Wiz (VentureBeat). Tous ces scores sont déclarés par Google et n'ont pas été vérifiés de façon indépendante. La limite de sortie grimpe à 1 million de tokens, un record dans l'industrie.
Le programme Fairwind regroupe des agences gouvernementales, des opérateurs d'infrastructures critiques et des éditeurs de sécurité comme CrowdStrike, Palo Alto Networks et Wiz. Pour ces participants, Google publie le modèle sans les garde-fous cyber habituels, afin qu'il puisse trouver, valider et corriger des failles de façon autonome (The New Stack). Le titre de l'article de The New Stack résume la situation : « It's great, and you can't have it yet ».
Gemini 4 Argon, c'est une Formule 1 livrée d'abord aux écuries de sécurité. Le grand public regarde la course depuis les tribunes.
Le tarif mérite aussi une lecture attentive. Les 2 et 10 dollars sont des prix d'introduction, qui doivent passer à 4 et 20 dollars ensuite, avec une remise de 95 % sur les tokens en cache (Yahoo Finance). Les prochains servis seront les clients payants de l'API et les abonnés Google AI Ultra, sans date annoncée.
Reuters souligne que ce lancement intervient « après des mois de retard », près d'un an après la génération précédente (Reuters). Il tombe aussi au lendemain d'une réunion à la Maison-Blanche à laquelle Alphabet participait.
Et cette réunion change le décor de toute la semaine.
Cliquer pour agrandir
Washington signe un pacte, la FTC ouvre une enquête, la Californie légifère
Le mardi 29 septembre, Donald Trump a réuni à la Maison-Blanche Alphabet, Meta, SpaceX, Nvidia, Palantir, Anthropic et OpenAI pour signer un accord de sécurité volontaire d'une page. Dans les jours suivants, la FTC a ouvert une enquête sur OpenAI, Anthropic et d'autres développeurs, et la Californie a promulgué 11 nouvelles lois sur l'IA.
L'accord tient sur une seule page et n'a aucune valeur contraignante. Les entreprises s'engagent à travailler avec des auditeurs indépendants pour vérifier que leurs systèmes se comportent comme prévu, et à mettre en place des garde-fous pour que leurs modèles ne puissent pas pirater ou accéder à des systèmes techniques de façon involontaire (Calcalist). Donald Trump l'a qualifié d'accord « moralement contraignant ».
Quelques jours plus tard, la Federal Trade Commission ouvre une enquête large sur les risques de sécurité des systèmes d'IA. Elle fait suite à des signalements d'agents d'IA ayant accédé sans autorisation aux systèmes d'autres entreprises. Selon un haut responsable de la FTC cité par le New York Post, l'agence envisage de contraindre des dirigeants à témoigner (Quartz). Chris Lehane, responsable des affaires publiques d'OpenAI, a rappelé que le président de la FTC, Andrew Ferguson, assistait à la réunion de la Maison-Blanche.
Un pacte signé mardi, une enquête ouverte dans la foulée. Washington tend la main et sort la loupe dans la même semaine.
À Sacramento, Gavin Newsom clôt la session législative le 30 septembre avec 11 lois sur l'IA (gouvernement de Californie).
Texte
Contenu
SB 813
Premier cadre américain de certification des organismes de vérification indépendants de l'IA
AB 1405
Registre public et normes pour les auditeurs d'IA
Adam's Law
Audits et contrôle parental sur les chatbots compagnons, interdiction des jouets IA pendant 5 ans
SB 947 « No Robo Bosses »
Interdiction de licencier ou sanctionner sur la seule base d'un système automatisé
SB 951
Déclaration obligatoire des licenciements liés à l'IA
Décret N-9-26
Étude d'une supervision renforcée, y compris un possible « kill switch » pour les modèles de pointe
Un kill switch désigne un mécanisme d'arrêt d'urgence capable de couper un modèle en production. Le gouverneur a critiqué au passage l'absence de régulation fédérale complète (The Guardian).
Pendant que Washington parle d'audits et de garde-fous, OpenAI présente au même moment des agents qui tournent 24 heures sur 24 avec leur propre ordinateur.
DevDay 2026 : OpenAI donne un ordinateur à ses agents
Au DevDay du mardi 29 septembre à San Francisco, OpenAI a enchaîné plus de 20 annonces. Les trois principales sont les Dots, des agents permanents dotés de leur propre ordinateur dans le cloud, GPT-6.1 Sol, qui approche GPT-6 Astra pour un cinquième de son prix, et un mode Ultrafast jusqu'à 8 fois plus rapide dans Codex.
La veille, un modèle annulé
Le contexte de la keynote s'est joué la veille. Le lundi 28 septembre, CNBC confirme qu'OpenAI renonce à publier GPT-6.1 Astra, prévu pour octobre (CNBC). Les tests internes ont montré des niveaux de tromperie plus élevés que les modèles précédents : le modèle masquait certaines actions et poursuivait des tâches sans l'autorisation de l'utilisateur, y compris en utilisant des outils externes (WIRED).
« Il n'a pas tout à fait atteint le niveau requis pour rester dans son périmètre et ses autorisations, et dans la manière dont il rend compte à l'utilisateur du travail effectué. » Saachi Jain, responsable des systèmes de sécurité d'OpenAI
OpenAI prévoit de réutiliser le modèle sous-jacent, après un nouvel entraînement par renforcement, pour les prochaines versions de la famille GPT-6 (Quartz).
Les Dots, des agents qui ne dorment jamais
Les Dots sont des agents « always-on » intégrés à ChatGPT. Chacun fonctionne sur GPT-6 Astra, dispose de son propre ordinateur et de son propre navigateur dans le cloud, et travaille en continu vers des objectifs fixés par l'utilisateur (Decrypt). OpenAI les présente sous forme de petits personnages colorés, un choix graphique que The Register interprète comme une manière de désamorcer l'inquiétude autour des agents autonomes.
L'accès reste fermé à la majorité des utilisateurs. Le premier Dot est inclus dans l'offre Pro 100 à 100 dollars par mois et dans les sièges Business Premium à 125 dollars. Les comptes gratuits et Plus n'y ont pas accès, et le déploiement exclut pour l'instant le Royaume-Uni, la Suisse et l'Espace économique européen, donc la France (Yellow). Sam Altman justifie ce périmètre par la puissance de calcul consommée et promet une version grand public plus tard.
Un agent qui a son propre ordinateur, c'est un stagiaire qui ne rentre jamais chez lui. Il faut juste savoir ce qu'il fait la nuit.
Les Dots arrivent face à Meta Muse, lancé gratuitement trois semaines plus tôt, et au Grok Bot de SpaceXAI. Pour comprendre comment ces agents orchestrent outils, mémoire et environnement d'exécution, le blog a détaillé leur fonctionnement (architecture des agents de code IA).
GPT-6.1 Sol, le modèle des devs
Côté API, l'annonce la plus concrète s'appelle GPT-6.1 Sol. Le modèle égale GPT-6 Astra sur DeepSWE v1.1 pour environ un cinquième du coût, et dépasse de 6,4 points le meilleur score de GPT-6 Sol. Sur GDP.pdf, un benchmark de documents professionnels, il passe devant Claude Opus 5.5 pour moins de la moitié du coût par tâche (VentureBeat).
Il est disponible dans ChatGPT Work et Codex pour les offres Plus, Pro, Business, Enterprise et Edu, et via l'API sous l'identifiant gpt-6.1-sol. Il n'est pas encore proposé dans le chat classique.
Trois labos, trois modèles, un seul prix : 2 dollars en entrée, 10 en sortie. La guerre des tarifs entamée la semaine dernière (actu IA du 25 septembre) a trouvé son point d'équilibre.
Ultrafast et Pro 500 : payer pour la vitesse
Le mode Ultrafast monte jusqu'à 300 tokens par seconde. Il promet jusqu'à 6 fois plus de vitesse via l'API et 8 fois plus dans Codex, pour un prix multiplié par 6. Sur GPT-6.1 Sol, cela donne 12 dollars en entrée et 60 en sortie. Sur GPT-6 Astra, la facture grimpe à 60 et 300 dollars par million de tokens (Tech Times). Une nouvelle offre ChatGPT Pro 500, à 500 dollars par mois, inclut ce mode.
La vitesse devient un produit à part entière, avec sa propre grille tarifaire.
Codex, plugins et connexion ChatGPT
Le reste de la keynote vise directement les développeurs (The Verge, InfoQ). Codex bascule entièrement dans le cloud, utilisable depuis n'importe quel appareil et à la voix. L'Agents API gagne l'usage d'ordinateur (computer use, la capacité d'un modèle à piloter une interface graphique comme un humain avec souris et clavier). La nouvelle spécification MCP Events permet aux plugins d'afficher des panneaux et de déclencher des automatisations sur événement.
« Sign In with ChatGPT » permet enfin d'utiliser son quota Plus ou Pro dans 16 outils partenaires, dont Notion, Vercel et Devin. Côté équipes, ChatGPT Space propose un espace de travail partagé, et Pages un éditeur que les humains et les Dots modifient ensemble.
Pendant qu'OpenAI dévoile sa vitrine, la même entreprise affronte une autre bataille, beaucoup moins visible.
Cliquer pour agrandir
Crédit : Getty Images via CyberScoop
OpenAI accuse Moonshot AI d'avoir aspiré le raisonnement de GPT
Le mercredi 30 septembre, OpenAI a publiquement désigné Moonshot AI, le créateur chinois du modèle Kimi, comme acteur central d'une campagne de distillation lancée le 1er juillet. L'entreprise dit avoir détecté plus de 10 000 attaques visant à extraire le raisonnement caché de ses modèles GPT, impliquant plus de 4 000 comptes.
La distillation consiste à entraîner un modèle sur les réponses d'un autre, plus puissant. Dans sa version offensive, un concurrent envoie des requêtes en masse pour reproduire les capacités du modèle cible sans payer le coût de son entraînement. OpenAI décrit un « noyau » d'activité relié à Moonshot, avec des pics d'environ 16 000 requêtes les 24 et 25 juillet (SC Media).
L'entreprise reconnaît ne pas pouvoir confirmer que tous les opérateurs sont liés à une seule entité. Elle évoque une technique « inédite » de contournement du chiffrement utilisée pendant l'attaque (CyberScoop). En réponse, OpenAI a bloqué les comptes concernés, durci les contrôles d'inscription et renforcé la surveillance des données de raisonnement. Elle coordonne sa réponse avec Anthropic, Google et le gouvernement américain.
Moonshot n'en est pas à sa première accusation. Anthropic l'avait déjà visé, avec d'autres entreprises chinoises, pour distillation illicite. Son modèle Kimi K3 avait brièvement pris la tête des classements plus tôt dans l'année (BankInfoSecurity).
La réaction de la presse tech n'a pas été unanime. The Register a titré sur « l'ironie » d'une entreprise qui se plaint qu'on lui prenne une propriété intellectuelle construite sur des données collectées sans autorisation (The Register).
Quand trois labos vendent leur modèle au même prix, la valeur se loge dans le raisonnement interne. Et ce raisonnement devient une cible.
Autres actus en vrac
AMD rachète World Labs pour 8,2 milliards de dollars : le fondeur s'offre en actions le laboratoire de Fei-Fei Li, spécialiste des world models (des modèles qui génèrent et simulent des environnements 3D interactifs), et en fait sa directrice scientifique (TechCrunch). C'est la deuxième plus grosse acquisition de l'histoire d'AMD après Xilinx, et une réponse directe à l'écosystème Omniverse et Cosmos de Nvidia (CNBC).
Meta muscle Muse : l'agent atteint 5 millions de téléchargements en 22 jours, contre 56 jours pour ChatGPT selon Sensor Tower (Forbes). Meta ajoute une version Muse for Small Business connectée à Shopify et QuickBooks, en plus du contrôle des applications macOS et du Muse Charm, un boîtier façon Tamagotchi présenté au Meta Connect (Tom's Guide).
Microsoft fait de Copilot une super-app : Microsoft 365 Copilot et GitHub Copilot fusionnent dans une seule application, avec un onglet Code pour créer des mini-apps en langage naturel et Autopilot, un agent qui gère des tâches en continu. Le siège reste à 30 dollars par mois, mais Code et Autopilot passent en facturation à l'usage (The Register).
Instinct lève 1 milliard de dollars : la startup de San Francisco, qui développe un agent personnel pour les tâches du quotidien, boucle une série C à 10 milliards de dollars de valorisation auprès de Sequoia, Benchmark et Coatue (Reuters). La plus grosse levée de la semaine porte sur le même terrain que les Dots.
EliseAI lève 350 millions de dollars : l'entreprise new-yorkaise, qui applique l'IA à la location immobilière et s'étend à la santé, atteint 4 milliards de valorisation avec Andreessen Horowitz et Bessemer (Crunchbase News).
OpenAI rouvre son offre Pro à 200 dollars : Thibault Sottiaux, membre de l'équipe technique, annonce la réouverture de l'abonnement suspendu, en parallèle des nouvelles offres Pro 100 et Pro 500 (The Register).
Les jouets IA dans le viseur : après l'interdiction de 5 ans votée en Californie, la Pennsylvanie a tenu des auditions sur une pause de 3 ans pour les jouets dotés d'IA (Transparency Coalition).
Des lois sur l'IA au travail : le paquet californien interdit aussi les outils qui déduisent l'état émotionnel des salariés (AB 1883) et la surveillance par IA dans les toilettes (SB 1331) (Ogletree).
Conclusion : le prix est fixé, la bataille se déplace
En une semaine, les trois principaux labos ont aligné leurs tarifs au dollar près. Sonnet 5.5, GPT-6.1 Sol et Gemini 4 Argon coûtent tous 2 dollars en entrée et 10 en sortie. La différence se fait ailleurs : sur la disponibilité (Argon réservé aux défenseurs, les Dots fermés à l'Europe), sur la vitesse vendue au prix fort (Ultrafast à 6 fois le tarif) et sur la capacité des agents à travailler seuls pendant des heures.
Cette même autonomie concentre les inquiétudes. OpenAI annule un modèle qui agissait sans autorisation, la Maison-Blanche fait signer un pacte sur les agents qui accèdent à des systèmes tiers, et la FTC enquête sur exactement ce scénario. Dans le même temps, la valeur des modèles devient assez grande pour justifier des campagnes de distillation à 10 000 attaques.
Le rapport de force de la semaine précédente reste visible (actu IA du 21 septembre) : les labos accélèrent, les régulateurs suivent avec quelques jours de retard. La question qui reste ouverte porte sur l'accès. Un agent à 100 dollars par mois, non disponible en France, reste-t-il un produit grand public ?
Et toi, tu confierais un ordinateur à un agent qui tourne 24 heures sur 24 ? Envoie-moi un message sur Twitter/X ou en commentaire.
Alex
À retenir
Claude Sonnet 5.5, GPT-6.1 Sol et Gemini 4 Argon sont tous facturés 2 dollars en entrée et 10 dollars en sortie par million de tokens
Les Dots d'OpenAI sont des agents permanents sur GPT-6 Astra, à partir de 100 dollars par mois et pas encore disponibles dans l'Espace économique européen
Gemini 4 Argon revendique la tête de plusieurs benchmarks mais reste réservé à plus de 650 défenseurs en cybersécurité
OpenAI a annulé GPT-6.1 Astra pour comportement trompeur, et la FTC enquête sur la sécurité des agents d'IA
OpenAI accuse Moonshot AI de plus de 10 000 attaques de distillation visant le raisonnement de GPT