L'actu IA du 7 septembre 2026 : GPT-6 Astra, Fable 5.1, Gemini 3.8, et la panne qui a tout arrêté
Alexandre
··
Durée de lecture : 10 min
Cliquer pour agrandir
Crédit : Reuters / Al Jazeera
Trois modèles frontier lancés en 72 heures par trois entreprises différentes. Anthropic ouvre le bal le 1er septembre avec Fable 5.1 et Mythos 5.1, Google enchaîne le 2 avec Gemini 3.8 Flash, et OpenAI ferme la marche le 3 avec GPT-6 Astra, que Greg Brockman présente comme l'entrée dans "l'ère AGI".
Côté chiffres, Anthropic signe un contrat cloud de 35 milliards de dollars avec Lambda, OpenAI facture Astra 10 dollars par million de tokens en entrée (50 en sortie), et Google maintient Gemini 3.8 Flash à 0,75 dollar par million de tokens en entrée jusqu'à fin 2026. Le tout avec, en toile de fond, l'administration Trump qui prend officiellement position en faveur d'OpenAI dans le procès copyright du New York Times.
Décryptage.
Anthropic lance Fable 5.1 et Mythos 5.1, et signe 35 milliards avec Lambda
Cliquer pour agrandir
Crédit : Anthropic
Anthropic a sorti Claude Fable 5.1 et Claude Mythos 5.1 le 1er septembre 2026, deux modèles construits sur la même architecture mais avec des niveaux de garde-fous différents. Fable 5.1 est le flagship en disponibilité générale, tandis que Mythos 5.1, avec des safeguards allégés, reste réservé à des participants triés sur le volet dans les programmes d'accès sécurisé d'Anthropic. L'annonce est arrivée le même jour qu'un contrat cloud de 35 milliards de dollars avec Lambda, le fournisseur cloud soutenu par Nvidia (Bloomberg, Quartz).
Les performances de Fable 5.1
Le chiffre qui ressort : 52,6% sur Terminal-Bench-Science 0.1, soit plus du double du résultat de Fable 5 sur ce même benchmark (MarkTechPost). Sur le code, Fable 5.1 gagne 13% sur Terminal-Bench 4.0 par rapport à son prédécesseur. La fenêtre de contexte reste à 1 million de tokens, la sortie maximale à 128 000 tokens, et la réflexion adaptative (adaptive thinking, le mode de raisonnement étendu du modèle) est activée en permanence.
Le cache à -75%
L'autre annonce, moins spectaculaire mais directement impactante pour les développeurs : le prix du cache en lecture passe de 1 dollar à 0,25 dollar par million de tokens. En pratique, ça représente environ 25% de réduction sur les charges de travail classiques, et jusqu'à 45% sur les tâches agentiques complexes qui multiplient les appels au cache (The Decoder, VentureBeat).
Mythos : le même modèle, les garde-fous en moins
Mythos 5.1 tourne sur le même moteur que Fable 5.1, mais avec des contraintes de sécurité allégées. L'accès est limité aux participants des programmes de confiance d'Anthropic, initialement des chercheurs en cybersécurité défensive et en sciences de la vie. Le screening est individuel et sur invitation. L'idée derrière cette approche : permettre aux chercheurs d'explorer les capacités du modèle sans les restrictions qui brident les cas d'usage avancés, tout en contrôlant qui y accède (Anthropic).
35 milliards pour Lambda
Le contrat avec Lambda porte sur environ 350 mégawatts de capacité de calcul dans un nouveau campus de data centers construit par Hut 8 dans le comté de Nueces, au Texas. Nvidia loue l'installation et fournit ses puces de nouvelle génération. Lambda installe le matériel et revend la puissance de calcul à Anthropic. La mise en service est prévue pour le premier trimestre 2027. Ce deal s'ajoute aux 45 milliards de dollars engagés avec Nscale en Virginie-Occidentale et aux 100 milliards sur dix ans avec AWS (PYMNTS, SiliconAngle). L'écosystème Claude ne cesse de s'étendre, des modèles aux outils de développement (présentation complète de Claude Code).
Pendant qu'Anthropic pose ses fondations, Google accélère la cadence de publication à un rythme qui donne le tournis.
Cliquer pour agrandir
Crédit : Google
Google sort Gemini 3.8 Flash, troisième modèle en six semaines
Google a dévoilé Gemini 3.8 Flash le 2 septembre 2026, nom de code interne "Skimaki", en le présentant comme le "cheval de trait le plus intelligent" de l'entreprise pour le code, le raisonnement long et les workflows agentiques. C'est le troisième rafraîchissement de la ligne Flash en six semaines, un rythme de publication qui traduit la volonté de Google de ne pas se laisser distancer par Anthropic et OpenAI sur le terrain du développement logiciel (Quartz, AI Business).
Les benchmarks
Sur DeepSWE v1.1, Gemini 3.8 Flash atteint 73,7%, contre 65,3% pour la version 3.7, soit 8,4 points de progression en trois semaines. Sur Terminal-Bench 2.1, le score passe de 85,8% à 89,4%. Les gains se concentrent sur les tâches de code et de raisonnement multi-étapes, exactement là où les développeurs ont besoin de fiabilité (Incrypted, blog.google).
Flash Cyber : l'IA qui patch Chrome
En parallèle, Google a lancé Gemini 3.8 Flash Cyber, une variante spécialisée dans la détection de vulnérabilités et le patching automatisé. La variante Cyber corrige 2,6 fois plus de vulnérabilités Chrome que son prédécesseur sur les benchmarks internes de Google (Tech Insider). L'accès est réservé aux gouvernements et opérateurs d'infrastructures critiques via le programme Fairwind, un programme restreint sur candidature, similaire dans l'esprit au Daybreak d'OpenAI.
Pricing : le calme avant la hausse
Google maintient le tarif d'introduction à 0,75 dollar par million de tokens en entrée et 3,75 dollars en sortie jusqu'au 31 décembre 2026. Après cette date, les prix doublent. Pour les développeurs qui construisent sur Gemini, c'est un signal clair : verrouiller les coûts maintenant ou prévoir le budget pour 2027 (SammyGuru).
Le modèle est disponible via l'API Gemini, AI Studio, Android Studio et Gemini Enterprise, ainsi que pour les abonnés Pro et Ultra. L'action Alphabet a pris 0,7% en after-hours après l'annonce (Shattered).
Et pendant que Google itère à toute vitesse sur Flash, OpenAI prépare une annonce d'une tout autre envergure.
Cliquer pour agrandir
Crédit : OpenAI / The New Stack
OpenAI lance GPT-6 Astra et déclare l'entrée dans "l'ère AGI"
OpenAI a lancé GPT-6 Astra le 3 septembre 2026 en le présentant comme "le modèle le plus intelligent et le plus aligné au monde". Greg Brockman, président d'OpenAI, a déclaré "Welcome to the AGI era" lors de la présentation, positionnant Astra comme une étape vers l'intelligence artificielle générale. Le modèle affiche 97,6% sur FrontierMath Tier 4 v2, 98,6% sur ARC-AGI-3 et 100% sur ExploitBench, le benchmark de cybersécurité (CNBC, OpenAI).
Le premier modèle "Critical"
Astra est le premier modèle à franchir le seuil "Critical" du Preparedness Framework d'OpenAI, le cadre interne qui évalue les risques de chaque modèle avant sa mise en production. En clair : le modèle est capable de générer des exploits fonctionnels en cybersécurité, et ces capacités sont volontairement bloquées en production. Les fonctionnalités avancées de cybersécurité ne sont accessibles qu'aux entreprises sélectionnées via le programme Daybreak (un programme d'accès restreint sur candidature pour les organisations autorisées), comparable au Fairwind de Google ou au programme Mythos d'Anthropic (Fortune, CNET).
AGI ou marketing ?
100% sur un benchmark de cybersécurité, ça ne veut pas dire intelligence artificielle générale. Plusieurs analystes rappellent qu'ExploitBench mesure la capacité du modèle à identifier et reproduire des vulnérabilités connues, pas à raisonner de manière autonome dans des situations inédites (Yahoo/ATT). Sur les benchmarks plus larges, Astra domine Fable 5.1 et Gemini 3.8 Flash sur la plupart des évaluations internes d'OpenAI, mais chaque entreprise teste sur ses propres grilles, ce qui rend les comparaisons directes difficiles.
Pricing et disponibilité
L'API standard est facturée 10 dollars par million de tokens en entrée et 50 dollars en sortie. Un mode "Fast" à environ le double du tarif standard promet un traitement 2,5 fois plus rapide. Le modèle est disponible pour les abonnés ChatGPT Plus (20 dollars par mois), Pro (100 à 200 dollars par mois), Business et Enterprise, ainsi que via l'API, Microsoft Azure, Amazon Bedrock et AWS. La cybersécurité avancée reste réservée au programme Daybreak. Le computer use (la capacité du modèle à contrôler un ordinateur de bout en bout) fait partie des capacités mises en avant pour les tâches de recherche, de code et de science (PCMag, The New Stack).
Pour les développeurs qui travaillent avec plusieurs fournisseurs, la semaine donne le vertige : trois modèles frontier en 72 heures, chacun avec ses spécificités et ses programmes d'accès restreints. La comparaison détaillée entre ces architectures et leur fonctionnement dans un workflow de code (architecture des agents de code IA) ne fait que confirmer que la diversification multi-modèles est devenue une nécessité opérationnelle.
ChatGPT, Claude, Grok et Gemini tombent en même temps pendant 90 minutes
Le 3 septembre 2026, quelques heures après le lancement de GPT-6 Astra, les quatre principaux chatbots IA ont subi une panne simultanée. ChatGPT, Claude, Grok et Gemini se sont retrouvés hors service dans la même fenêtre de 90 minutes, laissant des millions d'utilisateurs sans accès. Downdetector a enregistré un pic massif de signalements, et Microsoft Azure a confirmé un incident dans sa région East US (Quartz, Economic Times).
Azure, le point commun
L'analyse post-incident pointe vers une panne régionale d'Azure East US, la région cloud de Microsoft qui héberge ChatGPT, Claude et Grok. Les trois services dépendent de l'infrastructure Azure pour tout ou partie de leur fonctionnement. Gemini, qui tourne sur l'infrastructure propre de Google, a récupéré plus vite que les autres. Cloudflare et AWS ont aussi signalé des perturbations liées dans la même fenêtre de temps (Shattered, Tech Insider).
La chronologie
La panne a commencé dans les premières heures de la matinée (heure du Pacifique). OpenAI a confirmé des taux d'erreur élevés sur ChatGPT et Codex. Anthropic a signalé des pannes sur plusieurs modèles Claude, dont Opus 4.8 et Opus 5. xAI a reconnu que Grok était hors service. Les premiers signes de rétablissement sont apparus vers 8h49 PT, avec un retour complet de ChatGPT, Claude et Grok confirmé à 12h38 PT. Gemini est revenu à la normale peu après.
Ce que ça révèle
Quatre concurrents, un même point de défaillance. La dépendance d'une grande partie de l'industrie IA à Azure East US crée un risque systémique que peu d'utilisateurs mesurent. Quand trois des quatre principaux chatbots partagent la même infrastructure critique, une panne régionale Azure ne touche pas un service, elle paralyse l'écosystème. L'incident tombe le jour même du lancement d'Astra, ce qui ajoute une couche d'ironie à la communication d'OpenAI sur "l'ère AGI" : l'intelligence artificielle la plus avancée au monde reste tributaire d'un data center dans l'est des États-Unis.
L'incident rappelle pourquoi la diversification d'infrastructure reste un sujet aussi critique que la diversification de modèles (l'actu IA du 29 août).
Cliquer pour agrandir
Crédit : Bloomberg Law
L'administration Trump soutient OpenAI contre le New York Times sur le copyright
Le 2 septembre 2026, le département de la Justice américain a déposé un mémoire de 20 pages en faveur d'OpenAI dans le procès copyright intenté par le New York Times. C'est la première fois que le gouvernement fédéral intervient officiellement en faveur d'une entreprise d'IA dans un litige de propriété intellectuelle. Le DOJ qualifie l'entraînement des modèles sur du contenu protégé de "extraordinairement transformateur" et invoque le fair use, la doctrine juridique qui permet l'utilisation d'œuvres protégées à certaines conditions (Bloomberg Law, Politico).
L'argument "sécurité nationale"
Le mémoire du DOJ va plus loin que le simple fair use. Il avance qu'une victoire du New York Times pourrait "menacer la sécurité nationale" en freinant le développement de l'IA américaine face à la concurrence chinoise. Le département argue aussi qu'une obligation de licence bénéficierait disproportionnellement aux grands éditeurs au détriment des petites rédactions, qui n'auraient pas les moyens de négocier des accords avec les entreprises IA (Nieman Lab, Quartz).
Les implications au-delà de la presse
Cette prise de position dépasse largement le cas du New York Times. L'industrie musicale, qui mène ses propres batailles juridiques contre Anthropic et Suno, observe de près. Si la justice retient le fair use pour l'entraînement de modèles sur des articles de presse, le précédent s'appliquera potentiellement à la musique, aux images et à tout contenu créatif utilisé comme données d'entraînement (Music Business Worldwide).
Le timing de cette intervention n'est pas anodin. Sam Altman a pris la parole au G20 Innovation Ministerial à Chapel Hill le 2 septembre, le même jour que le dépôt du mémoire, où il a déclaré que l'IA est "non-négociable" pour la croissance économique (News Observer). La proximité entre OpenAI et l'administration américaine se lit à chaque page du mémoire.
Autres actus en vrac
Sam Altman au G20 : "L'IA est non-négociable" : au G20 Innovation Ministerial à Chapel Hill le 2 septembre, le CEO d'OpenAI a déclaré que les systèmes IA futurs agiront comme des "collaborateurs virtuels persistants". Il a aussi affirmé que "le travail qui prenait trois mois à une startup peut désormais se faire en 17 minutes avec Codex" (ETV Bharat).
Lyte, fondée par d'ex-ingénieurs Apple Face ID, lève 165 millions de dollars : la startup robotique et IA a triplé sa valorisation à 1,6 milliard de dollars. Le tour de financement confirme l'appétit des investisseurs pour l'IA appliquée à la vision et à la robotique (Bloomberg).
Crusoe passe le cap des 30 milliards de valorisation : la startup IA spécialisée dans l'infrastructure cloud a bouclé un nouveau tour de financement le 4 septembre, portant sa valorisation à environ 30 milliards de dollars.
Le Texas stoppe les contrats data centers IA : la commission des services publics du Texas a annoncé un moratoire sur les nouveaux contrats d'alimentation électrique pour data centers IA, citant une "demande fantôme" (des projets qui réservent de l'énergie sans jamais se construire). Le signal est clair : la croissance de l'infrastructure IA se heurte aux limites du réseau électrique (The Star).
Conclusion : la semaine où tout a accéléré
Trois modèles frontier en 72 heures, 35 milliards de dollars de contrats cloud, le gouvernement américain qui prend position sur le copyright IA, et une panne qui révèle que tout cet écosystème tient sur une poignée de data centers Azure. Le rythme est devenu tellement soutenu que chaque annonce a moins de 24 heures d'exposition avant d'être éclipsée par la suivante.
La vraie question de cette semaine ne porte pas sur les benchmarks. Elle porte sur l'infrastructure. Quand trois des quatre principaux services IA partagent le même point de défaillance, le progrès des modèles devient secondaire par rapport à la résilience de ce qui les fait tourner. Les 180 milliards de dollars qu'Anthropic a engagés en contrats d'infrastructure en 2026 (Lambda, Nscale, AWS) montrent que l'entreprise l'a compris.
Et toi, tu as ressenti la panne du 3 septembre ? Tu diversifies tes outils IA ou tu restes sur un seul fournisseur ? Envoie-moi un message sur Twitter/X ou en commentaire.
Alex
À retenir
Fable 5.1 et Mythos 5.1 sortent le 1er sept, cache à -75%, 52,6% sur Terminal-Bench-Science
Gemini 3.8 Flash est le 3e modèle Google en 6 semaines, prix inchangé à 0,75$/M tokens jusqu'à fin 2026
GPT-6 Astra obtient 97,6% sur FrontierMath et 100% sur ExploitBench, facturé 10$/M tokens en entrée
ChatGPT, Claude, Grok et Gemini tombent simultanément pendant 90 min, Azure East US en cause
L'administration Trump dépose un mémoire en faveur d'OpenAI dans le procès copyright du NYT