Actu IA

L'actu IA du 25 septembre 2026 : Altman et Amodei devant l'ONU, guerre des prix en 90 minutes, Jev casse le moule du LLM

Alexandre
Alexandre
··
Durée de lecture : 10 min
Sam Altman s'exprime devant le Conseil de sécurité des Nations unies, le 23 septembre 2026

Cliquer pour agrandir

Crédit : AFP via Al Jazeera
Le 22 septembre, Anthropic met Claude Opus 5.5 en ligne et coupe ses tarifs de 20%. Quatre-vingt-dix minutes plus tard, OpenAI publie GPT-6 Sol et GPT-6 Luna, deux modèles positionnés à peu près à la moitié du prix de la génération précédente. Le lendemain, les patrons des deux entreprises se retrouvent devant le Conseil de sécurité des Nations unies pour expliquer que leur industrie a besoin d'être encadrée.
La semaine tient dans cet écart. TypeSafe AI sort Jev, un modèle qui ne sait pas écrire une phrase et revendique 193 fois plus de vitesse pour 445 fois moins cher. Factory lève 200 millions de dollars à 5 milliards de valorisation pour ses agents de code. Crusoe boucle une Series F de 3,9 milliards à 30,9 milliards. Et une simulation Forcepoint montre comment un agent mal bridé passe 500 appels d'outils en un seul tour.
Décryptage.

Jev, le modèle qui ne sait pas écrire et qui s'en vante

TypeSafe AI a lancé Jev le 19 septembre, un modèle dit "System One" qui ne produit pas de texte libre mais choisit une réponse parmi des options définies, avec un score de confiance. L'entreprise revendique 193 fois plus de vitesse et 445 fois moins cher qu'un LLM classique, à 0,042 dollar le million de tokens en entrée, la sortie étant gratuite.
L'idée vient de Daniel Kahneman. Un modèle System One répond vite et par instinct, là où un LLM classique fait du System Two, lent et délibératif. Concrètement, Jev ne rédige rien : tu lui donnes un texte et une liste de sorties possibles, il renvoie un choix et une probabilité. Simon Willison, qui a décortiqué le lancement le 21 septembre, parle d'une nouvelle forme de modèle, les "decision models", et Zapier résume le positionnement en une image : un if-statement intelligent.
Le cas d'usage n'est pas la conversation, c'est la plomberie. Router un ticket vers la bonne équipe, classer un contenu, détecter une fraude, choisir quel outil un agent doit appeler. Autant de micro-décisions que la plupart des équipes font aujourd'hui tourner sur un modèle de génération à 3 ou 5 dollars le million de tokens, uniquement parce qu'il n'existait rien d'autre. Tom's Hardware note que le modèle se facture uniquement en entrée, ce qui a du sens quand la sortie tient en un mot.
L'autre usage mis en avant par TypeSafe est la surveillance : Jev peut lire les traces d'un agent LLM pour repérer un désalignement ou une tentative de jailbreak, c'est-à-dire un prompt conçu pour contourner les garde-fous du modèle. Une brique de contrôle à côté du modèle principal, pas à sa place. Le sujet de l'orchestration entre modèles spécialisés a déjà été creusé sur le blog (architecture des agents de code IA).
Pendant que TypeSafe attaque le problème par le bas du spectre, les deux gros laboratoires se battent sur le haut.
Anthropic a mis Claude Opus 5.5 en ligne le 22 septembre 2026

Cliquer pour agrandir

Crédit : Anthropic

Anthropic baisse ses prix, OpenAI répond en 90 minutes

Anthropic a publié Claude Opus 5.5 le 22 septembre, premier modèle de la famille 5.5. Selon l'annonce officielle, il se situe au niveau de Claude Fable 5.1 sur la majorité des tâches tout en coûtant 40% moins cher à faire tourner qu'Opus 5, avec un prix par token en baisse de 20% et un coût de cache réduit de 60%. Quatre-vingt-dix minutes plus tard, OpenAI sortait GPT-6 Sol et GPT-6 Luna.
Le communiqué d'Anthropic est direct : Opus 5.5 "performe au niveau de Claude Fable 5.1 sur la plupart des travaux et coûte 40% moins cher à faire tourner qu'Opus 5" (Anthropic). La réduction de 60% sur le cache mérite un mot, parce que c'est le poste qui pèse le plus sur une facture d'agent : le prompt caching consiste à facturer moins cher les portions de contexte déjà envoyées lors d'un appel précédent, et un agent qui boucle sur le même codebase relit sans arrêt les mêmes fichiers.
La riposte d'OpenAI est arrivée dans la foulée, avec deux variantes GPT-6 visant le milieu et le bas de gamme, à environ la moitié du tarif des modèles GPT-5.6. SiliconANGLE a horodaté la séquence : Anthropic annonce, OpenAI publie "quelques minutes plus tard". Quartz et KDnuggets confirment le même cadrage, à savoir une performance maintenue et un prix cassé.
C'est la deuxième fois en un mois que les deux laboratoires publient à quelques heures d'intervalle. La différence avec les cycles précédents, c'est que l'argument de vente n'est plus le benchmark mais la facture. Aucune des deux annonces ne revendique un saut de capacités : les deux revendiquent le même niveau pour moins cher. Pour un développeur solo qui fait tourner des agents en continu, c'est la variable qui compte vraiment (mon usage quotidien de Claude Code).
Cette baisse de prix arrive au moment précis où les investisseurs remettent des milliards dans la couche du dessous.
Crusoe a levé 3,9 milliards de dollars pour ses datacenters IA modulaires

Cliquer pour agrandir

Crédit : ETCIO Datacenters

L'argent va aux agents de code et aux datacenters

Factory a levé 200 millions de dollars à 5 milliards de valorisation, contre 1,5 milliard plus tôt dans l'année. Sur la même fenêtre, Crusoe a bouclé une Series F de 3,9 milliards à 30,9 milliards de valorisation, et Temporal une Series E de 550 millions à 12,6 milliards. Les trois plus gros chèques de la période vont au code automatisé et à l'infrastructure qui le fait tourner.
Factory vend des "Droids", des agents autonomes positionnés sur l'ensemble du cycle de développement et pas seulement sur la complétion de code. Le tour a été confirmé par l'entreprise et relayé par Forbes le 25 septembre. L'argument commercial porte moins sur la qualité du code que sur le contrôle : choix du modèle, déploiement cloud, on-premise ou air-gapped, et une couche de mesure qui rattache les sessions d'agents et la dépense associée aux projets, tickets et pull requests. Une valorisation multipliée par plus de trois en quelques mois sur une promesse de gouvernance, c'est-à-dire sur des besoins d'équipes qui n'ont rien à voir avec ceux d'un développeur indépendant (les coulisses d'une app construite en solo).
Côté infrastructure, Crusoe a annoncé 3,9 milliards de dollars en Series F, co-menée par Valor Equity Partners, Atreides Management et Mubadala Capital, avec Founders Fund, Nvidia, GIC, la Qatar Investment Authority, Radical Ventures et TPG au tour de table (Crunchbase News). L'entreprise bascule vers des datacenters IA modulaires, des blocs préfabriqués qu'on pose à côté d'une sous-station électrique plutôt que des bâtiments construits sur mesure (ETCIO).
Temporal complète le tableau avec 550 millions menés par Lightspeed, Goldman Sachs Alternatives, Wellington Management et Tiger Global. L'entreprise fait des workflows distribués tolérants aux pannes, soit exactement la couche dont un agent a besoin quand il enchaîne cinquante appels d'outils et qu'un seul échoue. Trois tours, trois positions sur la même chaîne : l'agent, le workflow, la machine.
Sam Altman écoute les débats lors de la session du Conseil de sécurité consacrée à l'intelligence artificielle, le 23 septembre 2026

Cliquer pour agrandir

Crédit : Reuters via CNN

Altman et Amodei demandent une régulation mondiale, Trump la refuse

Le 23 septembre, Sam Altman et Dario Amodei se sont exprimés devant le Conseil de sécurité des Nations unies lors d'une session convoquée par la France. Les deux dirigeants ont averti que l'IA, mal gérée, constituait "un risque pour l'humanité dans son ensemble" et demandé des mécanismes de supervision internationaux. Le même jour, Donald Trump rejetait à la tribune toute régulation internationale de l'IA.
Amodei, intervenu en visioconférence, a posé trois propositions concrètes selon CNN : une interdiction internationale étroite portant sur l'usage de l'IA pour concevoir des armes biologiques, un système d'évaluation et de vérification permettant aux États de contrôler mutuellement le respect des engagements, et des standards communs de test assortis d'un mécanisme de notification des incidents de sécurité. Le patron d'Anthropic a par ailleurs réaffirmé sa position sur le rythme de développement, dans la continuité de l'essai qu'il avait publié deux semaines plus tôt (le détail de cette séquence).
Altman a insisté sur un point différent : ce sont les processus démocratiques et des gouvernements responsables qui doivent définir la politique en matière d'IA, pas une poignée de laboratoires de la Silicon Valley (Al Jazeera). Les ministres des Affaires étrangères français et britannique ont appelé à des cadres communs. Hugging Face, désormais dans le giron de Nvidia, participait également à la session. France 24 et Le Monde ont couvert la séance dans les mêmes termes.
L'administration américaine, elle, a maintenu sa ligne. Donald Trump a écarté toute mise en place de nouveaux garde-fous internationaux, ce qui place les deux entreprises dans une position inhabituelle : elles demandent une supervision que leur propre gouvernement refuse d'organiser. Un dirigeant qui réclame publiquement des contraintes que personne n'a le pouvoir de lui imposer reste, en pratique, son seul régulateur.
Le lendemain, Anthropic donnait un exemple parfait de ce qui rend le débat concret. L'entreprise a annoncé le 24 septembre que Claude avait identifié un système enzymatique comparable à CRISPR, soit exactement le type de capacité biologique qu'Amodei propose d'encadrer la veille (Al Jazeera). Découverte scientifique et risque de prolifération sont la même compétence, vue de deux côtés.
Le denial of wallet ne coupe aucun service : il vide le budget

Cliquer pour agrandir

Crédit : Kaspersky Daily

La facture comme surface d'attaque : l'OWASP classe la consommation illimitée sixième

Le Top 10 OWASP 2026 pour les applications LLM classe la "consommation illimitée" au sixième rang des risques. Une simulation Forcepoint publiée cette semaine montre un agent assistant de recherche, sans limite de récursion ni budget d'appels, déclencher 500 appels d'outils sur un seul tour. Avec des garde-fous, le même scénario retombe à un appel et environ 0,02 dollar.
L'attaque s'appelle agent-tool fan-out. Un attaquant empoisonne l'entrée de l'agent, c'est-à-dire qu'il glisse dans un contenu que l'agent va lire une instruction qui déclenche des appels en cascade. Chaque requête prise isolément reste dans les limites de débit, donc rien ne se déclenche côté monitoring. C'est l'agrégat qui explose. SC Media rapporte un coût simulé d'environ 0,50 dollar dès le centième tour, montant à plusieurs centaines de dollars sur des sessions concurrentes.
Le nom du scénario est parlant : denial of wallet. Pas de déni de service, pas de fuite de données, juste une facture qui grimpe jusqu'à ce que quelqu'un regarde le tableau de bord. Dark Reading détaille cinq variantes du même mécanisme dans le rapport Forcepoint, du traitement en boucle au vol de modèle. Kaspersky note de son côté que 2026 est la première année où de grandes entreprises ont dépassé leur budget IA de façon significative, Uber ayant épuisé son enveloppe annuelle dès avril (Kaspersky).
Les contre-mesures testées sont volontairement basiques : un budget d'appels par session, un plafond de profondeur de récursion, et un disjoncteur agentique qui coupe l'exécution dès qu'un fan-out anormal est détecté. Ces trois réglages ramènent la simulation de 500 appels à un seul. Rien qui demande une refonte d'architecture, juste des limites explicites que la plupart des frameworks laissent ouvertes par défaut (dix leviers pour diviser ta facture de tokens).
La séquence de la semaine se lit d'un bout à l'autre sur cette ligne : des modèles moins chers, des agents qui appellent plus d'outils, et un plafond de dépense que personne ne pose tant qu'il n'a pas sauté.

Autres actus en vrac

Mistral rachète Pimento : la société parisienne poursuit ses acquisitions après sa Série D de 3 milliards d'euros menée par Samsung le 8 septembre, qui porte sa valorisation post-money au-delà de 21 milliards d'euros. L'opération vise son assistant Vibe plus que la publicité (Cryptonomist).
Nvidia finalise le rachat de Hugging Face : l'accord définitif signé le 2 septembre porte sur environ 13 milliards de dollars, dont 11 milliards aux investisseurs et environ 1 milliard en rétention salariale, pour une plateforme utilisée par plus de 18 millions de développeurs (TIKR).
Cloudflare change ses réglages par défaut sur les crawlers : depuis le 15 septembre, les bots sont classés en trois catégories, Search, AI-Training et AI-Agent, les deux dernières étant bloquées sur les pages financées par la publicité. Si ton agent va chercher du contenu web, vérifie dans quelle case il tombe (Shattered).
Les frameworks d'agents publient en série : LangChain 1.3.15 (core 1.6.4), LlamaIndex 0.14.25 et CrewAI 1.15.22 sont sortis autour des 20 et 21 septembre. LangSmith ajoute une option auto-hébergée et cesse par défaut d'enregistrer le contenu des requêtes et des réponses.
Google transforme les API REST en outils MCP : un billet du 24 septembre détaille comment exposer des endpoints REST à des agents via le Model Context Protocol avec Cloud API Gateway, et ajoute une couche Agent Gateway pour la gouvernance (Google Developers).
Ringg résout 65% des appels clients sur GPT-5.6 : l'entreprise annonce le 24 septembre des agents vocaux multilingues à un coût inférieur d'environ 90% à sa configuration GPT-4.1 (OpenAI).

Conclusion : la semaine où le prix est devenu le vrai sujet

Trois annonces, une même direction. Jev vend une décision à 0,042 dollar le million de tokens. Anthropic baisse Opus de 20% et le cache de 60%. OpenAI répond à moitié prix en quatre-vingt-dix minutes. Aucune des trois ne promet un modèle plus intelligent : les trois promettent le même travail pour moins cher.
Et au moment précis où le coût unitaire s'effondre, le rapport Forcepoint rappelle que le volume, lui, n'a aucune limite native. Un agent qui passe 500 appels d'outils sur un tour ne coûte presque rien par appel. C'est le compteur qui fait mal, pas l'unité. Les trois garde-fous qui ramènent la simulation à un seul appel tiennent en quelques lignes de configuration, et restent désactivés par défaut chez la plupart des frameworks sortis cette semaine.
Au-dessus, le Conseil de sécurité a passé une journée à discuter d'un encadrement que le principal pays concerné refuse d'organiser. Les propositions d'Amodei, vérification mutuelle, standards de test partagés, notification des incidents, ressemblent beaucoup à ce que les équipes techniques appellent des limites explicites. À une échelle où personne n'a encore le pouvoir de les imposer.
Et toi, tu as mis un plafond de dépense sur tes agents, ou tu regardes la facture à la fin du mois ? Envoie-moi un message sur Twitter/X ou en commentaire.
Alex

À retenir

  • TypeSafe AI lance Jev le 19 septembre, un modèle System One qui renvoie une décision et un score de confiance au lieu de texte, à 0,042 dollar le million de tokens en entrée
  • Anthropic publie Claude Opus 5.5 le 22 septembre avec 40% de coût en moins qu'Opus 5, 20% de baisse sur le prix par token et 60% sur le cache
  • OpenAI riposte quatre-vingt-dix minutes plus tard avec GPT-6 Sol et GPT-6 Luna, à environ la moitié du tarif des modèles GPT-5.6
  • Factory lève 200 millions à 5 milliards de valorisation pour ses agents Droids, Crusoe 3,9 milliards à 30,9 milliards et Temporal 550 millions à 12,6 milliards
  • Le 23 septembre, Altman et Amodei demandent une supervision internationale au Conseil de sécurité de l'ONU pendant que Donald Trump rejette toute régulation mondiale
  • Le Top 10 OWASP 2026 classe la consommation illimitée sixième, et une simulation Forcepoint montre 500 appels d'outils en un tour ramenés à un seul avec trois garde-fous

Je suis Alex, créateur de Waku. Retrouve-moi sur Twitter/X et Instagram.

Commentaires

Commentaires

Tu as un avis sur cet article ?

Crée un compte gratuit en 10 secondes pour commenter, laisser des likes et recevoir les prochains articles directement dans ta boîte mail.

Pas encore de compte ?

Ce site utilise des cookies pour les statistiques de visite et la publicité. Aucune donnée personnelle n'est revendue. En savoir plus