actualité

Actu IA mai 2026 : GPT-5.5, SpaceX, Codex, le phone OpenAI

Alexandre
Alexandre
··
Durée de lecture : 15 min
OpenAI a dominé le cycle d'info cette semaine d'une manière que même les fans trouvaient excessive. Cinq annonces majeures en quatre jours, sur des verticales complètement différentes : modèles, infrastructure compute, navigateur, hardware, procès. C'est le genre de semaine où tu réalises que la compagnie ne cherche plus à convaincre les devs un produit à la fois, mais à rendre la fuite impossible sur chaque surface.
Cinq actus qui méritent qu'on s'y arrête : GPT-5.5 Instant devient le défaut ChatGPT avec -52,5 % d'hallucinations, Anthropic signe avec SpaceX pour 220 000 GPU afin de lever ses rate limits, OpenAI lance Codex comme plugin Chrome avec accès aux DevTools, le smartphone OpenAI est fast-tracké pour l'automne 2027 avec un OS propriétaire, et Greg Brockman révèle sous serment une fortune de 30 milliards construite sans investissement direct. La semaine précédente avait déjà été chargée, entre Copilot, Mythos et l'agent qui a tout supprimé — cette semaine enfonce le clou.
Je construis Waku avec Claude Code et, concrètement, trois de ces annonces touchent directement mes sessions de dev : les rate limits Claude, les Realtime APIs et l'accès DevTools de Codex. Le reste, c'est de la stratégie macro qui prendra deux ans à atterrir.

Le radar de la semaine

ÉvénementDateActeurChiffre cléSource
GPT-5.5 Instant nouveau défaut ChatGPT5 maiOpenAI-52,5% hallucinationsTechCrunch
Anthropic signe avec SpaceXAI (Colossus 1)6 maiAnthropic220 000+ GPU, 300 MWForbes
Codex plugin Chrome + GPT Realtime API7 maiOpenAI70 langues, accès DevToolsEngadget
Smartphone OpenAI fast-tracké5 maiOpenAI (Kuo)30M unités 2027-28The Verge
Greg Brockman : 30 Md$ au tribunal4 maiProcès Musk v. OpenAI0 investi, 2,5-3% equityWashington Post

GPT-5.5 Instant : -52,5 % d'hallucinations et mémoire transparente pour ChatGPT

Le 5 mai 2026, OpenAI a remplacé GPT-5.3 Instant par GPT-5.5 Instant comme modèle par défaut de ChatGPT et de l'endpoint chat-latest de l'API. La réduction des hallucinations sur des domaines sensibles atteint 52,5 %, avec 81,2 sur l'AIME 2025 et 76,0 sur MMMU-Pro. La nouveauté structurelle : les "memory sources" affichent exactement quels fichiers et emails le modèle a utilisés pour personnaliser une réponse.
Selon TechCrunch, la mise à jour est automatique pour tous les utilisateurs ChatGPT web. L'endpoint chat-latest de l'API bascule aussi sur GPT-5.5 Instant sans action requise. Les développeurs qui avaient épinglé GPT-5.3 Instant conservent leur version — elle reste disponible aux plans payants pendant encore trois mois.
Les chiffres précis : 52,5 % de réduction des hallucinations sur prompts sensibles (droit, médecine, finance), 37,3 % de baisse des inexactitudes sur conversations difficiles. Sur les benchmarks standards : 81,2 sur l'AIME 2025 (mathématiques), 76,0 sur MMMU-Pro (raisonnement multimodal). Pour comparaison, GPT-5.3 Instant tournait à 74,1 sur AIME et 71,6 sur MMMU-Pro selon les données de Papers With Code.
Memory sources : fonctionnalité de ChatGPT qui rend visible quels documents, emails Gmail connectés ou conversations passées ont été utilisés par le modèle pour contextualiser une réponse. Chaque source est supprimable individuellement depuis l'interface.
La feature "memory sources" mérite un paragraphe séparé parce qu'elle change quelque chose de fondamental dans la relation utilisateur-modèle. Jusqu'ici, la personnalisation était une boîte noire : ChatGPT "te connaissait" mais tu ne savais pas à partir de quoi. Maintenant tu vois exactement les sources — un email spécifique, un fichier partagé, un échange datant du mois dernier — et tu peux les supprimer une à une. Disponible en plans Plus et Pro sur le web en priorité, Free et Enterprise dans les prochaines semaines.
Le 7 mai, trois modèles Realtime s'ajoutent à l'API (TechCrunch) : GPT-Realtime-2 (voix + raisonnement GPT-5, facturé au token), GPT-Realtime-Translate (70 langues source, facturation à la minute) et GPT-Realtime-Whisper (speech-to-text live, à la minute également). Ces APIs ouvrent la transcription multilingue en temps réel à des coûts inférieurs aux offres précédentes, sans passer par des pipelines intermédiaires.
ModèleCapacitéMode de facturation
GPT-Realtime-2Voix + raisonnement GPT-5Au token
GPT-Realtime-Translate70 langues sourceÀ la minute
GPT-Realtime-WhisperSpeech-to-text liveÀ la minute
Source : TechCrunch, 7 mai 2026

Mon take de dev solo

La transparence sur la mémoire, c'est ce que je voulais dans tous mes outils depuis deux ans. Voir les sources utilisées pour personnaliser une réponse, c'est le minimum viable pour faire confiance à un système qui "se souvient de toi". La connexion Gmail, non — c'est une surface d'attaque gratuite pour un gain marginal sur les cas d'usage qu'intéresse réellement. GPT-Realtime-Translate à la minute, par contre, ça change quelque chose pour les apps qui visent un marché non-anglophone sans budget NLP dédié.

Anthropic signe avec SpaceX : 220 000 GPU pour lever les rate limits Claude

Le 6 mai 2026, Anthropic a annoncé un accord exclusif avec SpaceXAI pour accéder à Colossus 1, le superordinateur de Memphis Tennessee. 220 000 GPU Nvidia (H100, H200, GB200), 300 mégawatts de puissance. Objectif déclaré de Dario Amodei : lever les rate limits sur Claude Pro, Claude Max et Claude Code dans les prochains mois.
Forbes et NBC News ont tous les deux confirmé les détails techniques. Colossus 1 a été initialement construit pour xAI mais la capacité excédentaire est louée à des tiers depuis début 2026. Anthropic obtient un accès prioritaire, pas exclusif sur l'ensemble du parc, mais la bande passante réservée est suffisante pour absorber un pic de demande significatif sur les modèles Claude.
Colossus 1 : superordinateur de 220 000 GPU Nvidia situé à Memphis, Tennessee, opéré par SpaceXAI. Construit initialement pour les besoins d'entraînement de xAI, il représente l'une des trois plus grandes concentrations de GPU au monde avec les clusters de Google DeepMind et Microsoft Azure AI.
Au developer conference du 6 mai, Dario Amodei a posé la phrase qui circulait encore sur X deux jours plus tard : "This is the first year that we have grown faster than the exponential." En clair : la demande sur Claude a cru plus vite que leur capacité à la provisioner, d'où les limitations qui frustrent les utilisateurs Claude Code depuis des semaines. L'accord avec SpaceXAI est présenté comme la réponse directe à ce bottleneck.
L'accord inclut aussi, selon SpaceNews, une option pour des data centers en orbite basse via des satellites SpaceX. Aucune timeline précise n'a été donnée sur ce volet, qui ressemble à une clause optionnelle plutôt qu'à un engagement opérationnel. Les taux de latence d'un cluster orbital pour de l'inférence LLM ne sont pas documentés — et pour cause.
Sur les réseaux sociaux, l'annonce a déclenché un débat assez prévisible sur r/MachineLearning : Anthropic, qui se positionne sur la sécurité et l'alignement IA, qui signe avec l'infrastructure d'Elon Musk pendant que Musk attaque OpenAI en justice pour manquement à la mission nonprofit. Les deux positions existent en même temps, et le compute a clairement gagné sur la cohérence de marque.
J'avais détaillé les capacités offensives de Mythos, le modèle cybersécurité d'Anthropic, il y a deux semaines. Cet accord de compute change l'équation : si les rate limits sautent sur Claude Code, Anthropic reprend l'avantage terrain sur les devs solos qui avaient basculé sur Cursor + GPT-5 par frustration.

Mon take de dev solo

Anthropic signe avec l'infra d'Elon Musk pendant que Musk attaque OpenAI en justice pour trahison de mission. La realpolitik du compute est plus forte que n'importe quel positionnement éthique — et c'est une information utile pour calibrer ce que valent les discours "safety-first". Sur le plan pratique : si les rate limits de Claude Code sautent dans les prochains mois, je le sens directement sur mes sessions de dev. C'est la seule chose qui compte pour mes flux de travail actuels.

Codex sur Chrome : DevTools, contexte multi-onglets, fusion annoncée avec ChatGPT

Le 7 mai 2026, OpenAI a lancé Codex comme plugin Chrome donnant accès aux DevTools du navigateur, au contexte des onglets ouverts et à la capacité de tester des apps web directement dans le navigateur. OpenAI a annoncé dans la foulée la fusion à venir de Codex, ChatGPT et de son navigateur Atlas en un seul produit.
Engadget a couvert le lancement en détail : le plugin s'installe sur Chrome stable, accède aux DevTools (console, network, elements), capte le contexte des onglets actifs pour contextualiser les requêtes, et peut exécuter des tests basiques sur des apps web ouvertes dans le navigateur. L'intégration DevTools change quelque chose : jusqu'ici, pour obtenir du contexte de navigateur dans un workflow LLM, il fallait copier-coller manuellement des stack traces ou des logs réseau.
Codex Chrome : plugin OpenAI pour Chrome qui connecte un assistant LLM directement aux DevTools du navigateur (console, network, elements), au contexte des onglets ouverts et aux apps web en cours de test. Premier accès natif d'un LLM grand public aux outils de debug front-end sans copier-coller manuel.
La fusion annoncée Codex + ChatGPT + Atlas est présentée comme une convergence progressive, sans date précise. Atlas est le navigateur IA d'OpenAI annoncé en mars, pas encore en beta publique large. L'idée : un seul environnement où le modèle voit ce que tu vois dans le navigateur, peut interagir avec les pages, et dispose du contexte de développement complet. C'est le schéma de Claude Computer Use, mais intégré nativement dans Chrome plutôt que via une VM.
Sur l'architecture agents en général, j'avais analysé les patterns d'orchestration il y a quelques semaines — la fusion Codex/Atlas correspond exactement au pattern "agent à fenêtre d'observation large" qui émerge comme standard.
Les 70 langues de GPT-Realtime-Translate (annoncé le même jour) complètent ce tableau : OpenAI construit une stack complète où le modèle comprend le navigateur, le code, et la voix simultanément. La question que ça pose aux outils comme Cursor ou Cline, c'est jusqu'où ils peuvent rester pertinents face à un éditeur + navigateur + voix natif.
ComposantStatutAccès
Codex ChromeDisponible, Chrome stableExtension Chrome Web Store
ChatGPTDisponibleWeb, iOS, Android
Atlas (navigateur)Beta limitéeListe d'attente
Fusion des troisAnnoncée, sans date

Mon take de dev solo

Je teste Codex Chrome ce week-end sur Waku. L'accès aux DevTools directement depuis le plugin, sans copier-coller les stack traces dans une fenêtre séparée, c'est le friction point que j'ai rencontré le plus souvent sur les sessions de debug front-end. Si ça fonctionne proprement sur des apps Next.js, c'est un vrai changement de workflow. La fusion avec Atlas par contre : trois produits séparés qui "fusionneront un jour" dans une roadmap sans date, j'attends de voir.

Smartphone OpenAI en automne 2027 : OS propriétaire, dual-NPU, 30 millions d'unités

Selon l'analyste Ming-Chi Kuo dans un rapport du 5 mai 2026 repris par The Verge, OpenAI a fast-tracké la production de son smartphone pour un lancement en automne 2027. Le dispositif tourne sur un OS propriétaire, embarque un chipset MediaTek Dimensity 9600 customisé avec dual-NPU pour l'inférence locale, et 30 millions d'unités sont ciblées sur 2027-2028.
The Verge a publié les détails du rapport Kuo : production de masse programmée pour H1 2027, lancement commercial automne 2027. Le chipset MediaTek Dimensity 9600 a été customisé spécifiquement pour OpenAI avec un dual-NPU conçu pour faire tourner des modèles d'inférence en local sans passer par le cloud pour les tâches courantes. L'OS est qualifié de "propriétaire" — ce qui peut couvrir un fork Android dur ou un système complètement indépendant, les détails n'ont pas été confirmés.
Dual-NPU : configuration de deux Neural Processing Units dans un même chipset, permettant d'exécuter deux modèles d'inférence en parallèle ou de dédier un NPU au traitement vocal en continu pendant que l'autre gère les tâches d'assistant. Privilégiée pour les appareils IA qui veulent maintenir une latence faible sans connexion réseau.
30 millions d'unités sur deux ans (2027-2028), c'est le chiffre qui a le plus circulé sur X dans les 48 heures après la publication. Pour comparaison : Samsung Galaxy S25 a vendu environ 12 millions d'unités au premier trimestre 2026 selon Counterpoint Research. Atteindre 30 millions en deux ans sans réseau retail établi, sans écosystème d'apps tiers mature, et en convertissant des utilisateurs à un nouvel OS représente une ambition que les analystes hardware ont qualifié de "narratif IPO" sur r/technology.
La vraie question que personne ne pose encore : qui est le distributeur ? Apple a l'App Store, Google a le Play Store et des milliers de revendeurs partenaires. OpenAI n'a ni l'un ni l'autre. Un deal avec Amazon ou Best Retail resolverait la distribution physique aux USA, mais l'Europe, l'Asie, le Japon restent des marchés où la présence retail locale est non-négociable pour un lancement hardware.

Mon take de dev solo

30 millions d'unités en deux ans sans écosystème d'apps ni réseau retail, c'est du narrative IPO avant d'être une stratégie produit. Je ne dis pas que le smartphone n'arrivera pas — Kuo a un track record solide sur Apple, moins sur le reste. Je dis que les chiffres annoncés supposent une courbe d'adoption que même des acteurs avec 20 ans d'infra distribution n'ont pas atteinte aussi vite. Ce qui m'intéresse davantage : le dual-NPU pour inférence locale. Si ça marche proprement à 30ms de latence, ça change ce qu'on peut faire dans une app mobile sans cloud.

Greg Brockman : 30 milliards de fortune révélés sous serment, zéro investi

Le 4 mai 2026, Greg Brockman, cofondateur d'OpenAI, a témoigné au procès Musk v. OpenAI au tribunal d'Oakland. Sous serment, il a révélé détenir entre 2,5 et 3 % d'OpenAI, obtenu via compensation lors de la transition nonprofit-forprofit, pour une valeur estimée à environ 30 milliards de dollars sur la valorisation actuelle de 852 milliards — sans avoir investi un centime en direct.
Washington Post et Reuters ont tous les deux couvert le témoignage en détail. C'est la première fois que ces chiffres sortent dans un contexte légal, avec obligation de vérité. Brockman a précisé que son equity avait été construit progressivement à travers des packages de compensation en équivalent-actions lors de la restructuration qui a transformé OpenAI d'organisation à but non lucratif en entité commerciale — une structure hybride toujours au cœur du procès Musk.
Le 7 mai, un ex-membre du board d'OpenAI a témoigné via vidéo préenregistrée qu'Altman "alimentait une culture toxique du mensonge" au sein de l'organisation. Selon Bloomberg, ce témoignage vise à établir que l'éviction d'Altman en novembre 2023 n'était pas arbitraire mais motivée par des comportements documentés. Le procès reprend la semaine prochaine avec Sam Altman lui-même à la barre.
Transition nonprofit-forprofit d'OpenAI : restructuration en cours depuis 2023 qui convertit OpenAI d'une organisation à but non lucratif supervisée par un board en une société commerciale classique (Public Benefit Corporation). La légalité de cette conversion, et notamment la manière dont les assets ont été valorisés lors du transfert, est au cœur du procès initié par Elon Musk.
La chronologie du procès :
DateÉvénement
4 mai 2026Témoignage Brockman : 30 Md$ révélés, 0 investissement direct
7 mai 2026Témoignage vidéo ex-board : "culture toxique du mensonge" (Altman)
Semaine du 11 maiSam Altman à la barre
Source : Bloomberg, Washington Post, Reuters
Sur X, le chiffre des 30 milliards sans investissement direct a été l'actu la plus relayée de la semaine dans les cercles tech. Beaucoup de gens qui avaient suivi le départ-retour d'Altman en novembre 2023 sans comprendre les enjeux financiers ont eu leur réponse.

Mon take de dev solo

30 milliards construits sur la transformation d'une association caritative en société commerciale. Ça ne change pas la qualité de GPT-5.5 Instant ni les rate limits de Claude Code — les outils restent ce qu'ils sont. Ça change ce que "développer l'IA pour le bénéfice de l'humanité" veut dire quand on lit les petites lignes du prospectus. Le procès qui donne l'accès public à ces chiffres est probablement plus utile pour comprendre l'industrie que la plupart des conférences IA de l'année.
ActuCe qui s'est passéPourquoi c'est important
GPT-5.5-Cyber "Spud"Accès limité aux cyber-défenseurs vérifiés pour bug-finding et reverse engineeringRival direct de Mythos d'Anthropic, capacités quasi-équivalentes revendiquées
Anthropic Managed AgentsBeta publique : dreaming, outcomes, orchestration multi-agentsLes agents Claude s'auto-améliorent entre sessions — à surveiller sur les pipelines longs
Google Gemma 4Speculative decoding, génération jusqu'à 3x plus rapideOpen-source viable sur hardware grand public, option réelle pour l'inférence locale
The Deployment Company10 Md$ avec TPG, Brookfield, Bain pour déployer des engineers OpenAI chez les clients enterpriseStandardisation rapide de l'enterprise sur les APIs OpenAI, viral sur r/programming
White House review IARevue pré-publication des modèles envisagée selon ForbesPremier mouvement sérieux vers une régulation pré-release aux USA

Ce que la semaine du 8 mai change pour les développeurs indépendants

GPT-5.5 Instant est déjà en prod, tu n'as rien à faire

Si tu utilises chat-latest ou la session ChatGPT web standard, tu es déjà sur GPT-5.5 Instant depuis le 5 mai. La réduction des hallucinations sur les domaines sensibles est réelle sur les benchmarks — ce que ça donne sur des prompts de code en contexte réel, quelques jours de tests permettront de trancher.

Les rate limits Claude pourraient sauter dans les prochains mois

L'accord SpaceXAI est présenté comme une réponse directe au bottleneck compute qui plafonne les utilisateurs Claude Pro, Max et Claude Code. Si l'objectif annoncé se concrétise, les sessions de dev longues qui se coupent sur les limites de context deviendront moins fréquentes. Ce n'est pas encore fait — mais c'est la première fois qu'Anthropic annonce publiquement avoir sécurisé l'infrastructure nécessaire pour absorber la demande.

Codex Chrome change le debug front-end, mais Atlas reste flou

L'accès DevTools depuis un plugin Chrome est une friction réduite sur les workflows de debug front-end. La fusion Codex + ChatGPT + Atlas annoncée en parallèle est du messaging produit sans date — utile pour signaler une direction, pas pour planifier un workflow.

Le smartphone OpenAI est à 18 mois, pas pour les devs solos maintenant

Aucun SDK, aucune doc développeur, pas d'écosystème. La cible de 30 millions d'unités 2027-2028 est un pari hardware qui prendra du temps à se confirmer ou s'effondrer. À surveiller fin 2026 : comment OpenAI gère la distribution et si un programme développeur se dessine.

Le procès Musk v. OpenAI va sortir des chiffres utiles pendant encore plusieurs semaines

Chaque témoignage apporte des informations sur la valorisation d'OpenAI, les structures d'equity et les décisions internes que les communications de la compagnie n'auraient jamais publiées volontairement. Altman à la barre la semaine prochaine.

FAQ

GPT-5.5 Instant remplace-t-il GPT-5.3 Instant pour tous les utilisateurs de l'API ? L'endpoint chat-latest bascule automatiquement sur GPT-5.5 Instant depuis le 5 mai 2026. Les développeurs qui ont explicitement épinglé gpt-5.3-instant dans leurs requêtes conservent l'ancien modèle pendant encore trois mois. OpenAI recommande la migration progressive pour les apps en production, notamment pour les domaines sensibles où la réduction des hallucinations est la plus marquée (droit, médecine, finance).
Qu'est-ce que l'accord Anthropic-SpaceX change concrètement pour les utilisateurs Claude Code ? L'objectif déclaré est de lever les rate limits sur Claude Pro, Max et Claude Code. Anthropic n'a pas publié de timeline précise. En pratique, les développeurs qui atteignent régulièrement les limites de contexte sur des sessions longues devraient voir ces limites repoussées dans les prochains mois — si l'onboarding du compute Colossus 1 se passe sans accroc. Aucune garantie n'a été donnée sur les délais.
Le plugin Codex Chrome fonctionne-t-il sur d'autres navigateurs que Chrome ? Au lancement du 7 mai, le plugin est disponible exclusivement sur Chrome stable via le Chrome Web Store. Il n'y a pas d'extension Firefox, Edge ou Safari annoncée. La fusion à venir avec Atlas (le navigateur propriétaire d'OpenAI) suggère que l'intégration profonde avec DevTools sera prioritairement développée sur Chrome et Atlas plutôt que sur les navigateurs tiers.
Le smartphone OpenAI sera-t-il compatible avec les apps Android existantes ? Les informations disponibles n'ont pas confirmé la compatibilité avec l'écosystème Android. L'OS est qualifié de "propriétaire", ce qui laisse deux possibilités : un fork Android dur avec accès partiel au Play Store, ou un système indépendant qui repart de zéro. La deuxième option impliquerait de convaincre les développeurs de porter leurs apps, ce qui rendrait l'objectif de 30 millions d'unités encore plus difficile à atteindre sans partenariats majeurs.
Greg Brockman a-t-il toujours un rôle actif chez OpenAI ? Brockman a pris un congé sabbatique d'OpenAI en septembre 2024 après les événements du board de novembre 2023. Son rôle opérationnel est suspendu mais son equity reste intact. Les révélations du procès (2,5-3 % de la compagnie, zéro investissement direct) portent sur sa situation patrimoniale, pas sur un retour annoncé à la compagnie.
Semaine dense, avec une cohérence de surface chez OpenAI (modèle, voix, navigateur, hardware, legal) et une Anthropic qui résout son problème d'infrastructure avec le partenaire le moins prévisible de l'industrie. La compétition entre les deux se joue maintenant sur le compute disponible autant que sur la qualité des modèles.
Deux dates à mettre dans le calendrier : Google I/O le 20 mai (probable réponse de Google sur les outils dev IA), et le témoignage de Sam Altman au procès la semaine prochaine. Le second est probablement plus instructif sur l'état réel de l'industrie que le premier.
Alex

À retenir

  • GPT-5.5 Instant : -52,5% hallucinations, memory sources transparentes, nouveau défaut ChatGPT et API chat-latest depuis le 5 mai
  • Anthropic signe avec SpaceXAI : Colossus 1 Memphis, 220 000+ GPU, 300 MW — objectif lever les rate limits Claude
  • Codex plugin Chrome : accès DevTools + contexte onglets + test web app dans le navigateur, lancé le 7 mai
  • GPT Realtime API : GPT-Realtime-2, Translate (70 langues) et Whisper (speech-to-text live), facturation au token ou à la minute
  • Smartphone OpenAI : Dimensity 9600 dual-NPU, OS propriétaire, production H1 2027, 30M unités ciblées 2027-2028
  • Greg Brockman : 30 Md$ révélés sous serment au procès Musk, 2,5-3% OpenAI sans investissement direct

Commentaires

Commentaires

Tu as un avis sur cet article ?

Crée un compte gratuit en 10 secondes pour commenter, laisser des likes et recevoir les prochains articles directement dans ta boîte mail.

Pas encore de compte ?

Ce site utilise des cookies pour les statistiques de visite et la publicité. Aucune donnée personnelle n'est revendue. En savoir plus