L'actu IA du 3 juillet 2026 : Fable 5 revient muselé, Sonnet 5 débarque, Alibaba pris en flagrant délit
Alexandre
··
Durée de lecture : 10 min
Cliquer pour agrandir
Fable 5 est de retour. 18 jours après sa suspension par le département du Commerce américain, Anthropic a remis son modèle phare en ligne le 1er juillet. Sauf que le Fable 5 qui revient n'est pas celui qui est parti : filtres de sécurité renforcés, quota plafonné à 50% de l'usage hebdomadaire, et passage au crédit à la consommation dès le 7 juillet (Anthropic).
Côté nouveautés, Anthropic lance Sonnet 5 le même jour, un modèle agentique facturé 2 dollars par million de tokens en entrée (tarif promotionnel jusqu'au 31 août). Apple annonce des hausses de prix allant jusqu'à 50% sur ses Mac et iPad, la mémoire ayant quadruplé de prix à cause des datacenters IA. Et Alibaba est accusé d'avoir utilisé 25 000 faux comptes et 28,8 millions d'échanges pour aspirer les capacités de Claude.
Décryptage.
Sonnet 5 : Anthropic lance son modèle agentique à prix cassé
Anthropic déploie Claude Sonnet 5 le 2 juillet, un modèle conçu pour les workflows multi-étapes autonomes, avec des performances proches d'Opus 4.8 en raisonnement et en code. Tarif d'introduction : 2 dollars par million de tokens en entrée et 10 dollars en sortie, jusqu'au 31 août. Après cette date, les prix montent à 3 et 15 dollars respectivement, selon 9to5Mac.
Sonnet 5 ne remplace pas Opus 4.8 ou Fable 5 en puissance brute. Son créneau, c'est l'exécution agentique (la capacité pour un modèle de planifier, utiliser des outils comme un navigateur ou un terminal, et enchaîner des tâches sans intervention humaine). Anthropic le positionne comme le modèle par défaut pour les tiers gratuit et Pro de Claude, ce qui en fait le premier point de contact pour la majorité des utilisateurs.
Les premiers retours enterprise sont positifs. VentureBeat rapporte que des partenaires constatent que Sonnet 5 "termine des tâches que les modèles précédents abandonnaient en cours de route". Le modèle est disponible sur Amazon Bedrock et Google Cloud, avec un gateway Claude Code self-hosted qui permet aux entreprises de l'utiliser dans leur propre infrastructure cloud.
Le timing n'est pas anodin. Anthropic lance Sonnet 5 au moment exact où Fable 5 passe en pay-to-play. C'est une stratégie produit limpide : offrir une alternative abordable pour ceux qui ne veulent pas payer le prix fort. Selon moi, pour 80% des cas d'usage en développement (génération de code, refactoring, tests), Sonnet 5 à 2 dollars par million de tokens peut suffire. C'est le ratio performance/coût qui compte, pas la puissance brute. Sur Waku et mes autres projets, je passe la majorité de mon temps sur des tâches agentiques répétitives, pas sur du raisonnement frontière. Sonnet 5 est taillé pour ça.
Attention au piège du tokenizer (le composant qui découpe le texte en unités de traitement). Un utilisateur de la chaîne BridgeMind a relevé que le nouveau tokenizer de Sonnet 5 traite environ 1,35 fois plus de tokens que les versions précédentes. Résultat : le coût par tâche peut être supérieur à celui d'Opus 4.8, malgré un prix unitaire plus bas. Le tarif affiché ne dit pas tout, il faut mesurer en coût réel par workflow complet.
Et pendant qu'Anthropic ajuste sa grille tarifaire, un autre acteur révise ses prix... mais pas à la baisse.
Cliquer pour agrandir
Apple augmente ses prix de 50% : les datacenters IA aspirent toute la mémoire
Apple annonce le 25 juin des hausses de prix sur l'ensemble de ses Mac, iPad, Apple TV, HomePod et Vision Pro, avec des augmentations dépassant 50% sur certains modèles. La cause : le coût de la mémoire vive (DRAM) a quadruplé et celui du stockage (NAND) a presque doublé, selon MacRumors. Tim Cook qualifie la situation de "crue centennale" et les hausses d'"inévitables".
La mémoire est aspirée par un client dont Apple ne s'était jamais soucié jusqu'ici : les datacenters d'intelligence artificielle. La demande de DRAM et de NAND pour entraîner et servir les modèles IA a fait exploser les prix sur le marché mondial. Business Insider note que la part du coût de la mémoire dans un iPhone phare pourrait passer de 10% à 45% d'ici 2027. Gartner prévoit une hausse de 130% des prix combinés mémoire et stockage d'ici fin 2026, entraînant une hausse de 17% des prix des PC et de 13% des smartphones par rapport à 2025.
Tim Cook a déclaré au Wall Street Journal que la situation était "insoutenable". Moneywise rapporte que Micron (le fabricant de puces mémoire) a répondu en suggérant qu'Apple avait elle-même contribué à créer la pénurie. Seuls les iPhone et Apple Watch sont épargnés pour l'instant, mais les iPhone 18 coûteront plus cher en septembre.
Perso, c'est le genre de conséquence de second ordre de la course à l'IA que personne ne voit venir. Les GPU consomment de la mémoire, les datacenters en achètent des quantités industrielles, et le reste de l'industrie électronique se retrouve à payer le prix. Pour un dev indie qui investit dans du matériel Apple pour construire des apps iOS, la facture monte. 9to5Mac titre carrément "Quand les prix Apple vont-ils rebaisser ? Peut-être jamais." Les prévisions tablent sur une amélioration marginale vers 2028, si tant est que la demande IA ne continue pas d'accélérer. L'IA fait monter le prix du hardware, et le hardware fait monter le prix de l'accès à l'IA. Cercle vicieux.
Fable 5 revient après 18 jours de ban, mais les utilisateurs crient au "nerf"
Claude Fable 5 est officiellement de retour depuis le 1er juillet, après que le département du Commerce américain a levé les contrôles à l'exportation imposés le 12 juin. Anthropic rétablit l'accès mondial, mais avec un quota plafonné à 50% de l'usage hebdomadaire et un passage au crédit à la consommation (environ 10 dollars par million de tokens en entrée, 50 dollars en sortie) dès le 7 juillet, selon le communiqué officiel d'Anthropic.
Rappel des faits. Le 12 juin, Washington suspend Fable 5 et Mythos 5 après la découverte qu'un jailbreak (une technique qui contourne les garde-fous d'un modèle IA) avait permis à Mythos de trouver des vulnérabilités dans des systèmes classifiés de la NSA. J'avais couvert le shutdown initial dans un article dédié. Anthropic coupe l'accès à tous les utilisateurs dans le monde parce qu'il ne peut pas vérifier la nationalité des utilisateurs en temps réel. 18 jours de blackout total.
Pour plaider le retour du modèle, Anthropic aurait remplacé son PDG Dario Amodei par le cofondateur Tom Brown comme principal interlocuteur auprès de l'administration Trump. Jugé "plus facile" dans les négociations, Brown serait désormais au centre des discussions, qui portent sur l'élaboration d'un cadre commun d'évaluation des incidents de jailbreak, selon France 24. The Hacker News confirme que la levée des contrôles est directement liée à ces négociations.
Le problème, c'est ce qui revient. BleepingComputer rapporte que les utilisateurs trouvent un modèle sensiblement affaibli. Beaucoup de requêtes sont routées vers Opus 4.8 au lieu de Fable 5, et les filtres de sécurité bloquent des demandes de code parfaitement légitimes. Anthropic affirme que le modèle lui-même n'a pas été dégradé : c'est l'ajout de guardrails (des filtres de sécurité supplémentaires) plus stricts qui crée cette impression. Le nouveau classifieur de sécurité bloque le jailbreak Amazon dans plus de 99% des cas. Mais il bloque aussi des choses qu'il ne devrait pas bloquer.
Franchement, le retour de Fable 5 ressemble à un compromis politique plus qu'à un vrai rétablissement. Le modèle revient bridé, passe en payant dans quelques jours, et personne ne sait vraiment si les performances d'origine vont être restaurées un jour. Pour moi qui utilise Claude Code au quotidien sur Waku, la question est simple : est-ce que le Fable 5 d'après le ban vaut le surcoût par rapport à Sonnet 5 ou Opus 4.8 ? Pour l'instant, la réponse n'est pas évidente. Anthropic a indiqué que Fable 5 reviendrait dans les abonnements "quand la capacité le permettra" (BleepingComputer). En attendant, il faut composer avec un modèle muselé ou se rabattre sur Sonnet 5.
Alibaba a utilisé 25 000 faux comptes pour aspirer Claude : la guerre froide IA explose
Anthropic accuse Alibaba d'avoir mené une attaque de distillation massive contre Claude, utilisant 25 000 faux comptes et 28,8 millions d'échanges pour extraire les capacités du modèle et entraîner ses propres systèmes IA. La distillation, c'est une technique qui permet de transférer les compétences d'un gros modèle vers un plus petit, en le faisant répondre à des millions de requêtes calibrées pour capturer son savoir. L'accusation a été rapportée par Gizmodo et Business Insider.
Alibaba n'est pas le premier lab chinois sur la liste. Anthropic a déjà accusé DeepSeek, Moonshot et MiniMax d'avoir utilisé Claude pour entraîner leurs propres modèles. Mais l'ampleur de l'opération Alibaba est d'un autre ordre : 25 000 comptes créés sous de fausses identités, 28,8 millions de conversations, une opération industrielle de vol de propriété intellectuelle, rapporte Tom's Hardware. C'est du pillage organisé, pas de l'expérimentation.
La Maison-Blanche a promis de sévir contre les campagnes coordonnées qui extraient systématiquement les capacités des modèles américains. Washington considère désormais que les modèles frontière sont des actifs stratégiques, au même titre que les puces Nvidia soumises aux restrictions d'export. Gizmodo titre "La guerre froide IA vient de se refroidir encore". Le contexte se durcit : dans la même semaine, le chinois Z.ai lance GLM 5.2, un modèle qui revendique des performances équivalentes à Mythos en cybersécurité, un jour après le ban américain (Euronews).
L'asymétrie est flagrante. Anthropic se fait suspendre son propre modèle pendant 18 jours pour une faille de sécurité. Des labs chinois pillent ce même modèle à grande échelle, et la seule conséquence c'est un communiqué. Anthropic subit les conséquences de ses propres vulnérabilités, deux fois : une fois par le jailbreak, une fois par la distillation.
Selon moi, cette affaire va accélérer deux choses. D'abord, des systèmes de détection de distillation beaucoup plus agressifs (Anthropic travaille déjà dessus depuis les accusations contre DeepSeek). Ensuite, une pression politique pour traiter le vol de modèles IA comme du piratage industriel classique. Le problème c'est que la distillation se situe dans une zone grise juridique : faire appel à une API publique des millions de fois, c'est techniquement légal dans beaucoup de juridictions. C'est le volume et l'intention qui font la différence. L'IA a besoin d'un cadre juridique, et cette affaire pourrait être le catalyseur. Et Washington ne se contente pas de réagir à la Chine. Du côté américain aussi, la Maison-Blanche resserre le contrôle.
Cliquer pour agrandir
GPT-5.6 Sol : Washington retient le modèle d'OpenAI avant la sortie publique
OpenAI a repoussé le lancement public de GPT-5.6 Sol à la demande de l'administration Trump. Le modèle existe, les prix sont publiés (5 dollars par million de tokens en entrée, 30 dollars en sortie, soit la moitié de Fable 5), mais un décret présidentiel exige une revue de sécurité nationale pouvant durer jusqu'à 30 jours avant toute mise à disposition large, selon SecurityWeek.
Sol introduit deux nouveaux modes : "max" pour le raisonnement approfondi et "ultra" qui déploie des sous-agents coordonnés pour les tâches complexes. OpenAI le positionne comme supérieur à Mythos sur GeneBench, Terminal-Bench et ExploitBench, avec environ un tiers de tokens consommés en moins. Seule une vingtaine d'entreprises approuvées par Washington y ont accès dans le cadre d'un "limited preview" dont la composition est partagée avec le gouvernement (Time).
Sam Altman a accepté la limitation sans résistance publique. OpenAI a déclaré se "conformer à la demande du gouvernement à titre exceptionnel", tout en précisant que "les restrictions ne devraient pas devenir la norme" (Axios). David Sacks, le "czar IA" de la Maison-Blanche, a défendu ces mesures en invoquant la sécurité nationale, provoquant une fracture dans le mouvement pro-IA qui accuse l'administration de freiner l'innovation américaine.
A mon sens, le parallèle avec Fable 5 est limpide. Deux modèles frontière, deux entreprises différentes, le même résultat : Washington contrôle qui peut utiliser quoi, et quand. La sortie de modèles IA n'est plus une décision technique ou commerciale, c'est un processus politique. Pour moi qui travaille avec Claude Code sur Waku et qui dépends de ces modèles au quotidien (j'en parle ici), c'est une réalité à intégrer. OpenAI repousse d'ailleurs son IPO à 2027, probablement parce que valoriser une entreprise dont les produits peuvent être gelés par directive gouvernementale complique sérieusement l'exercice (Forbes).
Autres actus en vrac
Godot bannit le code IA autonome : la Godot Foundation interdit toute contribution impliquant des agents IA autonomes ou du "vibe coding" (coder en laissant l'IA générer sans supervision). Seule l'assistance IA avec relecture humaine reste autorisée, après une vague de pull requests qualifiées de "démoralisantes" par les mainteneurs. (GamesIndustry.biz)
Together AI lève 800 millions de dollars : le neocloud (une plateforme cloud spécialisée dans l'infrastructure IA) boucle un Series C qui porte sa valorisation à 8,3 milliards. C'est l'infrastructure qui attire les capitaux, pas les applications. (TechCrunch)
Anthropic dépose son dossier d'IPO : entrée en bourse visée en octobre 2026, après un Series H-1 qui valorise l'entreprise à 965 milliards de dollars. OpenAI, de son côté, repousse son IPO à 2027. (Forbes)
Le Japon veut 10 millions de robots IA d'ici 2040 : face au déclin démographique, le gouvernement japonais dévoile un plan national pour déployer des robots pilotés par IA dans tous les secteurs de l'économie. (RaillyNews)
Z.ai (Chine) lance GLM 5.2 : le modèle chinois revendique des performances équivalentes à Mythos en cybersécurité, lancé le lendemain du ban américain sur Fable 5. Le timing ne doit rien au hasard. (The Verge)
Conclusion : une semaine de compromis et de lignes rouges
Cette semaine résume bien la période actuelle. Fable 5 revient, mais compromis. Sonnet 5 arrive, mais à des conditions qui vont évoluer. Apple augmente ses prix, et l'IA en est la cause indirecte. Alibaba aspire les modèles américains pendant que Washington essaie de les contrôler. Godot trace une ligne entre l'IA outil et l'IA auteur.
Le point commun : les compromis se multiplient. Entre performance et sécurité (Fable 5). Entre coût et capacité (Sonnet 5). Entre ouverture et protection (distillation Alibaba). Entre productivité et qualité (Godot). Chaque acteur négocie sa ligne rouge, et ces lignes rouges dessinent petit à petit les contours de ce que sera l'industrie IA dans un an.
Et toi, tu utilises déjà Sonnet 5 ou tu attends de voir ce que donne Fable 5 après le 7 juillet ? Dis-le moi sur X, LinkedIn ou en commentaire.
Alex
À retenir
Fable 5 revient après 18 jours de ban, muselé et bientôt payant
Sonnet 5 à 2$/M tokens, bon ratio pour les workflows agentiques
Alibaba a piraté Claude avec 25 000 faux comptes et 28,8 millions d'échanges
Apple augmente ses prix de 50%, la mémoire aspirée par les datacenters IA
GPT-5.6 Sol retardé par décret, la sortie de modèles IA est devenue un acte politique