L'actu IA du 29 août 2026 : Nvidia rachète Hugging Face pour 12,9 milliards, DeepSeek vise 74 milliards, Apple lance Core AI
Alexandre
··
Durée de lecture : 11 min
Cliquer pour agrandir
Crédit : SiliconANGLE
Nvidia s'apprête à racheter Hugging Face pour 12,9 milliards de dollars. L'information a été révélée par The Information le 26 août, puis confirmée par TechCrunch, Fortune et CNBC. Aucune des deux entreprises n'a signé publiquement, mais le deal valorise la plateforme open-source à environ 86 fois son chiffre d'affaires annuel.
DeepSeek, le challenger chinois, boucle une levée de 7,4 milliards de dollars à 74 milliards de valorisation, avec une introduction en bourse prévue à Shanghai en 2027. Apple sort le Mac Studio M5 Ultra avec 512 Go de RAM unifiée et un nouveau framework, Core AI, pour faire tourner des modèles frontier en local. Anthropic déploie Claude dans Chrome pour tous les abonnés payants, intègre un navigateur natif dans Cowork, et lance Claudeforce avec Salesforce.
Décryptage.
Anthropic partout : Claude dans Chrome, navigateur intégré, Claudeforce avec Salesforce
Cliquer pour agrandir
Crédit : The Decoder / Anthropic
Anthropic a rendu Claude in Chrome disponible pour tous les abonnés payants le 26 août 2026, en passant de la bêta à la disponibilité générale. L'extension permet à Claude d'agir de manière autonome dans le navigateur, avec un classificateur de sécurité qui vérifie chaque action par rapport aux instructions de l'utilisateur. En parallèle, Anthropic a ajouté un navigateur Chromium intégré à l'application de bureau Claude Cowork (Gigazine, The New Stack).
Un navigateur qui appartient à Claude
Le navigateur intégré dans Cowork s'ouvre automatiquement dans un panneau latéral quand Claude détermine qu'une tâche nécessite un accès web. Il peut naviguer entre les pages, cliquer sur des boutons, remplir des formulaires, le tout sans accéder au navigateur personnel de l'utilisateur. L'extension Chrome reste utile pour les cas où l'utilisateur veut que Claude intervienne directement sur une page déjà ouverte (mettre à jour un CRM, éditer un document en ligne), mais le navigateur natif devient l'option par défaut pour les tâches de recherche et d'action sur le web.
Ce navigateur est disponible pour les abonnés Pro, Max, Team et Enterprise. Le détail qui compte : Anthropic construit sa propre couche d'accès web au lieu de dépendre de Google Chrome, ce qui réduit la dépendance technique à l'écosystème Google (The Decoder).
Claudeforce : Claude entre dans Salesforce
Côté entreprise, Salesforce a annoncé "Claudeforce" lors de ses résultats trimestriels du 27 août, une intégration qui embarque Claude directement dans la plateforme CRM avec 37 skills de vente préconstruits. Le produit est déjà accessible à des clients pilotes, et la bêta ouverte est prévue pour septembre 2026. Salesforce, qui détient une participation au capital d'Anthropic, a battu ses prévisions avec un bénéfice ajusté de 2,53 dollars par action et relevé ses objectifs annuels de chiffre d'affaires. L'action a bondi de 14% en after-hours (The Star).
Pour contexte, le chiffre d'affaires annualisé d'Anthropic (le run-rate, c'est-à-dire le revenu projeté sur 12 mois à partir du rythme actuel) a atteint 65 milliards de dollars fin juillet 2026, soit environ 25 milliards d'avance sur OpenAI (Yellow.com). L'écosystème Claude ne cesse de s'étendre, du navigateur au CRM en passant par les outils de développement (présentation complète de Claude Code).
Pendant qu'Anthropic étend son empreinte logicielle, Apple fait un pari différent : ramener la puissance de calcul IA en local.
Cliquer pour agrandir
Crédit : Apple
Apple Mac Studio M5 Ultra : 512 Go de RAM unifiée pour faire tourner des LLM en local
Apple a dévoilé le Mac Studio avec la puce M5 Ultra le 25 août 2026, avec jusqu'à 512 Go de mémoire unifiée, un GPU 80 coeurs et un débit mémoire de 1,2 To/s. La puce délivre 4,3 fois les performances IA de pointe du M3 Ultra et 9,8 fois celles du M1 Ultra, permettant de faire tourner des modèles de langage de grande taille en local sans envoyer de données dans le cloud. Les précommandes ont ouvert le 27 août, avec une disponibilité générale le 22 septembre. Prix de départ : 5 499 dollars (Apple Newsroom).
Core AI : un nouveau framework pour l'IA sur Apple Silicon
Le lancement matériel s'accompagne de Core AI, un framework unifié (une API unique pour construire, entraîner et déployer des modèles IA sur l'ensemble des composants Apple Silicon : CPU, GPU et Neural Engine). Core AI fonctionne en tandem avec MLX, la bibliothèque open-source d'Apple pour l'inférence et le fine-tuning de modèles sur Mac.
Les premiers benchmarks indépendants montrent qu'un modèle de 70 milliards de paramètres en quantisation 4-bit tourne à 42-52 tokens par seconde via MLX sur le M5 Ultra (TechTimes). C'est comparable aux performances des API cloud comme GPT-4o, sauf que tout tourne en local, sans aucune donnée envoyée à l'extérieur.
Clustering Thunderbolt 5 : mutualiser la RAM entre plusieurs machines
Le Mac Studio M5 Ultra supporte le clustering via Thunderbolt 5 et RDMA (Remote Direct Memory Access, un protocole qui permet à deux machines de partager leur mémoire sans passer par le CPU). En connectant plusieurs Mac Studio, il est possible de créer un pool de mémoire partagé qui accélère l'inférence distribuée d'un facteur 3 selon Apple. Pour les chercheurs et les développeurs IA qui travaillent sur des modèles trop gros pour une seule machine, c'est une alternative concrète aux clusters GPU cloud.
512 Go de RAM unifiée dans un Mac Studio. Un modèle de 70 milliards de paramètres qui tourne en local à plus de 40 tokens par seconde. Apple ne se contente plus de vendre du matériel, l'entreprise construit l'infrastructure pour que l'IA tourne sur le bureau.
Côté financement, l'argent ne coule pas uniquement dans le hardware. En Chine, un challenger prépare un coup de force.
DeepSeek vise 74 milliards de dollars de valorisation : le challenger chinois lève 7,4 milliards avant son IPO
DeepSeek, la startup IA basée à Hangzhou, finalise une levée de fonds de 50 milliards de yuans (7,4 milliards de dollars) qui valoriserait l'entreprise à 500 milliards de yuans, soit environ 74 milliards de dollars. Le revenu sur les sept premiers mois de 2026 atteint 475 millions de yuans (70,7 millions de dollars), soit dix fois le total de l'année 2025 complète. L'information a été rapportée par le Wall Street Journal et confirmée par Fortune et Breaking The News (WSJ, Fortune).
Des investisseurs chinois de poids
Parmi les investisseurs existants qui remettent au pot : Monolith Management, Shixiang Capital et CATL, le géant chinois des batteries. Côté nouveaux entrants : CPE, Legend Capital, Stony Creek Capital et plusieurs fonds liés à des plateformes de financement des collectivités locales chinoises. La diversité des investisseurs illustre un soutien qui dépasse le cercle classique du venture capital tech.
Le revenu annualisé récurrent de DeepSeek tourne autour de 500 millions de dollars (NewsBytesApp). En comparaison, Anthropic affichait un run-rate de 65 milliards en juillet. Les ordres de grandeur ne sont pas les mêmes, mais la trajectoire de croissance (x10 en sept mois) reste spectaculaire.
Cap sur Shanghai pour l'IPO
DeepSeek a embauché des banques et des conseillers pour préparer une introduction en bourse (IPO) sur le Star Market de Shanghai, le segment de la bourse chinoise dédié aux entreprises technologiques et innovantes. Le dépôt pourrait intervenir dès fin 2026, avec un début de cotation visé pour 2027 (BigGo Finance). Si la levée se confirme, DeepSeek deviendrait la startup IA la plus valorisée de Chine.
DeepSeek multiplie ses revenus par 10 en sept mois et prépare une IPO à 74 milliards. La course à l'IA ne se joue pas uniquement dans la Silicon Valley.
Et pendant que DeepSeek lève des milliards, Nvidia joue un tout autre coup.
Nvidia rachète Hugging Face pour 12,9 milliards de dollars : l'open-source IA change de mains
Nvidia a accepté en principe de racheter Hugging Face pour 12,9 milliards de dollars, selon The Information (26 août), une information confirmée par TechCrunch, Fortune, Ars Technica et SiliconANGLE. L'acquisition valorise la plateforme de modèles open-source à plus de 13 milliards de dollars après ajustements, soit environ 86 fois son chiffre d'affaires annuel estimé à 150 millions de dollars. Les deux entreprises n'ont pas confirmé publiquement la transaction, qui pourrait encore ne pas aboutir (TechCrunch, Fortune).
Pourquoi 86 fois le revenu ?
Hugging Face est la plateforme de référence pour le partage et le déploiement de modèles IA open-source. Plus de 800 000 modèles y sont hébergés, avec des datasets, des espaces de démonstration et des outils d'inférence utilisés par des millions de développeurs dans le monde. Le chiffre d'affaires annualisé est passé d'environ 100 millions à 150 millions de dollars, mais ce n'est pas le revenu qui justifie le prix : c'est le positionnement stratégique.
Pour Nvidia, contrôler Hugging Face signifie verrouiller un maillon clé de la chaîne de valeur IA. Nvidia fabrique déjà les GPU, fournit le framework CUDA, et vend les serveurs DGX. Ajouter la plateforme de distribution de modèles à cette pile, c'est contrôler le parcours complet, du modèle au silicium (Ars Technica, SiliconANGLE).
Les questions ouvertes
La communauté open-source surveille l'opération de près. Hugging Face a toujours défendu l'ouverture et l'interopérabilité : modèles accessibles à tous, compatibles avec n'importe quel hardware. Si Nvidia commence à privilégier ses propres GPU dans les recommandations d'inférence ou à restreindre l'accès à certaines fonctionnalités, les alternatives comme ModelScope ou Replicate pourraient profiter du mouvement.
12,9 milliards pour une plateforme qui fait 150 millions de chiffre d'affaires. 86 fois le revenu annuel. Nvidia ne paye pas pour les revenus d'aujourd'hui, mais pour le contrôle de la distribution de l'IA open-source demain.
L'architecture des agents de code IA (analyse complète) repose massivement sur des modèles hébergés sur Hugging Face. Ce rachat pourrait redessiner les dépendances de tout l'écosystème.
Au-delà des deals et des valorisations, la vraie question reste : est-ce que les agents IA tiennent leurs promesses à l'échelle industrielle ? Uber vient d'apporter une réponse chiffrée.
Uber fait tourner 3 600 skills d'agents IA et poste 25 000 reviews de code automatisées par semaine
Uber a présenté les chiffres de sa "Software Factory" lors de la conférence AI Engineer 2026 le 27 août. 3 600 skills d'agents IA construits par les ingénieurs, plus de 30 000 exécutions par jour, une croissance de 7x des utilisateurs actifs hebdomadaires entre février et août 2026, et des requêtes agent en hausse de 9,4x. Le tout avec un budget IA total resté stable depuis avril. Présenté par Uday Kiran Medisetty, Distinguished Engineer chez Uber (Uber Engineering Blog, StartupHub.ai).
uReview : le moteur multi-agents qui review le code
Le coeur du système s'appelle uReview, un moteur de code review multi-agents développé en interne. En août 2026, uReview poste environ 25 000 commentaires de review IA chaque semaine et gère plus de 70% des pull requests à travers les six monorepos d'Uber (un monorepo par langage). Les coûts de review ont baissé de 60%, et la précision des commentaires a augmenté de 70% par rapport à une première implémentation.
Le problème initial : le temps d'attente pour une première review avait triplé, passant de 3 heures en 2024 à 9 heures en 2026, à mesure que la base de code et le nombre d'ingénieurs augmentaient. Les agents uReview détectent les problèmes courants et ne remontent aux humains que les exceptions qui nécessitent un jugement de fond.
AI Context Graph : 24 millions de noeuds, 80 millions de liens
La technologie qui rend tout ça possible s'appelle l'AI Context Graph, un graphe de connaissances (une structure de données qui relie des entités entre elles par des relations typées) de 24 millions de noeuds et 80 millions de liens. Ce graphe agrège les données de plus de 30 systèmes internes : code, pull requests, documents de conception, logs d'incidents, datasets. Les agents interrogent ce graphe en langage naturel, ce qui fait passer le temps de recherche d'information de plus de 20 minutes à moins d'une minute.
Le coût par 1 000 requêtes a baissé de 34% et le coût par session de 52% sur la même période. Uber prouve qu'il est possible de scaler des agents IA en production sans faire exploser le budget. C'est l'optimisation de l'orchestration, pas la puissance brute des modèles, qui fait la différence à cette échelle. Le sujet de l'économie de tokens est un enjeu central pour tout développeur qui utilise des outils IA au quotidien (10 leviers pour diviser ta facture de tokens par 5).
Autres actus en vrac
McKinsey publie son State of AI 2026 : l'enquête mondiale (1 719 professionnels, 97 pays) révèle que 40% des grandes entreprises (plus d'un milliard de dollars de CA) scalent des agents IA dans au moins une fonction, contre 27% l'année précédente. 32% des répondants construisent désormais leurs logiciels en interne avec des outils de coding agentiques plutôt que d'acheter des solutions packagées (McKinsey, The Register).
OWASP met à jour son Top 10 des risques LLM : le prompt injection (une attaque où un texte malveillant détourne le comportement de l'IA) reste la menace numéro un pour la troisième année consécutive. Trois incidents majeurs en 2026 : l'exploit "PerplexedBrowser" contre des navigateurs agentiques en mars, la technique "BioShocking" en juin qui volait des clés SSH via des pages web piégées, et une faille dans Microsoft Copilot en août. Le sujet de la sécurité des agents IA (actu du 17 août) ne faiblit pas (SC Media, VentureBeat).
OpenAI et le fossé d'adoption de ChatGPT Work : lancé en juillet à 20 dollars par mois, ChatGPT Work permet aux cols blancs de déployer des agents IA connectés à leurs outils (email, Slack, calendrier, Notion). Mais l'étude interne d'OpenAI révèle un écart massif : 98% des employés OpenAI utilisent les agents Codex, contre seulement 17% des abonnés organisationnels et moins de 1% des utilisateurs individuels (TechCrunch).
Le financement des startups spatiales atteint un record : 20,3 milliards de dollars en 2026, porté par Anduril (5 milliards de dollars), Yuanxin Satellite (1 milliard) et K2 Space (500 millions). SpaceX, coté depuis peu, échange autour de 140 dollars l'action, en dessous de son pic à 225 dollars (TechTimes, Crunchbase).
Conclusion : la semaine où l'infrastructure IA a changé de mains
Trois mouvements de fond se dessinent cette semaine. Le premier est vertical : Nvidia, qui contrôlait déjà le silicium et les frameworks, s'empare maintenant de la distribution avec Hugging Face. Le deuxième est géographique : DeepSeek prouve que l'IA chinoise ne se contente plus de suivre, elle lève, elle croît et elle prépare une IPO. Le troisième est architectural : les agents IA passent du prototype au système de production, comme Uber le démontre avec 25 000 reviews automatisées par semaine et un graphe de connaissances de 24 millions de noeuds.
Le dénominateur commun de ces annonces, c'est la concentration. Les acteurs qui contrôlent plusieurs maillons de la chaîne (hardware, modèles, distribution, intégrations) prennent l'avantage. Apple construit le hardware et le framework. Nvidia achète la plateforme de modèles. Anthropic intègre Claude dans le navigateur, le bureau et le CRM. La question pour les développeurs et les petites structures, c'est de savoir quels espaces de liberté vont subsister dans cet écosystème.
Et toi, le rachat de Hugging Face par Nvidia, tu trouves que c'est un risque pour l'open-source ou une chance de l'industrialiser ? Envoie-moi un message sur Twitter/X ou en commentaire.
Alex
À retenir
Nvidia rachète Hugging Face pour 12,9 milliards de dollars, soit 86 fois son revenu annuel
DeepSeek lève 7,4 milliards à 74 milliards de valorisation, revenus multipliés par 10 en sept mois
Apple sort le Mac Studio M5 Ultra avec 512 Go de RAM unifiée et le framework Core AI
Anthropic lance Claude in Chrome en GA, intègre un navigateur dans Cowork et déploie Claudeforce avec Salesforce
Uber fait tourner 3 600 skills d'agents IA avec 25 000 reviews de code automatisées par semaine