Claude Design, Factory 1,5 Md$ et Mythos au DoD — Actu IA
Alexandre
··
Durée de lecture : 18 min
Cette semaine, j'ai eu un moment bizarre : j'ai relu le mémo Mythos deux fois pour vérifier que je n'avais pas mal compris. Le même modèle déclaré trop dangereux pour le grand public… branché sur le DoD deux semaines plus tard. Le reste de la semaine était à l'avenant.
En une journée, OpenAI et Anthropic ont sorti chacun leur gros modèle en simultané — guerre de benchmarks classique. Le lendemain, Anthropic remettait ça avec Claude Design, un outil de prototypage visuel propulsé par Opus 4.7. Mais l'actu qui m'a vraiment occupé l'esprit, c'est autre chose : Bloomberg révèle que Mythos, le modèle qu'Anthropic venait de déclarer trop dangereux pour le grand public, va être branché sur le DoD et Homeland Security. Entre ça, Factory qui lève 150M$ à 1,5 milliard avec Morgan Stanley comme client, et Google qui sort Gemini Mac en activant l'accès à tes données par défaut — je construis Waku avec Claude Code, et ces cinq actus touchent mes outils directement.
Le radar de la semaine
Événement
Date
Acteur
Chiffre clé
Source
Factory lève 150M$ à 1,5 Md$
16 avr.
Factory
Morgan Stanley, EY, Palo Alto Networks clients
TechCrunch
OpenAI Codex Mac — cible Claude Code
16 avr.
OpenAI
111 nouveaux plugins, computer use intégré
The Verge
Claude Opus 4.7 reprend le lead SWE-bench
16 avr.
Anthropic
64,3 % SWE-bench Pro vs 57,7 % GPT-5.4
VentureBeat
Claude Design lancé en research preview
17 avr.
Anthropic Labs
Prototypes, slides, designs — export Canva/PPTX, handoff Claude Code
Anthropic
Mémo Barbaccia — agences US sur Mythos
7 avr. (révélé 16 avr.)
White House / Anthropic
6 agences fédérales + 3 comités du Congrès
Bloomberg / Reuters
Gemini Mac lancé + Google I/O annoncé
15-19 avr.
Google
I/O le 19 mai 2026
9to5Mac / TechCrunch
Sources : TechCrunch, The Verge, VentureBeat, Bloomberg, Reuters, 9to5Mac
Factory lève 150 millions de dollars à 1,5 milliard : les agents de code enterprise ont trouvé leur champion
Factory, 150M$ levés le 16 avril, valorisation 1,5 milliard. Khosla en lead, Sequoia, Insight Partners et Blackstone dedans. Clients : Morgan Stanley, EY, Palo Alto Networks. La boîte, fondée en 2023 par Matan Grinberg, construit des agents de code autonomes pour les entreprises.
Morgan Stanley et EY ne sont pas des early adopters tech. Ce sont des boîtes avec des contraintes de compliance et d'audit trail que les outils de code grand public ne couvrent pas. Quand elles paient pour des agents de code en production, le marché a basculé du pilote à la dépense récurrente.
Définition — Agent de code enterprise : agent IA spécialisé dans la génération et la modification de code à l'échelle d'une organisation, avec des contraintes spécifiques : respect des politiques de sécurité internes, intégration dans les chaînes CI/CD, auditabilité des actions, gestion des droits d'accès multi-équipes. Distinct des outils grand public (Claude Code, Codex) par la nécessité de s'adapter aux workflows existants plutôt que de les remplacer.
La valorisation de 1,5 milliard pour une boîte fondée en 2023, c'est une prime sur le potentiel, pas sur les revenus prouvés. TechCrunch précise que Blackstone participe à ce round. Blackstone n'est pas un VC classique. Quand un gestionnaire d'actifs alternatifs entre dans un round pour une boîte d'agents de code, la thèse "les agents IA vont remplacer des équipes de développeurs" n'est plus un pitch deck — c'est une conviction d'allocation.
Palo Alto Networks comme client mérite aussi qu'on s'y arrête. La cybersécurité est un secteur où la qualité du code a des conséquences directes sur la surface d'attaque. Le fait qu'une boîte de sécurité fasse confiance à un agent externe pour modifier son codebase dit quelque chose sur le niveau de maturité opérationnelle que Factory a atteint.
Mon take de dev solo
Je construis Waku seul, avec Claude Code à 100 euros par mois. Je n'ai pas besoin d'audit trail ou d'intégration SAML. Le produit de Factory n'est pas fait pour moi.
Ce que ça dit concrètement : les outils que j'utilise et ceux que Morgan Stanley utilise ne vont plus converger. Deux marchés, deux pricing, deux roadmaps. Pour moi c'est plutôt une bonne nouvelle — la compétition sur les outils grand public reste entière.
Ce qui me préoccupe sur 18 mois : si les grandes entreprises capturent une part croissante de la compute des labs via des contrats enterprise, est-ce que les labs vont optimiser pour leurs cas d'usage au détriment des workflows solo ? Pas dans l'immédiat. Mais c'est une dynamique à surveiller.
Et justement, le même jour que la levée Factory, OpenAI sortait une réponse très directe à Claude Code.
Cliquer pour agrandir
OpenAI Codex Mac : computer use, browser intégré et 111 plugins pour cibler Claude Code
Codex Mac est sorti le 16 avril. Ce n'est pas un simple portage desktop : computer use en arrière-plan, browser intégré, génération d'images via gpt-image-1.5, mémoire cross-sessions et 111 nouveaux plugins dont GitLab, la suite Atlassian et Microsoft Office. The Verge titre sans ambiguïté : "a direct shot at Claude Code".
Les fonctionnalités listées correspondent précisément aux points faibles de Claude Code. La mémoire cross-sessions est la lacune la plus citée : chaque session repart de zéro sans contexte accumulé. Le computer use en arrière-plan permet à Codex de lancer des tests, vérifier des builds et interagir avec des interfaces graphiques pendant que tu travailles sur autre chose. Les 111 plugins ciblent directement les équipes qui n'utilisent pas GitHub.
Définition — Computer use : capacité d'un agent IA à contrôler une interface graphique d'ordinateur comme le ferait un humain : cliquer, taper du texte, naviguer entre les fenêtres, lire l'état de l'écran. Introduite par Anthropic avec Claude 3.5 Sonnet en octobre 2024, elle permet aux agents d'automatiser des tâches qui nécessitent des interactions avec des logiciels non dotés d'API.
Le timing est calculé. Anthropic venait de sortir Opus 4.7 le même jour. OpenAI a choisi de lancer Codex Mac simultanément, occupant la couverture médiatique et forçant les comparaisons. Engadget et The Verge ont tous les deux couvert les deux annonces le même jour.
La génération d'images via gpt-image-1.5 dans un outil de code révèle une stratégie différente. OpenAI ne construit pas un outil de code. Il construit un assistant de développement complet qui couvre aussi les assets visuels, les maquettes, les icônes. Claude Code reste plus étroit dans sa spécialisation — et c'est peut-être un choix délibéré.
Ars Technica a testé le computer use en profondeur : l'agent peut lancer Xcode, attendre la fin de la compilation, lire les erreurs et corriger le code, sans interruption. Sur les workflows iOS natifs, c'est concret.
Mon take de dev solo qui utilise Claude Code tous les jours
Cette release me fait regarder mon setup différemment.
La mémoire cross-sessions, c'est le point où Claude Code me perd le plus de temps. Sur Waku, mon codebase SwiftUI fait maintenant plusieurs milliers de lignes réparties sur des dizaines de fichiers. Chaque nouvelle session nécessite un recap de contexte que j'ai semi-automatisé via un fichier CLAUDE.md — friction réelle. Si Codex garde le contexte automatiquement, c'est une qualité de vie significative.
Le computer use pour les builds iOS, c'est aussi ce que je veux. Comment j'utilise Claude Code pour développer Waku implique encore beaucoup d'allers-retours manuels avec le simulateur et Xcode. Un agent qui peut lancer le build, lire les erreurs et les corriger en boucle : c'est la prochaine étape logique.
Je ne switche pas demain. La compréhension architecturale de Claude Code sur des codebases complexes, sa façon de raisonner sur les implications d'un changement dans plusieurs fichiers à la fois, est ce qui m'a convaincu sur la durée. Mais si Codex Mac tient ses promesses sur la mémoire et le computer use, la distance entre les deux outils se réduit.
Cliquer pour agrandir
Claude Opus 4.7 : Anthropic reprend le premier rang SWE-bench avec 64,3 %
Opus 4.7 est sorti le 16 avril. 64,3 % sur SWE-bench Pro, contre 57,7 % pour GPT-5.4. 3x plus de tâches difficiles résolues vs Opus 4.6, résolution visuelle 3x supérieure. C'est clairement la réponse d'Anthropic aux critiques sur la régression 4.6.
Définition — SWE-bench Pro : version professionnelle du benchmark SWE-bench (Software Engineering Benchmark), conçu pour mesurer la capacité d'un modèle IA à résoudre des issues GitHub réelles sur des dépôts open source en production. Contrairement au SWE-bench standard, SWE-bench Pro exclut les issues présentes dans les données d'entraînement des modèles, ce qui rend le benchmark plus difficile à mémoriser et plus représentatif des performances réelles.
6,6 points d'écart sur SWE-bench Pro, c'est pas rien : on parle d'issues GitHub réelles, dans des codebases en production, avec des tests à passer. C'est le workflow Claude Code en conditions réelles. VentureBeat note que les gains sont particulièrement marqués sur les tâches classées "hard" : bugs qui nécessitent une compréhension cross-fichiers ou une modification de l'architecture.
L'amélioration visuelle (3x) est moins spectaculaire sur le papier mais a des implications pratiques. Sur les workflows qui incluent des captures d'écran d'erreurs, des maquettes UI ou des diagrammes d'architecture, une meilleure vision signifie moins d'hallucinations sur les détails.
The Information rapporte que l'amélioration sur les tâches de "production complexity" — modifier plusieurs fichiers avec des dépendances croisées — est l'indicateur qui compte le plus pour les équipes engineering en production. Le facteur 3x sur ce critère est la donnée la plus concrète de cette release.
Ce pattern — régression signalée, correction dans la version suivante — est rassurant sur la capacité d'Anthropic à écouter ses utilisateurs techniques. Même si un mois de cycle entre la dégradation et le correctif, c'est long pour un outil de développement quotidien.
Mon take de dev solo
Les benchmarks SWE-bench, je les lis avec prudence. Ils mesurent des issues GitHub isolées, en environnement contrôlé. Mon usage réel de Claude Code sur Waku ressemble davantage à "construis cette feature, maintiens la cohérence avec les composants existants, assure-toi que ça compile sur Xcode 16.3, respecte les conventions SwiftUI que j'utilise depuis 6 mois". C'est un benchmark de facto beaucoup plus contextuel.
Cela dit, la progression sur les tâches difficiles dit quelque chose de réel : Anthropic a travaillé spécifiquement sur les cas qui nécessitent une compréhension en profondeur du codebase. C'est précisément là où Claude Code était meilleur qu'Opus 4.6 avant la régression.
Ce qui m'intéresse vraiment : si Opus 4.7 gère vraiment 3x mieux les tâches complexes, je peux envoyer des prompts plus ambitieux en une seule passe. Moins d'itérations, moins de tokens. Je teste cette semaine sur les features iOS en cours — et si tu veux optimiser ta consommation de tokens sur Claude Code, c'est le bon moment pour revoir tes prompts.
Claude Design : Anthropic veut aussi prendre le marché du prototypage visuel
Le 17 avril 2026, Anthropic Labs a lancé Claude Design en research preview pour les abonnés Pro, Max, Team et Enterprise. L'outil permet de créer des designs, prototypes interactifs, slides et one-pagers en conversation avec Claude — propulsé par Opus 4.7. L'export va vers Canva, PDF, PPTX ou HTML. Le handoff vers Claude Code se fait en un clic avec un bundle packagé.
Le pitch est clair : tu décris ce que tu veux, Claude génère une première version, tu affines par la conversation, des commentaires inline ou des curseurs de réglage générés par Claude lui-même. L'outil lit ton codebase ou tes fichiers de design au démarrage pour construire un design system propre à ta marque.
Définition — Research preview : phase de lancement limitée où un produit est disponible pour un sous-ensemble d'utilisateurs existants (ici les abonnés payants), avec des fonctionnalités incomplètes ou susceptibles d'évoluer. Anthropic utilise ce format pour collecter des retours réels avant un lancement grand public.
Ce qui distingue Claude Design des outils existants : le handoff Claude Code. Quand le prototype est prêt, Claude Design génère un bundle que tu passes à Claude Code avec une seule instruction pour implémenter. Pas de copier-coller de spécifications entre un outil de design et un outil de code — le contexte se transfère directement.
Anthropic cite Datadog, Brilliant et Canva comme early partners. Datadog note que ce qui prenait une semaine de va-et-vient entre briefs, maquettes et reviews se fait maintenant en une seule conversation. Canva est intégré en export natif — tu crées dans Claude Design, tu exportes dans Canva pour la mise en production collaborative.
La cible est explicitement les non-designers : fondateurs, product managers, marketeurs qui ont des idées visuelles mais pas le background Figma. Et les designers qui veulent explorer plus de directions sans passer du temps à les produire manuellement.
Le premier : les assets marketing. Une landing page, des visuels App Store, des posts réseaux sociaux. Je passe aujourd'hui beaucoup de temps sur des outils de design pour des tâches qui ne nécessitent pas de compétences Figma avancées. Si Claude Design gère ça de façon cohérente avec mon design system, c'est du temps récupéré.
Le deuxième : les prototypes de nouvelles features iOS avant de les coder. Décrire une interface en langage naturel, avoir un prototype interactif en quelques minutes, l'envoyer à des utilisateurs pour feedback, puis passer le bundle à Claude Code pour implémenter. C'est le workflow que j'essaie d'optimiser depuis des mois avec des solutions bricolées.
La vraie question : est-ce que le output tient la route sur des interfaces mobiles complexes, avec des états différents, des animations SwiftUI, des composants réutilisables ? Les témoignages sont sur du web et des slides. Je teste dès cette semaine.
Cliquer pour agrandir
Claude Mythos entre dans les agences fédérales américaines : le mémo Barbaccia
Le 16 avril 2026, Bloomberg et Reuters ont révélé que le federal CIO Gregory Barbaccia a signé le 7 avril un mémo préparant l'accès de six agences fédérales à Claude Mythos : DoD, Treasury, Commerce, Homeland Security, Justice et State. Avant ce mémo, deux agences non nommées et trois comités du Congrès avaient déjà contacté Anthropic. Le déploiement passerait par l'accord FedRAMP existant d'Anthropic.
C'est l'actu de la semaine. La semaine du 10 avril, Anthropic avait annoncé via Project Glasswing que Mythos Preview avait découvert des milliers de vulnérabilités zero-day — un bug OpenBSD de 27 ans, une faille FFmpeg de 16 ans. Trop dangereux pour être publié. Accès limité à 40+ partenaires vettés incluant Amazon, Apple, Microsoft et CrowdStrike.
Désormais, ce même modèle est sur le point d'être branché sur le Département de la Défense et Homeland Security.
Définition — FedRAMP : Federal Risk and Authorization Management Program. Programme du gouvernement américain qui standardise l'évaluation de sécurité des services cloud utilisés par les agences fédérales. Une accréditation FedRAMP signifie que le fournisseur a passé un audit de sécurité rigoureux et répond aux exigences fédérales de protection des données gouvernementales. Anthropic avait obtenu cette accréditation pour ses modèles commerciaux, ce qui simplifie le déploiement de Mythos dans les agences.
Reuters précise les cas d'usage : analyse de vulnérabilités dans les systèmes d'infrastructure critique, veille sur les cybermenaces étatiques, assistance aux analystes du renseignement. Pas de la productivité générale — des cas d'usage où les capacités offensives de Mythos seraient utilisées en mode défensif.
Bloomberg rapporte que la décision a été facilitée par des exercices de red team organisés par la CISA fin mars. Mythos aurait identifié des vecteurs d'attaque sur des systèmes d'infrastructure énergétique que les équipes humaines n'avaient pas vus après six semaines de travail.
La chronologie est instructive. Le 7 avril, le mémo Barbaccia est signé. Le même jour, Anthropic annonce Project Glasswing. Glasswing est la structure qui permet de déployer Mythos auprès d'acteurs gouvernementaux tout en maintenant une apparence de gouvernance multi-parties. La liste des partenaires ressemble désormais à une liste pré-approuvée pour des accords fédéraux.
Mon take de dev solo
Cette actu me met mal à l'aise.
Deux semaines après avoir déclaré Mythos "trop dangereux pour le grand public", Anthropic s'apprête à le brancher sur le DoD et Homeland Security. Ces deux institutions ont une définition de "défensif" qui ne coïncide pas nécessairement avec la mienne.
Ce qui me dérange dans le raisonnement d'Anthropic, c'est la logique d'"entre de bonnes mains". Glasswing, c'est 40 entreprises privées. L'accès fédéral, c'est des agences dont certaines ont des histoires documentées d'abus de surveillance (NSA, FBI). "Défensif" dans le contexte de Homeland Security peut inclure des cas d'usage qui auraient été qualifiés d'offensifs ailleurs.
Je ne prétends pas avoir la réponse sur ce que devrait faire Anthropic. Mais j'observe que les labs naviguent systématiquement entre deux positions : "nous construisons pour le bénéfice de l'humanité" et "nous acceptons des contrats gouvernementaux pour des usages militaires". Ces deux positions peuvent coexister — mais seulement avec une transparence radicale sur les garde-fous. Glasswing n'est pas ça.
J'utilise Claude Code pour construire Waku. Ça ne change rien à mon usage immédiat. Mais savoir que le même lab qui me vend un outil de développement signe aussi des contrats avec le DoD, ça rentre dans ma réflexion sur la dépendance à un seul fournisseur — et sur l'architecture des agents de code IA que je veux construire à long terme.
Cliquer pour agrandir
Google Gemini Mac et I/O 2026 : la contre-programmation tranquille de Mountain View
Le 15 avril 2026, Google a lancé l'application Gemini native pour macOS, avec Personal Intelligence activé par défaut — accès à tes documents locaux, calendrier, emails et navigation web. Dans le même mouvement, Google a annoncé Google I/O 2026 pour le 19 mai : Gemma, Android 17, Firebase agent-native et des outils de vibe-coding. Selon 9to5Mac, Gemini Mac était le troisième téléchargement sur le Mac App Store dans les 12 heures suivant son lancement.
Google avait signalé la disponibilité de Gemini Mac depuis plusieurs semaines. Mais Personal Intelligence activé par défaut, c'est une décision produit qui tranche. La plupart des assistants demandent à l'utilisateur d'activer explicitement les permissions. Google a inversé la logique : l'accès est activé, à toi de le désactiver.
Définition — Personal Intelligence (Google Gemini) : fonctionnalité qui permet à Gemini d'accéder aux données personnelles de l'utilisateur stockées dans les services Google (Gmail, Calendar, Drive, Photos) et sur l'appareil local, pour fournir des réponses contextualisées. Exemple : "qu'ai-je de prévu cette semaine ?" ou "résume les emails reçus de ce client le mois dernier". La version Mac inclut l'accès aux fichiers locaux avec permission système macOS.
Les annonces I/O 2026 méritent attention. Firebase agent-native est la plus concrète : Google prépare un SDK pour construire des agents IA qui s'exécutent directement dans l'infrastructure Firebase, avec accès natif à Firestore, à l'authentification et aux Cloud Functions. Pour un dev solo qui utilise Firebase pour son backend, c'est une façon de construire des agents sans monter sa propre infrastructure.
TechCrunch rapporte qu'I/O incluera une session dédiée aux outils de vibe-coding. Que Google y consacre une keynote confirme que le terme a quitté les dev solo pour devenir un segment de marché à part entière.
9to5Google note une intégration native avec Xcode : Gemini peut être invoqué depuis Xcode via une extension, avec accès au contexte du projet en cours. C'est une réponse directe à l'intégration Claude Code / Xcode que les indie dev iOS utilisent.
Mon take de dev solo
Pendant qu'OpenAI et Anthropic se battent sur les benchmarks, Google sort une app native Mac bien foutue et active l'accès à tes données locales par défaut. Stratégie différente — moins de bruit, plus d'infiltration dans le quotidien.
L'intégration Xcode native m'intéresse plus que le reste. J'utilise Claude Code via terminal parce que c'est l'intégration la plus fluide dans mon workflow actuel. Si Gemini peut s'invoquer directement depuis Xcode avec le contexte du projet, c'est un argument de friction réduite qui peut convaincre des devs qui ne veulent pas sortir de leur éditeur.
Google accède à tes fichiers locaux et tes emails par défaut. Pour une boîte dont le modèle est la pub ciblée, je préfère activer ça moi-même, pas devoir le désactiver après coup.
Autres actus IA de la semaine
Actu
Ce qui s'est passé
Pourquoi c'est important
Sequoia lève 7 Md$
Sequoia Capital a levé son plus grand fond late-stage : 7 milliards de dollars le 17 avril. La majorité est destinée aux boîtes IA à croissance rapide qui ont besoin de capitaux avant une IPO. (Financial Times)
Les IPO IA de 2026-2027 seront massives. Sequoia finance des rounds de pré-IPO avec des tickets de 500M+.
FluidStack à 18 Md$ de valorisation
FluidStack, qui agrège de la puissance de calcul GPU distribuée pour les labs IA, était en négociation pour une levée à 18 milliards. (Bloomberg)
La pénurie de GPU reste le goulot d'étranglement de l'IA. Les agrégateurs de compute ont une prime de valorisation extrême.
Booking.com fuite de données
Le 13 avril, Booking.com a confirmé une fuite exposant noms, emails et partiellement numéros de cartes. Les attaquants auraient utilisé un agent IA pour automatiser l'exfiltration via une API interne. (Wired)
Premier cas documenté d'un agent IA utilisé pour automatiser une exfiltration à grande échelle. La surface d'attaque des entreprises exposant des APIs internes à des agents change fondamentalement.
Forbes AI 50 2026
Forbes a publié son AI 50 2026 le 16 avril. Le titre : "From AI Dominance to AI Independence". La liste valorise les boîtes qui construisent de la souveraineté technologique plutôt que celles qui dépendent des APIs des labs. (Forbes)
Les investisseurs et clients enterprise valorisent l'indépendance vis-à-vis des labs IA. Contre-tendance à surveiller.
OpenAI GPT-Rosalind
OpenAI a annoncé GPT-Rosalind le 16 avril, un modèle spécialisé life sciences / biopharma entraîné sur des corpus cliniques. Disponible uniquement via API pour les clients enterprise santé et biotech. (STAT News)
Début de la stratégie de modèles verticaux chez OpenAI. Plutôt qu'améliorer les généralistes, ils entraînent des versions spécialisées par secteur. Pattern à surveiller.
Meta hyperagents
Meta a publié un papier de recherche sur les "hyperagents" : des agents capables de modifier leurs propres poids pour améliorer leurs performances sur des tâches non-coding. (arXiv)
Si ça sort du labo, c'est une rupture. Un agent qui peut s'auto-améliorer sans supervision humaine sort du cadre des agents IA actuels. À surveiller de très près.
Ce que la semaine du 14 avril 2026 change pour les développeurs indépendants
1. Le marché enterprise de l'IA de code diverge des outils grand public
Factory à 1,5 milliard avec Morgan Stanley et EY, ça confirme que l'IA de code enterprise n'est plus le même marché. Les deux segments vont diverger : pricing différent, fonctionnalités différentes, exigences de sécurité différentes. Pour les dev solo, la bonne nouvelle c'est que la compétition sur les outils grand public (Claude Code vs Codex Mac) reste entière — les labs ont besoin des deux marchés.
2. La mémoire cross-sessions va devenir un standard, pas une feature premium
Codex Mac l'a lancée. Anthropic va devoir suivre. C'est la différence entre un assistant qui repart de zéro chaque matin et un assistant qui sait sur quoi tu travaillais hier. Si tu as des workflows Claude Code qui incluent un fichier CLAUDE.md de contexte, prépare-toi à pouvoir l'abandonner d'ici 6 mois.
3. Opus 4.7 justifie de revoir tes prompts pour des tâches plus ambitieuses
Si Anthropic a vraiment multiplié par 3 les performances sur les tâches difficiles, les prompts que tu utilisais avec Opus 4.6 sont sous-dimensionnés. C'est le moment de demander des tâches plus complexes en une seule passe. Moins d'itérations, moins de tokens, meilleure cohérence.
4. Tes outils de dev et les agences de renseignement partagent la même infrastructure
Le mémo Barbaccia n'est pas abstrait. Les mêmes modèles que tu utilises pour construire ton app sont en cours de déploiement dans des agences de renseignement américaines. Si tu construis pour des marchés réglementés ou si tu es européen, la question de la juridiction des données que tu passes à ces outils mérite d'être posée.
5. Firebase agent-native à I/O 2026 peut changer la stack des apps solo
Si Firebase lance un SDK pour des agents natifs, intégrer de l'IA dans une app mobile solo devient beaucoup plus court. Pas besoin de monter une infrastructure LangChain ou LlamaIndex. Juste Firebase + les agents natifs. À surveiller de très près à I/O le 19 mai.
Conclusion : la semaine où l'IA de code est devenue géopolitique
Factory à 1,5 milliard dit que le marché enterprise existe et est déjà là. OpenAI et Anthropic se battent feature par feature sur les outils de code — et Anthropic ne s'arrête pas au code : Claude Design arrive pour couvrir aussi le prototypage visuel. Et Mythos entre dans les agences fédérales américaines — le même modèle déclaré trop dangereux pour le grand public deux semaines plus tôt.
Ce que je retiens concrètement : Opus 4.7 à tester cette semaine sur mes workflows difficiles. Claude Design à évaluer sur les assets Waku et les prototypes iOS. Codex Mac à regarder sérieusement sur la mémoire cross-sessions. Et Mythos dans le DoD me rappelle que mes outils de dev sont fabriqués par des boîtes qui font aussi des arbitrages géopolitiques. Je ne diversifie pas demain — mais j'y pense.
Alex
À retenir
Factory lève 150M$ à 1,5 Md$ le 16 avril 2026, mené par Khosla + Sequoia + Insight + Blackstone. Clients : Morgan Stanley, EY, Palo Alto Networks. Le marché enterprise de l'IA de code est un segment distinct avec ses propres exigences de compliance et de sécurité.
OpenAI lance Codex Mac le 16 avril avec computer use en arrière-plan, browser intégré, mémoire cross-sessions, génération d'images gpt-image-1.5 et 111 nouveaux plugins (GitLab, Atlassian, Microsoft Suite). The Verge le qualifie de tir direct contre Claude Code. La mémoire cross-sessions est la fonctionnalité qui distingue Codex Mac de Claude Code actuel.
Claude Opus 4.7 disponible le 16 avril : 64,3 % sur SWE-bench Pro vs 57,7 % pour GPT-5.4. 3x plus de tâches de production difficiles résolues vs Opus 4.6. 3x meilleure résolution visuelle. Réponse directe aux critiques sur la régression d'Opus 4.6.
Claude Design lancé le 17 avril en research preview par Anthropic Labs : prototypes interactifs, slides, designs et one-pagers en conversation avec Claude Opus 4.7. Export Canva, PDF, PPTX, HTML. Handoff Claude Code en un clic. Cible : fondateurs, PMs et marketeurs sans background design, et designers qui veulent explorer plus vite.
Le federal CIO Gregory Barbaccia a signé le 7 avril un mémo pour brancher DoD, Treasury, Commerce, Homeland Security, Justice et State sur Claude Mythos, révélé par Bloomberg et Reuters le 16 avril. Le même modèle déclaré trop dangereux pour le grand public deux semaines plus tôt entre dans les agences de renseignement américaines sous l'accord FedRAMP.
Google lance Gemini Mac le 15 avril (Personal Intelligence activé par défaut) et annonce Google I/O 2026 le 19 mai avec Firebase agent-native, Gemma, Android 17 et des outils de vibe-coding. Firebase agent-native est la donnée la plus concrète pour les dev solo utilisant Firebase comme backend.