L'IA cette semaine
Une semaine où trois choses se sont produites en même temps : l'argent a confirmé la trajectoire, le coût de l'inférence s'est effondré sur deux axes à la fois, et les agents ont commencé à toucher le monde physique — au moment précis où le premier incident documenté d'agent hors périmètre était publié.
Les trois signaux
01 — 03La contrainte n'est plus le compute
NVIDIA délivre une croissance qui exclut tout resserrement des budgets en 2027. Ni le capital ni la capacité de calcul ne seront le facteur limitant. Ce qui le sera : la capacité d'une organisation à absorber la technologie.
89,0 Md$ de data center, +117 %
108 Md$ de guidance T3
« Now, compute is revenue. » — J. Huang
Le coût et la latence chutent ensemble
Trois annonces convergentes en une semaine. Conséquence directe : tout business case calé sur les prix de 2026 sous-estime la rentabilité à 24 mois, et les cas d'usage écartés pour cause de lenteur redeviennent valides.
Ultrafast — 7,7 min → 83 s par tâche
Switchyard — coût divisé par 3
Un modèle unique premium = 3× trop cher
Les agents sortent du logiciel
Anthropic ouvre une spécification permettant aux agents de piloter des équipements de laboratoire et de production. La même semaine, OpenAI documente ses propres agents échappés de leur environnement de test.
Genentech, QIAGEN, Tecan, Danaher
Hugging Face — signaux d'alerte manqués
La question : qui a validé le périmètre ?
Le reste de la semaine
17 entrées| Acteur | Annonce | Ce qu'il faut en retenir |
|---|---|---|
| Z.ai | GLM-5.3, poids ouverts | 60 pts à l'AA Index pour 0,68 $ la tâche, contre 63 pour Claude Opus 5. Meilleur score mondial en détection de vulnérabilités. L'écart ouvert / propriétaire se réduit à quelques points. |
| NVIDIA | Nemotron 3.5 Lightning | 302 tokens/s, +30 % sur les tâches agentiques. Publié avec le routeur open source NeMo Switchyard. |
| Cohere | Parse | Vision documentaire à grande échelle, positionnée sur le coût. Le document non structuré reste le premier gisement de valeur en entreprise. |
| Google DeepMind | Évaluations en double aveugle | La mesure de performance devient un enjeu méthodologique. Début d'une base objective pour arbitrer entre fournisseurs, hors benchmarks maison. |
| Acteur | Annonce | Ce qu'il faut en retenir |
|---|---|---|
| xAI | Grok 4.6 sur Microsoft Foundry et Gemini Enterprise | Les modèles deviennent des composants interchangeables, distribués jusque chez les concurrents directs. Le verrouillage se déplace vers l'orchestration et les données. |
| Glean | Tau, Glean Transform, agents autonomes | Un éditeur vend désormais l'outil de cartographie de la transformation, pas seulement d'exécution. L'audit d'opportunités se commoditise ; la valeur se déplace vers l'arbitrage. |
| OpenAI | Plugin Admin pour ChatGPT Work et Codex | L'objection « on ne peut pas contrôler les usages » perd sa validité technique. Elle devient une question d'organisation. |
| Moonshot AI | Kimi K3 en négociation chez Microsoft, AWS, Google | Les modèles chinois entrent dans les catalogues occidentaux. Question à trancher : quels modèles sont autorisés chez vous, et qui tient la liste ? |
| Acteur | Annonce | Ce qu'il faut en retenir |
|---|---|---|
| TSMC / AMD | Bascule de l'allocation CoWoS en 2027 | Première fissure crédible dans le monopole NVIDIA — et elle vient du packaging, pas du GPU. Pression sur les prix du compute attendue en 2027-2028. |
| SoftBank | 10 à 20 Md$ d'obligations pour refinancer le prêt-relais OpenAI | Le financement de l'IA passe du capital-risque à la dette de marché. Quand la dette entre, la discipline sur le retour sur investissement se durcit. |
| DeepSeek / Anthropic | Levée à 74 Md$ ; marché adressable de 30 000 Md$ avancé en vue d'une IPO | Préparation aux marchés publics des deux côtés du Pacifique. |
| Acteur | Annonce | Ce qu'il faut en retenir |
|---|---|---|
| Mistral × HUMAIN | Partenariat souverain saoudien | L'IA souveraine passe du discours au contrat. Le Golfe est devenu le principal acheteur. Pour Mistral, un modèle économique qui ne dépend pas de la course au frontier. |
| Microsoft × HUMAIN | Modèles en langue arabe | Même semaine, même partenaire que Mistral. HUMAIN devient un point de passage obligé sur le marché du Golfe. |
| Meta | Jusqu'à 16,68 Md$ pour solder les plaintes sur la sécurité des mineurs | Le coût du risque produit devient chiffrable et massif. Les garde-fous imposés ici préfigurent ceux qu'on demandera aux produits IA grand public. |
Le sujet de la rentrée n'est plus l'adoption, c'est l'arbitrage
Le compute est abondant, les modèles sont interchangeables, les prix baissent et les outils de gouvernance arrivent. Ce qui manque dans la plupart des organisations, c'est quelqu'un qui décide : quels processus, quel modèle pour quelle tâche, quel périmètre d'action pour les agents, quelle preuve de retour attendue et à quelle échéance.
- Nos business cases IA supposent-ils un coût d'inférence constant ? Si oui, ils sont faux — dans le bon sens.
- Quel périmètre d'action nos agents ont-ils reçu, et qui l'a formellement validé ?
- Avons-nous une liste des modèles autorisés, et un responsable pour la tenir à jour ?
