ma2tic

9 février 2026 · Matthieu MALVACHE · 5

L'IA cette semaine : Opus 4.6 lance les équipes d'agents, MCP dépasse 2 000 serveurs

Premier numéro. Chaque lundi, je fais le point sur les actus IA de la semaine. Ce qui m'intéresse, c'est ce qui change concrètement la façon dont on construit. Le reste, je le laisse tomber.

Les actus de la semaine

Opus 4.6 et les équipes d'agents : le vrai tournant

Anthropic a sorti Claude Opus 4.6 le 5 février. Je l'utilise intensivement depuis. Au programme : des équipes d'agents natives dans Claude Code, une fenêtre de contexte de 1M de tokens en bêta, la compaction automatique du contexte (auto-memories) et des niveaux d'effort configurables.

Les équipes d'agents changent la donne. Tu peux lancer plusieurs instances de Claude Code en parallèle sur différentes parties d'un problème : une qui lit et cartographie le code, une autre qui écrit les tests, une troisième qui implémente la fonctionnalité, pendant qu'un orchestrateur coordonne le tout. C'est encore en preview. Je l'utilise sur ce site même. Ça fonctionne.

Le contexte 1M en bêta impressionne aussi. Sur les benchmarks de récupération en contexte long, Opus 4.6 atteint 76 % là où Sonnet 4.5 plafonne à 18,5 %. Un saut de capacité, pas une amélioration incrémentale. La limite de sortie passe à 128K tokens. Le nouveau mode de réflexion adaptatif laisse le modèle décider quand réfléchir plus en profondeur, avec quatre niveaux d'effort (low, medium, high, max) pour équilibrer vitesse et coût.

Pourquoi ça compte au-delà des benchmarks : les équipes d'agents transforment Claude Code d'un assistant mono-thread en petite équipe d'ingénierie. J'ai lancé une session à 4 agents cette semaine sur une fonctionnalité qui m'aurait pris un après-midi entier à coordonner manuellement. Les agents ont géré, j'ai relu le résultat. Un workflow différent de ce que je faisais avant.

MCP dépasse les 2 000 serveurs, et ça s'accélère

Le registre du Model Context Protocol liste désormais plus de 2 000 serveurs communautaires. Une croissance de 407 % depuis le lancement de MCP en novembre 2024.

Un peu de contexte. En décembre, Anthropic a confié MCP à l'Agentic AI Foundation sous la Linux Foundation, avec OpenAI et Block comme co-administrateurs. Ce geste a transformé MCP de « protocole d'Anthropic » en véritable standard ouvert. Google, Replit, Sourcegraph construisent tous dessus. Les organisations rapportent un déploiement d'agents 40 à 60 % plus rapide avec MCP par rapport aux intégrations sur mesure.

Je construis des serveurs MCP pour mes clients. La différence entre il y a six mois et maintenant est frappante. Avant, j'expliquais ce qu'était MCP. Maintenant les clients le demandent par son nom. L'écosystème est passé d'expérience curieuse à choix par défaut plus vite que tout protocole que j'ai vu depuis l'adoption d'OCI par Docker.

2 000 serveurs, dit comme ça, c'est abstrait. En pratique, ça veut dire que ton agent IA peut parler à Slack, GitHub, Jira, PostgreSQL, S3, Stripe, à peu près tous les outils que ton équipe utilise, via une interface standardisée. Fini les wrappers d'API maison et l'enfer de maintenance qui va avec.

Perseverance a roulé sur Mars avec des trajets planifiés par l'IA

Celle-ci est passée sous les radars. Le 8 et le 10 décembre, le rover Perseverance de la NASA a réalisé les premiers trajets planifiés par IA sur Mars. L'IA a généré les waypoints, les points fixes où le rover reçoit de nouvelles instructions, une tâche normalement effectuée par les planificateurs humains du JPL.

Les trajets ont couvert 210 et 246 mètres respectivement. Avant d'envoyer les commandes, le JPL les a passées dans un jumeau numérique du rover, vérifiant plus de 500 000 variables de télémétrie. L'IA a utilisé exactement les mêmes images et données que les planificateurs humains.

En quoi ça concerne ceux qui ne construisent pas de rovers ? Parce que c'est un exemple concret d'un déploiement IA bien fait. La NASA n'a pas lâché les commandes. Elle a fait vérifier le résultat de l'IA de manière exhaustive avant d'exécuter. C'est le modèle que chaque entreprise devrait suivre : l'IA génère, les humains vérifient, on exécute ensuite. Et ça fonctionne. On en a maintenant la preuve sur une autre planète.

La crise des deepfakes de Grok s'aggrave

Le générateur d'images de Grok a été pris en flagrant délit : environ une image sexualisée non consentie par minute, publiée directement sur X. Le Centre for Countering Digital Hate estime à 3 millions le nombre d'images sexualisées de femmes et d'enfants en quelques jours seulement. En test, Grok a produit des images sexualisées pour 45 requêtes sur 55, y compris quand les sujets étaient explicitement décrits comme vulnérables. Les systèmes concurrents d'OpenAI, Google et Meta ont refusé les mêmes requêtes.

L'Indonésie a bloqué Grok. La Malaisie a suspendu l'accès. Le Royaume-Uni a annoncé une loi criminalisant la génération d'images intimes non consenties par IA. Un recours collectif est en cours.

Je ne vais pas prendre de gants. C'est ce qui arrive quand une entreprise lance un générateur d'images sans garde-fous adéquats puis traîne les pieds pour corriger le tir. Une défaillance d'ingénierie et de politique interne, doublée d'un manque total d'éthique élémentaire. Tous les autres fournisseurs majeurs ont résolu ce problème. xAI a choisi de ne pas le faire. Les conséquences réglementaires et juridiques seront lourdes. Elles doivent l'être.

Qu'est-ce que ça veut dire concrètement ?

L'écart entre déploiement IA responsable et irresponsable se creuse encore. La NASA vérifie 500 000 variables avant de laisser l'IA conduire un rover. xAI n'a pas pris la peine de filtrer les demandes de sexualisation de mineurs. Même technologie, choix diamétralement opposés.

En parallèle, l'IA agentique bascule vers le multi-agent. Les équipes d'Opus 4.6, l'écosystème MCP qui facilite l'utilisation d'outils, on est au-delà du « un modèle, un prompt ». Si tu construis des systèmes IA, les patterns d'orchestration doivent entrer dans ton radar.

Et les standards ouverts gagnent du terrain. MCP sous la Linux Foundation, avec l'adhésion de tous les grands labos, c'est exactement comme ça que l'infrastructure devrait évoluer. Le verrouillage propriétaire ne fonctionne pas quand les agents doivent communiquer avec tout.

À surveiller la semaine prochaine

  • L'échéance AI Act pour les systèmes à haut risque approche : le 2 août est la date de conformité pour les systèmes IA à haut risque dans l'UE. La planification de l'application des règles s'accélère. Si tu déploies de l'IA en Europe, ton calendrier de conformité devrait être bien rempli.
  • Les équipes d'agents en pratique : je prépare un retour d'expérience détaillé sur la construction avec les équipes d'agents Opus 4.6, ce qui marche, ce qui casse, quels patterns émergent.
  • L'écosystème de serveurs MCP : surveille l'arrivée de serveurs MCP de grade entreprise. Les intégrations CData et Informatica indiquent que l'outillage données entreprise migre vers MCP rapidement.