🔬 Claude pilote 26% de la R&D d'Anthropic

Anthropic annonce que Claude mène 26% de sa R&D en IA, contre moins de 1% en février. Environ 30 000 agents internes, mais toujours des humains dans la boucle.

Date : 2026-09-17

Tags : Anthropic, Claude, Gouvernance IA, Agent IA, Innovation

![Graphique Anthropic : Claude mène 26% des tâches de R&D sur les modèles, contre moins de 1% en février 2026](https://www-cdn.anthropic.com/images/4zrzovbb/website/31704b297a9350f392f143ea078561f36cd14908-1920x1230.png) Le 17 septembre 2026, Anthropic a publié ses premières mesures détaillées sur la part de la recherche en IA réalisée par Claude lui-même. Le chiffre qui circule est 26%, mais il cache une nuance importante. Voici ce que l'annonce dit vraiment. ## Que veut dire « Claude mène 26% de la R&D » chez Anthropic ? Anthropic a construit un « R&D Automation Index », un indice qui recense les tâches de recherche et développement de l'entreprise et note à quel point chacune est automatisée. L'échelle vient d'Epoch AI, un organisme indépendant, et va de AL0 (aucune IA) à AL5 (IA totalement autonome, sans humain dans la boucle). Claude « mène » une tâche au niveau AL4, c'est-à-dire qu'il la réalise presque entièrement à partir d'une consigne de haut niveau, pendant qu'un humain supervise. Fin août 2026, 26% du travail de R&D sur les modèles était à ce niveau, contre moins de 1% en février, et plus de 90% était au moins en mode collaboration (AL3). Aucune tâche mesurée n'a atteint AL5, donc Claude n'est pas en train de construire seul son successeur. Sur la plateforme interne la plus utilisée, environ 30 000 agents travaillent en parallèle, et 100% de leurs actions passent par un moniteur avant exécution. | Mesure (août 2026) | Résultat | |---|---| | Tâches de R&D menées par Claude (AL4) | 26% (moins de 1% en février) | | Tâches en collaboration ou mieux (AL3 et plus) | plus de 90% | | Tâches totalement autonomes (AL5) | 0% | | Agents internes actifs en même temps | environ 30 000 | | Décisions d'agents bloquées | 0,002% sur plus d'un milliard, soit 1 sur 47 000 | | Compute de R&D dédié à la sécurité (semaine du 13 au 20 juillet) | environ 6% (12% pour la R&D pilotée par l'IA) | > « minimiser l'écart entre ce que savent les laboratoires de pointe et ce que sait le public » *Marina Favaro et Phillie Wright, Anthropic Institute* Ces chiffres sont mesurés par Anthropic lui-même, et c'est leur principale limite. Pour construire l'indice, un agent Claude a listé environ 15 000 tâches à partir des messages Slack et de la documentation interne, puis un autre Claude a attribué les niveaux d'automatisation. Anthropic reconnaît que ce juge peut reproduire les erreurs du modèle qu'il évalue, et précise que son accord exact avec les humains atteint 59%, contre 35% entre humains eux-mêmes. L'entreprise annonce vouloir installer des évaluateurs indépendants en interne, avec un accès comparable à celui de ses équipes de risque, et invite les autres laboratoires à publier des mesures équivalentes. Cette publication arrive après l'appel de Dario Amodei à « pacer » le développement des modèles de pointe, c'est-à-dire à le ralentir de façon coordonnée. Pour les dirigeants et les équipes qui déploient des agents, le signal est clair : mesurer et superviser ce que font les agents devient une pratique de gouvernance, pas un détail technique. --- **Sources** - [Measurements for understanding the pace of AI development inside frontier labs, Anthropic](https://www.anthropic.com/institute/measuring-pace-of-ai-development) - [Claude leads 26% of Anthropic's AI research, lab says, Resultsense](https://www.resultsense.com/news/2026-09-18-anthropic-ai-rd-automation-metrics/) - [Anthropic says Claude leads 26% of its AI R&D work, Quartz](https://qz.com/anthropic-claude-ai-research-development-automation-091826)