Anthropic exécute environ 30 000 agents IA sur lui-même et bloque une action sur 47 000

L’article ne peut pas être activé avec JavaScript. Vous pouvez également activer JavaScript dans votre navigateur et sur la nouvelle page.

Anthropic a chiffré la part de sa propre entreprise gérée par des agents logiciels, et il s’agit d’un chiffre important. L’Anthropic Institute indique qu’en août 2026, « environ 30 000 agents effectuaient des travaux de recherche et d’ingénierie chez Anthropic à tout moment sur notre plateforme interne la plus utilisée ».

Le même article, publié le 17 septembre par Marina Favaro et Phillie Wright, expose ce qui surveille ces agents. Chaque action qu’ils entreprennent passe par un moniteur en ligne avant de s’exécuter, « généralement en quelques secondes », et un deuxième moniteur hors ligne lit ensuite l’intégralité de l’information.

Une action sur 47 000 est stoppée

Le taux de bloc est le chiffre qui se démarque. Anthropic a analysé plus d’un milliard de décisions d’agents en août 2026 et affirme que 0,002 % d’entre elles, « environ 1 sur 47 000 », ont été bloquées par le moniteur en ligne.

Cela peut être lu de deux manières, et Anthropic ne tranche pas le débat. Un blocage est le jugement du moniteur selon lequel une action ne devrait pas être exécutée, et non un préjudice confirmé, et le message ne dit pas quelles étaient les actions bloquées.

Le moniteur hors ligne est le réseau le plus lent, conçu pour un comportement qui se développe progressivement plutôt qu’en une seule commande. Il ingère chaque action après coup, signale « environ une à deux transcriptions sur mille » pour un examen plus approfondi et envoie les indicateurs de priorité la plus élevée, environ 50 par semaine, à une personne.

La sécurité a obtenu environ 6 % du calcul d’une semaine

Anthropic a également publié la division sur laquelle on l’interroge depuis des années : quelle part de son silicium sert à rendre les modèles plus sûrs plutôt que plus performants. Dans un instantané couvrant la période du 13 au 20 juillet 2026, « environ 6 % des calculs consacrés à la R&D en IA ont été alloués à la sécurité », ce qui s’élève à environ 12 % des calculs consacrés à la R&D en IA basée sur l’IA.

Ces deux pourcentages couvrent une semaine mesurée, et non l’année, et Anthropic les décrit comme des estimations prudentes. L’agent compte et le taux de blocage proviennent d’une fenêtre différente, août 2026, il s’agit donc d’instantanés de la même entreprise pris à quelques semaines d’intervalle plutôt que d’une image cohérente.

Tout cela est autodéclaré. Anthropic a mesuré ses propres systèmes avec sa propre méthodologie, et aucun tiers n’a audité les chiffres. La société affirme qu’elle prévoit de faire appel à des évaluateurs tiers indépendants ayant un accès comparable à celui de ses équipes internes de gestion des risques, ce qui permettra de vérifier des chiffres comme ceux-ci.

Les agents ne fonctionnent pas seuls

Une ligne du message fait beaucoup de travail : Claude « ne fonctionne pas de manière totalement autonome pour aucun sous-ensemble mesuré du travail de R&D en IA ». Anthropic classe son travail sur une échelle allant de AL0, sans implication de l’IA, à AL5, entièrement autonome, et rien de ce qu’il mesure ne se situe au sommet.

Le chiffre de 30 000 décrit donc des agents travaillant sous supervision sur une plateforme conçue pour les surveiller, et non une entreprise gérée elle-même. Cela correspond au chiffre du même article, selon lequel Claude a dirigé 26 % des travaux de recherche sur l’IA d’Anthropic en août, contre moins de 1 % en février 2026.

Pour les lecteurs extérieurs aux laboratoires d’IA, la valeur réside dans la forme de la divulgation plutôt que dans un pourcentage unique. Un laboratoire frontalier a publié le nombre d’agents qu’il exécute, la quantité de leurs résultats qu’il lit, la fréquence à laquelle il intervient et la quantité de calculs qu’il pointe vers la sécurité. En attendant que ces évaluateurs extérieurs soient en place, il évalue également ses propres devoirs.