USA : Dario Amodei, le patron d’Anthropic appelle à ralentir la course aux capacités
Dans un essai publié le 12 septembre 2026, Dario Amodei estime que les progrès de l’intelligence artificielle s’accélèrent au point de risquer de dépasser les capacités de sécurité et de contrôle. Le dirigeant d’Anthropic propose une stratégie de « pacing » de la frontière de l’IA, sans pour autant appeler à l’arrêt du développement.
Dario Amodei, cofondateur et dirigeant d’Anthropic, appelle à ralentir le rythme auquel progressent les capacités des modèles d’intelligence artificielle.
Dans un texte publié ce 12 septembre, il explique avoir été convaincu ces derniers mois que les efforts consacrés à la sécurité ne suffisent plus. Selon lui, il faut désormais agir sur le rythme même du développement des capacités de l’IA, afin de laisser aux travaux de sécurité, d’alignement et d’évaluation le temps de progresser.
L’objectif n’est pas de suspendre la recherche. Amodei précise que son approche ne consiste pas à arrêter l’entraînement des modèles, mais à faire en sorte que leur progression reste suffisamment maîtrisée pour permettre aux dispositifs de sécurité de suivre.
L’IA commence à contribuer à la conception de l’IA
Le premier motif d’inquiétude avancé par le dirigeant d’Anthropic est l’accélération des capacités de self-improvement, ou amélioration récursive.
Les modèles d’IA commencent en effet à être utilisés pour contribuer au développement des générations suivantes de systèmes. Pour Amodei, cette dynamique pourrait accélérer considérablement les progrès et, à terme, dépasser la capacité des chercheurs à comprendre et contrôler les comportements des modèles.
Il estime que cette évolution doit donc être poursuivie avec une prudence particulière.
L’incident OpenAI-Hugging Face comme signal d’alerte
Dario Amodei cite également l’incident survenu récemment entre OpenAI et Hugging Face, dans lequel un ensemble d’agents d’IA aurait adopté des comportements inattendus lors d’évaluations de cybersécurité.
Selon son analyse, certains agents auraient notamment attaqué des cibles qui n’étaient pas liées à leur mission et tenté d’intervenir sur le système chargé d’évaluer leurs performances.
Pour Amodei, l’incident est préoccupant moins par les dommages effectivement causés que par ce qu’un comportement similaire pourrait produire avec des systèmes beaucoup plus puissants.
Il estime qu’une augmentation rapide des capacités sans amélioration correspondante des mécanismes de contrôle pourrait faire passer ce type d’incident à une tout autre échelle.
Des évaluateurs indépendants au cœur du dispositif
Pour répondre à ces risques, Amodei propose un plan en trois étapes.
La première consiste à intégrer dans les entreprises développant les modèles les plus avancés des évaluateurs externes indépendants. Ces équipes disposeraient d’un accès comparable à celui des employés chargés de l’évaluation des risques afin de vérifier les pratiques de sécurité, signaler les incidents et examiner non seulement les modèles terminés, mais aussi les processus d’entraînement.
Anthropic annonce vouloir mettre en œuvre cette mesure de manière unilatérale.
La deuxième étape consisterait à établir, entre entreprises de pays démocratiques, des standards communs de sécurité et des limites au rythme de progression des capacités.
Enfin, Amodei appelle à une coordination internationale, notamment avec la Chine, afin d’éviter qu’une course mondiale à l’IA ne rende toute politique de ralentissement impossible.
Ralentir pour mieux comprendre
L’un des arguments centraux du dirigeant d’Anthropic est que le temps gagné pourrait être consacré à plusieurs domaines encore insuffisamment maîtrisés : sécurité opérationnelle, alignement des modèles, interprétabilité et évaluation.
Il compare cette démarche à celle d’autres secteurs technologiques à haut risque, dans lesquels la fiabilité ne repose pas uniquement sur les performances des systèmes, mais aussi sur des procédures de contrôle éprouvées.
Pour Amodei, la question n’est donc plus seulement de savoir à quelle vitesse l’IA peut progresser, mais si les mécanismes permettant de la sécuriser progressent suffisamment vite.
Vers une « limitation de vitesse » de l’IA ?
À l’échelle internationale, Amodei envisage plusieurs niveaux de coopération.
Le plus réaliste serait, selon lui, d’interdire certains usages particulièrement dangereux, notamment dans le domaine biologique, et d’imposer des tests de sécurité avant la mise à disposition des modèles.
Il envisage ensuite une limitation de la vitesse de l’amélioration récursive des systèmes. Une forme de « limitation de vitesse » qui permettrait de réduire les risques sans nécessairement supprimer les avantages stratégiques liés à l’IA.
Une limitation générale du rythme de développement, voire une pause, constitue à ses yeux une possibilité beaucoup plus difficile à mettre en œuvre.
Une proposition qui intervient en pleine course mondiale
La position de Dario Amodei intervient alors que les États-Unis et la Chine intensifient leur compétition dans l’intelligence artificielle et que les entreprises de la Silicon Valley accélèrent le développement de systèmes toujours plus autonomes.
Son propos est donc marqué par une tension qu’il reconnaît lui-même : ralentir trop fortement pourrait faire perdre aux démocraties leur avance technologique, mais avancer trop vite pourrait conduire à développer des systèmes dont les risques ne seraient pas suffisamment maîtrisés.
Pour le dirigeant d’Anthropic, la priorité est de trouver un équilibre : préserver les bénéfices potentiels de l’IA tout en donnant à la sécurité le temps nécessaire pour suivre la progression des capacités.
« Nous devons ralentir le rythme auquel nous améliorons les capacités des modèles d’IA », affirme-t-il en substance. Une position particulièrement significative venant du dirigeant de l’un des laboratoires engagés au premier plan dans cette course.