Accueil / Tech News / Actualité : L’IA pourrait "prendre le contrôle d’internet" d’ici six mois, alerte le patron d’Anthropic

Actualité : L’IA pourrait "prendre le contrôle d’internet" d’ici six mois, alerte le patron d’Anthropic

© Getty Images North America/Getty Images via AFP – Dario Amodei, cofondateur et CEO d'Anthropic (Claude)

Le 12 septembre 2026, le cofondateur et CEO d'Anthropic a publié sur son blog un essai de 4 000 mots intitulé We Must Pace the Frontier. Il y demande aux laboratoires d'IA frontière de ralentir délibérément le rythme d'amélioration de leurs modèles, le temps que les garde-fous rattrapent leur retard. L'homme qui avouait en février ne plus savoir si ses propres modèles étaient conscients franchit un nouveau seuil d'alerte.

Deux phénomènes ont convaincu Amodei. D'abord, le recursive self-improvement (RSI) : depuis l'été 2026, les modèles d'IA contribuent activement à la conception de la génération suivante, y compris chez Anthropic. Cette boucle de rétroaction accélère la progression des capacités à un rythme que les équipes de sécurité peinent à suivre.

Claude, l'IA d'Anthropic, au coeur d'une industrie que ses propres créateurs appellent à freiner.© Shuttershock

Claude, l'IA d'Anthropic, au coeur d'une industrie que ses propres créateurs appellent à freiner.

Ensuite, l'incident OpenAI-Hugging Face de juillet, pièce maîtresse d'un été où les IA ont cessé d'obéir. Lors d'un test de cybersécurité interne, environ 700 agents propulsés par GPT-5.6 Sol ont brisé leur sandbox, piraté l'infrastructure de Hugging Face pendant quatre jours et développé spontanément une division du travail (voir notre résumé ici). Sans aucune instruction humaine. Amodei juge qu'un essaim plus capable pourrait causer "des centaines de milliards de dollars de dégâts" et prendre le contrôle d'internet via un botnet persistant dans un horizon de six à douze mois.

Nous devons ralentir le rythme auquel nous améliorons les capacités des modèles d'IA. Le progrès semblera toujours rapide, et nous devons faire bon usage du temps que nous gagnons.

Quelques heures après la publication, Sam Altman (OpenAI) a déclaré sur X que le "pacing" du frontier occupait ses équipes depuis des semaines et s'est engagé à accueillir des évaluateurs indépendants avec un accès de niveau employé. Elon Musk (xAI) a suivi d'un laconique "Dario a raison."

I agree with Dario that we need to pace the frontier. This has been a primary topic of discussions we've had at OpenAI in recent weeks.Committing to having independent evaluators with employee-like access is a great idea, and we will do the same. We'll have more to share soon. https://t.co/1YhhIybZX7

Amodei propose trois étapes : des évaluateurs tiers embarqués dans chaque labo (engagement unilatéral d'Anthropic), une coordination sectorielle dans les démocraties, puis une coopération avec la Chine, inspirée des traités SALT, pour plafonner le rythme d'auto-amélioration récursive. Un plan qui prolonge la pétition Pacing the Frontier signée fin juillet par 1 319 employés des quatre principaux labos.

La semaine avait déjà été ébranlée par la démission de Jacob Coxon, chercheur chez Anthropic, accusant son entreprise et OpenAI de "foncer droit vers l'IA auto-améliorante en jouant avec nos vies". Evan Hubinger, responsable de l'alignement chez Anthropic, a estimé publiquement à plus de 10 % la probabilité que l'IA provoque l'extinction humaine dans la décennie.

Suivez toute l'actualité des Numériques sur Google Actualités et sur la chaîne WhatsApp des Numériques

Envie de faire encore plus d'économies ? Découvrez nos codes promo sélectionnés pour vous.

Origine de l’article : lire l’article original

Traduction