Anthropic met en garde contre les risques liés à l’auto-amélioration de l’IA

Anthropic met en garde contre les risques liés à l’auto-amélioration de l’IA

Les membres de l’équipe Anthropic externalisent de plus en plus une grande partie du développement de nouveaux modèles vers des systèmes d’IA. L’entreprise y a vu le signe d’une approche d’auto-amélioration récursive.

Selon des données internes, plus de 80 % du code des produits actuels de l'entreprise a été écrit par Claude. Dans le même temps, au deuxième trimestre, le volume de code par ingénieur a été multiplié par huit par rapport à 2024.

Capture d'écran 2026-06-05 111829Capture d'écran 2026-06-05 111829
Source : Institut Anthropique.

Marina Favaro, PDG de l'Anthropic Institute, et Jack Clark, co-fondateur de l'entreprise, ont écrit qu'avec suffisamment d'informatique, cette tendance pourrait conduire à un système capable de « concevoir et développer de manière totalement autonome son successeur ».

« Nous n'avons pas encore atteint le point de non-retour, et l'auto-amélioration récursive n'est pas inévitable. Mais elle pourrait survenir avant que la plupart des institutions ne soient prêtes », ont souligné les experts.

Benchmarks et mesures

En avril, Claude a réalisé plus de 800 réparations, un exploit qui, selon l'ingénieur superviseur, prendrait quatre ans à un être humain.

Sur les tâches ouvertes, le taux de réussite des sessions de Claude est passé à 76 % en mai 2026, soit une augmentation de 50 points de pourcentage sur six mois.

Capture d'écran 2026-06-05 113941Capture d'écran 2026-06-05 113941
Source : Institut Anthropique.

Anthropic a déclaré que la durée des tâches que l'IA peut effectuer seule de manière fiable double environ tous les quatre mois (contre les sept précédents).

Dans le but d'accélérer la formation d'un petit modèle d'IA, Claude Opus 4 en mai 2025 a donné en moyenne une augmentation de vitesse d'environ trois fois, et Mythos Preview en avril 2026 – environ 52 fois.

Capture d'écran 2026-06-05 113843Capture d'écran 2026-06-05 113843
Source : Institut Anthropique.

Lors de tests internes, le modèle Mythos Preview a démontré sa capacité à résoudre des problèmes de recherche dans le domaine de la sécurité de l'IA. En 800 heures de travail, l'équipe d'agents a comblé 97 % de l'écart problématique de l'expérience, tandis que deux chercheurs humains n'ont complété que 23 % du volume en une semaine.

De nouveaux goulots d'étranglement

Malgré les progrès du codage, les humains conservent un avantage en matière de « jugement exploratoire » et de définition d’objectifs stratégiques.

Anthropic estime que dans un avenir proche, le rôle des développeurs passera de l'écriture de lignes de code à l'examen approfondi des résultats d'un réseau neuronal. C’est la vérification humaine qui peut devenir le principal frein à la rapidité de développement de nouveaux modèles.

La société a également admis que le monde gagnerait à pouvoir ralentir ou suspendre temporairement le développement de systèmes d’IA avancés pour permettre aux institutions publiques et à la recherche d’alignement de suivre le rythme des progrès.

Dans le même temps, les représentants de la startup ont prévenu : un ralentissement unilatéral pourrait jouer en défaveur de ceux qui ralentissent – les acteurs les moins prudents pourront réduire l'écart. Sans un mécanisme de coordination mondial, les décisions en matière de sécurité devront être prises sous des pressions concurrentielles et géopolitiques.

Rappelons qu'en mai, Anthropic a publié le premier rapport sur le projet Glasswing, un programme de recherche de vulnérabilités utilisant le modèle Claude Mythos.

Le même mois, la société a publié Claude Opus 4.8 et a introduit séparément une fonctionnalité de flux de travail dynamiques pour Claude Code.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !

Voir l’article original en russe

Amazon music unlimited
Rejoignez dès maintenant Amazon Music Unlimited et plongez dans un univers de 100 millions de titres sans publicité. Profitez de 30 jours d’essai gratuit pour une expérience musicale inégalée !