
Les membres de l’équipe Anthropic externalisent de plus en plus une grande partie du développement de nouveaux modèles vers des systèmes d’IA. L’entreprise y a vu le signe d’une approche d’auto-amélioration récursive.
Selon des données internes, plus de 80 % du code des produits actuels de l'entreprise a été écrit par Claude. Dans le même temps, au deuxième trimestre, le volume de code par ingénieur a été multiplié par huit par rapport à 2024.

Marina Favaro, PDG de l'Anthropic Institute, et Jack Clark, co-fondateur de l'entreprise, ont écrit qu'avec suffisamment d'informatique, cette tendance pourrait conduire à un système capable de « concevoir et développer de manière totalement autonome son successeur ».
« Nous n'avons pas encore atteint le point de non-retour, et l'auto-amélioration récursive n'est pas inévitable. Mais elle pourrait survenir avant que la plupart des institutions ne soient prêtes », ont souligné les experts.
Benchmarks et mesures
En avril, Claude a réalisé plus de 800 réparations, un exploit qui, selon l'ingénieur superviseur, prendrait quatre ans à un être humain.
Sur les tâches ouvertes, le taux de réussite des sessions de Claude est passé à 76 % en mai 2026, soit une augmentation de 50 points de pourcentage sur six mois.

Anthropic a déclaré que la durée des tâches que l'IA peut effectuer seule de manière fiable double environ tous les quatre mois (contre les sept précédents).
Dans le but d'accélérer la formation d'un petit modèle d'IA, Claude Opus 4 en mai 2025 a donné en moyenne une augmentation de vitesse d'environ trois fois, et Mythos Preview en avril 2026 – environ 52 fois.

Lors de tests internes, le modèle Mythos Preview a démontré sa capacité à résoudre des problèmes de recherche dans le domaine de la sécurité de l'IA. En 800 heures de travail, l'équipe d'agents a comblé 97 % de l'écart problématique de l'expérience, tandis que deux chercheurs humains n'ont complété que 23 % du volume en une semaine.
De nouveaux goulots d'étranglement
Malgré les progrès du codage, les humains conservent un avantage en matière de « jugement exploratoire » et de définition d’objectifs stratégiques.
Anthropic estime que dans un avenir proche, le rôle des développeurs passera de l'écriture de lignes de code à l'examen approfondi des résultats d'un réseau neuronal. C’est la vérification humaine qui peut devenir le principal frein à la rapidité de développement de nouveaux modèles.
La société a également admis que le monde gagnerait à pouvoir ralentir ou suspendre temporairement le développement de systèmes d’IA avancés pour permettre aux institutions publiques et à la recherche d’alignement de suivre le rythme des progrès.
Dans le même temps, les représentants de la startup ont prévenu : un ralentissement unilatéral pourrait jouer en défaveur de ceux qui ralentissent – les acteurs les moins prudents pourront réduire l'écart. Sans un mécanisme de coordination mondial, les décisions en matière de sécurité devront être prises sous des pressions concurrentielles et géopolitiques.
Rappelons qu'en mai, Anthropic a publié le premier rapport sur le projet Glasswing, un programme de recherche de vulnérabilités utilisant le modèle Claude Mythos.
Le même mois, la société a publié Claude Opus 4.8 et a introduit séparément une fonctionnalité de flux de travail dynamiques pour Claude Code.
Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE
Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !
Voir l’article original en russe
