
Anthropic a publié Claude Opus 4.8 et a introduit séparément la fonctionnalité de flux de travail dynamiques pour Claude Code.
Présentation de Claude Opus 4.8 : il s'appuie sur l'Opus 4.7 avec un jugement plus aiguisé, plus d'honnêteté quant à ses propres progrès et la capacité de travailler de manière indépendante plus longtemps que ses prédécesseurs.
Disponible aujourd'hui au même prix. pic.twitter.com/EufxL7T1kb
–Claude (@claudeai) 28 mai 2026
L'outil permet à l'IA elle-même d'écrire des scripts d'orchestration qui lancent des dizaines ou des centaines de sous-agents parallèles, et de vérifier le travail avant de transmettre le résultat à l'utilisateur.
Il est conçu pour des tâches complexes dans des bases de codes volumineuses : audits de sécurité, détection d'erreurs, migration entre frameworks et langages de programmation, modernisation de projets.
La fonctionnalité est disponible en mode aperçu dans la CLI Claude Code, version bureau et extension VS Code, via APIainsi qu'Amazon Bedrock, Vertex AI et Microsoft Foundry.
Vous pouvez démarrer le mode avec une commande directe pour créer un flux de travail ou via ultracode. Cela augmente le niveau d'effort de calcul au maximum et permet au modèle de décider indépendamment quand engager un circuit à plusieurs étapes.
Anthropic a averti que les flux de travail dynamiques consomment beaucoup plus de jetons qu'une session Claude Code standard.
Le modèle divise le problème en sous-tâches, les répartit entre des agents parallèles, puis combine les conclusions après vérification mutuelle et tente de réfuter les solutions trouvées.
A titre d'exemple, Anthropic a cité le transfert Chignon du langage de programmation Zig à Rust. Le développeur Jared Sumner a utilisé des flux de travail dynamiques pour générer environ 750 000 lignes de code Rust. Le portage a réussi 99,8 % de la suite de tests existante et a pris 11 jours entre le premier engagement et la fusion. Dans le même temps, Anthropic a précisé que la version n'est pas encore utilisée en production.
Indicateurs du nouveau modèle Opus 4.8 :
- 69,2 % dans SWE-Bench Pro ;
- 49,8 % au Dernier examen de l'humanité sans outils et 57,9 % avec eux ;
- 83,4 % dans OSWorld-Verified ;
- 1890 points en GDPval-AA ;
- 53,9 % dans Agent financier v2.
Dans Terminal-Bench 2.1, Opus 4.8 était inférieur à GPT-5.5 – 74,6 % contre 78,2 %.
Anthropic a déclaré qu'Opus 4.8 est devenu sensiblement plus « honnête » lors de l'exécution de tâches basées sur des agents : le modèle est plus susceptible d'indiquer une incertitude, déclare moins souvent des progrès non confirmés et est plus efficace pour repérer les problèmes dans son propre code avant de transmettre le résultat à l'utilisateur.
Rappelons qu'en mai, Anthropic a publié le premier rapport sur le projet Glasswing, un programme de recherche de vulnérabilités utilisant le modèle Claude Mythos.
Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE
Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !
