Le modèle de cyber-IA GPT-5.5 d'OpenAI bat le modèle Mythos interdit d'Anthropic, et personne ne l'arrête

Le modèle de cyber-IA GPT-5.5 d'OpenAI bat le modèle Mythos interdit d'Anthropic, et personne ne l'arrête

En résumé

  • OpenAI a publié GPT-5.5-Cyber ​​​​avec 85,6 % sur CyberGym, battant Mythos 5 d'Anthropic qui a obtenu 83,8 %.
  • Mythos 5 et Fable 5 d'Anthropic restent hors ligne suite à une directive d'urgence de sécurité nationale.
  • OpenAI a signé des alliances de cyberdéfense avec sept pays et 28 sociétés de sécurité telles que CrowdStrike et Cisco.

Le modèle de cybersécurité d'OpenAI vient de surpasser le modèle d'IA Mythos d'Anthropic, que le gouvernement américain a mis hors ligne, et il est toujours opérationnel.

Le 22 juin, OpenAI a annoncé la sortie complète de GPT-5.5-Cyber ​​​​dans le cadre de son programme de cyberdéfense Daybreak. Dans CyberGym, un benchmark développé à l'Université de Berkeley qui présente aux agents d'IA 1 507 vulnérabilités logicielles connues issues de 188 projets open source et les évalue en fonction du nombre de vulnérabilités qu'ils peuvent reproduire dans un environnement contrôlé, le modèle mis à jour a obtenu un score de 85,6 %.

Mythos 5 d'Anthropic se situe à 83,8% dans le même classement. Claude Opus 4.7, le modèle le plus largement disponible d'Anthropic, a obtenu un score de 73,1 %.

Une différence de moins de deux points dans un indice de référence ne serait normalement pas notable. Cependant, le contexte ici est différent. Mythos 5 et Fable 5 d'Anthropic ont été mis hors ligne le 12 juin après que l'administration de Donald Trump a publié une directive d'urgence sur le contrôle des exportations invoquant la sécurité nationale.

Le gouvernement a signalé un jailbreak, une technique permettant de contourner les limites de sécurité intégrées d'un modèle d'IA, semblable à la recherche d'une clé principale qui ouvre une porte de haute sécurité. Anthropic ne disposait d'aucun moyen fiable pour vérifier la nationalité des utilisateurs à grande échelle, c'est pourquoi il a désactivé les deux modèles pour tout le monde, partout.

Une partie des dégâts a été auto-infligée. Anthropic a passé des mois à décrire Mythos comme l'un des modèles d'IA les plus performants et les plus dangereux jamais construits, avertissant dans sa propre documentation que ses capacités de cybersécurité pourraient causer de graves dommages sans restrictions appropriées. Le PDG d'Anthropic, Dario Amodei, a publié le 10 juin un essai comparant les modèles d'IA frontaliers aux avions que les régulateurs de sécurité devraient pouvoir immobiliser au sol s'ils échouent aux audits.

Quelques jours plus tard, le gouvernement a cloué au sol l'avion d'Anthropic.

Ce n'était pas la seule alarme cette semaine-là. Anthropic avait déjà été critiqué pour un filtre caché dans Fable 5 qui rétrogradait silencieusement les réponses des modèles pour les utilisateurs soupçonnés de construire une IA concurrente – sans les en informer – et a été contraint de s'excuser et d'annuler la politique.

Une approche différente

Alors qu’Anthropic négocie avec le ministère du Commerce et poursuit son procès contre l’administration Trump, OpenAI étend sa portée. Daybreak a signé des alliances de cybersécurité avec l'Australie, le Canada, la France, l'Allemagne, le Japon, la Corée du Sud et les institutions de l'UE, dont l'Agence de cybersécurité de l'Union européenne.

Vingt-huit sociétés de sécurité, dont CrowdStrike, Cisco et Cloudflare, ont rejoint son programme Cyber ​​​​Partner pour intégrer GPT-5.5 dans leurs produits destinés aux clients vérifiés. Selon le propre blog d'OpenAI, l'outil Codex Security a analysé plus de 30 millions de commits dans 30 000 bases de codes et a enregistré plus de 500 000 vulnérabilités corrigées depuis son lancement en mars.

La société étend également son programme de partenariat afin que les sociétés de sécurité puissent intégrer ces capacités dans leurs propres outils, et a lancé « Patch the Planet », une initiative visant à corriger les vulnérabilités des projets open source largement utilisés.

Cela dit, GPT-5.5-Cyber ​​​​n'est pas disponible pour un usage général. Il n'est disponible que pour les professionnels de la sécurité vérifiés, et OpenAI a effectué des tests préalables au déploiement avec des agences fédérales, notamment le Center for AI Standards and Innovation et le Bureau du directeur national de la cybersécurité, avant son lancement. Il s'agit de la même approche d'accès restreint qu'Anthropic a essayée avec Mythos, mais OpenAI a d'abord obtenu l'approbation du gouvernement.

Depuis le 23 juin, Fable 5 et Mythos 5 restent hors ligne, onze jours après une suspension sans date de restauration officielle d'Anthropic ou du ministère du Commerce.

Débriefing quotidien Bulletin

Commencez chaque journée avec les principales actualités du moment, ainsi que des fonctionnalités originales, un podcast, des vidéos et bien plus encore.

Voir l’article original en espagnol