Anthropic réactive Claude Fable 5 après la levée des contrôles à l'exportation aux États-Unis

Anthropic réactive Claude Fable 5 après la levée des contrôles à l'exportation aux États-Unis

En résumé

  • Anthropic a réactivé Claude Fable 5 mercredi suite à la levée des contrôles à l'exportation en place depuis le 12 juin.
  • Un jailbreak découvert par Amazon a forcé la désactivation du modèle ; un nouveau filtre bloque plus de 99 % des tentatives.
  • Pendant la panne, le GPT-5.5-Cyber ​​​​d'OpenAI a surpassé Mythos 5 dans le benchmark CyberGym de l'UC Berkeley.

Claude Fable 5 est de retour. Anthropic a annoncé que le modèle serait à nouveau disponible mercredi pour les utilisateurs du monde entier via Claude.ai, Claude Platform, Claude Code et Claude Cowork, après que le ministère américain du Commerce a levé les contrôles à l'exportation qui le mettaient hors ligne depuis le 12 juin.

Mythos 5, le modèle frère le plus performant construit sur le même système sous-jacent, restera limité aux partenaires vérifiés.

« Le vendredi 12 juin, le gouvernement américain a appliqué des contrôles à l'exportation sur nos nouveaux modèles, les Claude Fable 5 et Claude Mythos 5. Cela nous a obligés à restreindre l'accès aux ressortissants étrangers, tant à l'intérieur qu'à l'extérieur des États-Unis », a écrit Anthropic dans un article de blog mardi soir. « À compter d'aujourd'hui, 30 juin, les contrôles à l'exportation sur Fable 5 et Mythos 5 ont été levés. »

L'arrêt provient d'un rapport de jailbreak rédigé par des chercheurs d'Amazon, qui ont trouvé un moyen de contourner les protections de Fable 5 et d'amener le modèle à identifier les vulnérabilités logicielles. Dans un cas, le modèle a produit un code montrant comment exploiter l’un d’entre eux. Étant donné que l’ordre d’exportation s’appliquait à tous les citoyens étrangers partout dans le monde et qu’Anthropic n’avait aucun moyen de vérifier la nationalité utilisateur par utilisateur en temps réel, la société a désactivé les deux modèles pour tous les utilisateurs plutôt que de risquer de violer la réglementation.

Dans le rapport, Anthropic explique que sa solution est un classificateur de sécurité recyclé, spécialement conçu pour détecter la technique signalée. La société a déclaré qu'elle bloque désormais ce contournement dans plus de 99 % des tentatives, et que toute demande signalée dans Fable 5 est automatiquement redirigée vers Claude Opus 4.8 avec une notification à l'utilisateur.

Les chercheurs du Centre de normes et d'innovation en IA du ministère du Commerce ont examiné les nouvelles et anciennes mesures de protection et les ont qualifiées d'extraordinairement solides, bien qu'Anthropic ait reconnu que le filtre plus strict serait également sujet aux fausses alarmes.

En d’autres termes, la Fable, déjà stricte et prudente, sera encore plus prudente de par sa conception.

Les détails d’accès varient selon le plan. Les abonnés Pro, Max, Team et certains Enterprise bénéficient de Fable 5 inclus jusqu'à la moitié de leurs limites d'utilisation hebdomadaires jusqu'au 7 juillet, après quoi il passera aux crédits d'utilisation, ce qui signifie que la nouvelle fenêtre est plus petit que l'original : six jours avec un plafond de 50 % contre 13 jours avec une inclusion complète. En fin de compte, les utilisateurs bénéficient d'un accès moins gratuit que ce qu'ils auraient eu sans l'interdiction, même en comptant la deuxième fenêtre, ce qui permet à Anthropic d'économiser tout ce budget informatique.

La disponibilité sur AWS, Google Cloud et Microsoft Foundry arrivera « le plus rapidement possible », selon l'entreprise, laissant les déploiements d'entreprise hébergés dans le cloud attendre un peu plus longtemps que les applications natives de Claude.

La panne d’électricité a donné une opportunité aux rivaux. Alors que Mythos et Fable étaient hors ligne, GPT-5.5-Cyber ​​​​d'OpenAI a surpassé Mythos dans CyberGym, un benchmark de l'UC Berkeley qui teste les agents d'IA par rapport à 1 507 vulnérabilités connues dans 188 projets open source et les note en fonction du nombre qu'ils peuvent reproduire avec succès.

GPT-5.5-Cyber ​​​​a atteint 85,6% contre 83,8% pour Mythos 5, un écart auquel Anthropic n'a pas pu répondre immédiatement car son modèle n'était pas disponible pour le déploiement. Les entreprises chinoises ont également profité de cette pause pour développer leurs propres systèmes de détection de vulnérabilité, Qihoo 360 introduisant Tulong Feng et Z.ai lançant des alternatives de poids ouvertes.

Il a également été démontré que les alternatives de routage intelligent avec des LLM plus faibles offrent des résultats similaires à ceux rapportés par Mythos, les dépassant même dans certains cas.

Anthropic propose désormais une méthode partagée pour évaluer les futurs jailbreaks aux côtés d'Amazon, Microsoft et Google, en évaluant chacun en fonction du gain de capacité, de la portée, de la facilité d'armement et de la découvrabilité. Il s'est également engagé à donner au gouvernement un accès rapide aux tests de modèles frontières et à leurs garanties avant leur diffusion publique, et a ouvert un nouveau programme sur HackerOne permettant aux chercheurs de signaler directement les techniques de contournement de Fable 5.

Débriefing quotidien Bulletin

Commencez chaque journée avec les principales actualités du moment, ainsi que des fonctionnalités originales, un podcast, des vidéos et bien plus encore.

Voir l’article original en espagnol

Prime Video sur Amazon.fr
Découvrez un monde infini de divertissement avec Prime Video d’Amazon. Inscrivez-vous dès maintenant pour profiter d’un essai gratuit de 30 jours et plongez dans vos séries et films préférés, où que vous soyez !