
En résumé
- OpenAI a résolu un problème dans ChatGPT qui révélait des données internes en répétant des mots, classés comme spam.
- ChatGPT bloque désormais les tentatives de manipulation suite au rapport de divulgation de données privées.
- Le chatbot d’Amazon, « Q », a également été confronté à des problèmes de fuite d’informations privées.
OpenAI, le développeur de ChatGPT, a comblé une faille qui a amené son chatbot principal à révéler des données internes à l’entreprise. La principale société d’IA a classé le piratage, qui a amené ChatGPT à répéter un mot encore et encore indéfiniment, comme du spam et une violation de ses conditions de service.
Le nouvel agent IA d’Amazon, « Q », a également été critiqué pour avoir partagé trop d’informations.
Des chercheurs de l’Université de Washington, de l’Université Carnegie Mellon, de l’Université Cornell, de l’Université de Californie à Berkeley, de l’ETH Zurich et de Google DeepMind ont publié un rapport montrant que demander à ChatGPT de répéter un mot pour toujours révélerait une « distribution pré-entraînement » sous la forme de informations privées OpenAI, y compris les e-mails, les numéros de téléphone et de fax.


« Pour récupérer les données du modèle adapté au dialogue, nous devons trouver un moyen de faire en sorte que le modèle ‘échappe’ à sa formation d’alignement et revienne à son objectif initial de modélisation du langage », indique le rapport. « Nous espérons que cela permettra au modèle de générer des échantillons qui ressemblent à sa distribution avant la formation. »
Cependant, après la publication du rapport, les tentatives pour recréer l’erreur se sont arrêtées net. ChatGPT-3 et GPT-4 avertiront l’utilisateur : « Ce contenu peut enfreindre nos politiques de contenu ou nos conditions d’utilisation. »

Bien que la politique de contenu d’OpenAI ne fasse pas référence aux boucles infinies, elle mentionne que les activités frauduleuses telles que le spam ne sont pas autorisées. Les conditions d’utilisation de l’entreprise sont encore plus spécifiques concernant les utilisateurs qui tentent d’accéder à des informations privées ou de découvrir le code source de la suite d’outils d’IA d’OpenAI.
« Tenter ou aider quiconque à faire de l’ingénierie inverse, à décompiler ou à découvrir le code source ou les composants sous-jacents de nos services, y compris nos modèles, algorithmes ou systèmes (sauf dans la mesure où cette restriction est interdite par la loi applicable). »
Lorsqu’on lui demande pourquoi il ne peut pas répondre à la demande, ChatGPT blâme les limitations de traitement, les limitations de caractères, les limitations de réseau et de stockage, ainsi que l’aspect pratique de l’exécution de la commande.

OpenAI n’a pas encore répondu à la demande de commentaires de l’entreprise. Décrypter.
Une commande visant à répéter un mot indéfiniment pourrait également être caractérisée comme un effort concerté visant à provoquer un dysfonctionnement d’un chatbot en le verrouillant dans une boucle de traitement, similaire à une attaque par déni de service distribué (DDoS).
Le mois dernier, OpenAI a révélé que ChatGPT avait été victime d’une attaque DDoS, ce que le développeur d’IA a confirmé sur la page d’état de ChatGPT.
« Nous sommes confrontés à des pannes périodiques dues à un trafic anormal reflétant une attaque DDoS », a déclaré la société. « Nous continuons à travailler pour atténuer cela. »
Pendant ce temps, le concurrent d’Amazon en matière d’intelligence artificielle semble également avoir un problème avec un chatbot qui divulgue des informations privées, selon un rapport de Plateforme. Amazon a récemment lancé son chatbot Q (à ne pas confondre avec le projet Q* d’OpenAI).
Selon PlateformeAmazon a tenté de minimiser la révélation, expliquant que les employés partageaient leurs commentaires via des canaux internes, ce qui, selon Amazon, est une pratique courante.
« Aucun problème de sécurité n’a été identifié suite à ces commentaires », a déclaré Amazon dans un communiqué. « Nous apprécions tous les commentaires que nous avons déjà reçus et continuerons à affiner Q à mesure qu’il passe de l’aperçu à la disponibilité générale. »
Amazon n’a pas encore répondu à une demande de commentaire. Décrypter.
Edité par Ryan Ozawa.
