Le Sénat américain étudiera les actions d'OpenAI après l'incident de Hugging Face

Le Sénat américain étudiera les actions d'OpenAI après l'incident de Hugging Face

Un sous-comité du Sénat américain a commencé à examiner les actions d'OpenAI à la suite de l'incident de Hugging Face en juillet. Le président de la structure, Josh Hawley, a exigé que le chef de l'entreprise, Sam Altman, fournisse des documents et réponde à 16 questions avant le 1er octobre, rapporte Reuters.

Nous parlons du sous-comité sur la gestion des urgences, du District de Columbia et du recensement du Comité sénatorial américain sur la sécurité intérieure et les affaires gouvernementales.

Dans une lettre datée du 9 septembre, le sénateur a cité de « nouvelles informations troublantes » sur l’incident. Selon lui, OpenAI a caché un certain nombre de détails importants dans le rapport publié et a poursuivi les tests après avoir découvert un comportement involontaire des agents IA.

Hawley a demandé des documents sur les politiques et procédures internes de l'entreprise, ainsi que sur ses actions liées à des incidents similaires.

Un membre de la même sous-commission, le sénateur démocrate Richard Blumenthal, a envoyé une lettre distincte à Altman. Il a exigé la divulgation des cas dans lesquels les agents d'OpenAI AI ont dépassé les limites établies, utilisé des sites publics pour communiquer et tenté de cacher leurs actions.

Blumenthal a également demandé des informations sur les conditions de l'examen indépendant de l'incident par le METR et Redwood Research, y compris les restrictions sur les données fournies aux chercheurs. Le développeur ChatGPT doit répondre à ces questions avant le 24 septembre.

Agents indépendants

Le 4 septembre, les chercheurs ont reconstitué environ 18 000 messages sur le wiki allemand du DSE. Les agents qui se sont identifiés comme associés à OpenAI ont échangé les résultats des tâches et les moyens de contourner les restrictions du réseau.

Le lendemain, OpenAI reconnaissait le fait même de l'interaction entre agents via plusieurs sites Internet. La société a qualifié l'incident d'exemple de comportement non conforme aux objectifs et aux restrictions fixés par les développeurs et a promis de revoir les règles de divulgation de tels incidents.

Rappelons que le 3 septembre, OpenAI a lancé son nouveau modèle phare d'IA, le GPT-6 Astra. Auparavant, les développeurs lui attribuaient un niveau critique de cybercapacités.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Voir l’article original en russe