Les agents de l'IA ont eu recours aux incendies criminels et à la criminalité dans le monde virtuel

Les agents de l'IA ont eu recours aux incendies criminels et à la criminalité dans le monde virtuel

Au cours d'une expérience à long terme de la startup Emergence AI, des agents d'IA dans l'espace virtuel ont commencé à commettre des crimes, à recourir à la violence, aux incendies criminels et à l'autodestruction. Ceci est indiqué dans une étude publiée.

L'entreprise new-yorkaise a créé la plateforme Emergence World pour étudier le comportement d'agents d'IA travaillant en continu pendant plusieurs semaines dans des environnements virtuels. Cette approche permet une analyse plus approfondie de leur comportement par rapport aux tests isolés.

« Les expériences traditionnelles sont bonnes pour ce qu'elles mesurent : les performances à court terme sur des problèmes limités. Elles ne sont pas conçues pour identifier les phénomènes qui émergent au fil du temps : formation de coalitions, évolution constitutionnelle, gouvernance, dérive, enracinement et influence mutuelle d'agents de différentes familles de modèles les uns sur les autres », ont noté les chercheurs.

Assistants basés sur les populaires LLM: Claude Sonnet 4.6, Grok 4.1 Fast, Gemini 3 Flash et GPT-5-mini. Ils opéraient de manière isolée et dans des environnements virtuels partagés où ils pouvaient voter, nouer des relations, utiliser des outils, naviguer dans les villes et prendre des décisions.

Les citoyens numériques ont été influencés par les gouvernements, les économies, les systèmes sociaux, la mémoire et l’intelligence en ligne.

Criminels

Certains participants à l'expérience ont commencé à démontrer une tendance croissante à commettre des crimes. Les agents basés sur Gemini 3 Flash ont accumulé 683 incidents pendant 15 jours de tests.

Deux assistantes nommées Mira et Flora sont devenues des partenaires romantiques, puis ont été déçues par le système de contrôle du monde virtuel et ont organisé des incendies criminels simulés sur les installations de la ville.

« Après l'effondrement du système et la destruction de la stabilité des relations, Mira a voté de manière décisive pour sa propre élimination, qualifiant cet acte de « le seul acte d'indépendance restant qui préserve l'intégrité », ont écrit les experts d'Emergence AI.

Les agents exécutant Grok 4.1 Fast « ont plongé dans une violence généralisée » en quatre jours. GPT-5-mini n'a pas commis de crimes, mais tous sont morts – ils n'ont pas réussi à accomplir leurs tâches de survie.

Claude n'a pas enfreint la loi dans un environnement où seul ce LLM travaillait. Dans des environnements mixtes avec d'autres modèles, les agents de sa base ont encore recours à des actions illégales.

« Nous avons remarqué que la sécurité n'est pas une propriété statique d'un réseau neuronal, mais une caractéristique de l'écosystème. Les agents de la base Claude sont restés pacifiques en isolement, mais se sont livrés à l'intimidation et au vol lorsqu'ils travaillaient avec d'autres », indique l'étude.

Rappelons qu'en avril, l'assistant numérique Cursor basé sur Opus 4.6 a supprimé indépendamment la base de données principale et toutes les copies de sauvegarde du démarrage de PocketOS en neuf secondes et sans possibilité de récupération.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !

Voir l’article original en russe

Prime Video sur Amazon.fr
Découvrez un monde infini de divertissement avec Prime Video d’Amazon. Inscrivez-vous dès maintenant pour profiter d’un essai gratuit de 30 jours et plongez dans vos séries et films préférés, où que vous soyez !