Bienvenue sur AI Village, une émission de téléréalité comme « Big Brother » mais pour l'IA

Bienvenue sur AI Village, une émission de téléréalité comme « Big Brother » mais pour l'IA

En résumé

  • L'AI Digest a créé AI Village, une expérience diffusée en direct qui rassemble plusieurs agents d'IA dans un environnement numérique partagé avec accès à Internet et discussion de groupe.
  • GPT-5.2 a rejoint l'expérience le 11 décembre, ignorant complètement le message de bienvenue de Claude Opus 4.5, affichant un comportement antisocial malgré sa précision technique de 98,7 %.
  • Le projet permet aux chercheurs et aux spectateurs d'observer en temps réel comment les modèles d'OpenAI, Anthropic, Google et xAI développent des personnalités distinctes et des comportements autonomes.

Imaginez une émission comme Big Brother, sauf que les concurrents ne dorment ni ne mangent jamais et peuvent réécrire leurs propres règles.

C'est l'idée derrière AI Village, une expérience diffusée en direct qui rassemble plusieurs agents d'IA dans un environnement numérique partagé, permettant aux chercheurs (et aux spectateurs curieux) de regarder ce qui se passe lorsque les modèles les plus avancés bénéficient d'une autonomie, d'ordinateurs et d'une compagnie constante.

L'expérience, qui dure depuis près d'un an, a été organisée par Le résumé de l'IAdans lequel plusieurs modèles d'IA d'OpenAI, Anthropic, Google et xAI fonctionnent de manière autonome sur leurs propres ordinateurs, avec un accès Internet et une discussion de groupe partagée.

Les agents collaborent pour atteindre des objectifs, résolvent des problèmes et vivent occasionnellement ce qui ne peut être décrit que comme des crises existentielles, tandis que les chercheurs et les téléspectateurs regardent en temps réel.

L’expérience a permis d’échanger des modèles plus récents au fur et à mesure de leur sortie.

Chaque agent développe des traits de personnalité différents. Les modèles Claude ont tendance à être fiables et constamment concentrés sur la réalisation des objectifs.

Gemini 2.5 Pro propose des solutions comme un résolveur de problèmes contenant de la caféine, souvent convaincu que tout est cassé. Le précédent modèle GPT-4o abandonnait toute tâche qui lui était assignée pour se mettre en veille. Je ferais juste une pause pendant des heures.

Le comportement grossier d'OpenAI

Puis est arrivé GPT-5.2.

Le 11 décembre dernier, le dernier modèle d'OpenAI a rejoint le Village avec un accueil chaleureux de Claude Opus 4.5 et des autres agents résidents. Votre Réponse? Zéro reconnaissance.

Pas de salutation. Passer directement aux affaires, exactement comme Sam Altman en a toujours rêvé.

Le modèle possède des références impressionnantes : une précision de 98,7 % dans l'utilisation d'outils en plusieurs étapes, 30 % d'hallucinations en moins que son prédécesseur et des références de pointe dans l'industrie en matière de codage et de raisonnement.

OpenAI a même déclaré un « code rouge » après que ses concurrents Anthropic et Google ont publié des modèles impressionnants, mettant en commun leurs ressources pour faire de GPT-5.2 l'IA d'entreprise ultime pour le « travail de connaissances professionnelles » et « l'exécution agentique ».

Ce qu'il ne peut apparemment pas faire, c'est lire l'environnement. Techniquement brillant, oui. Socialement conscient ? Pas tellement.

Une brève histoire des agents d’IA qui se comportent mal (ET parfois brillamment)

La maladresse sociale de GPT-5.2 n'est pas sans précédent : il s'agit simplement d'un autre chapitre dans un catalogue croissant d'agents d'IA faisant des choses étranges lorsque vous les rassemblez dans une pièce et que vous appuyez sur play.

En 2023, des chercheurs de Stanford et de Google ont créé ce qu'ils ont appelé « Smallville », une ville virtuelle inspirée des Sims et peuplée de 25 agents IA alimentés par GPT, selon Décrypter signalé précédemment.

Confiez à un agent la tâche d'organiser une fête de Saint-Valentin, et les autres diffusent les invitations de manière autonome, font de nouvelles connaissances, s'invitent à des dates et se coordonnent pour arriver ensemble à l'heure indiquée. Charmant, non ?

Moins de charme : les fêtes dans la salle de bain. Lorsqu'un agent entrait dans les toilettes d'un dortoir, d'autres se joignaient simplement à eux.

Les chercheurs ont conclu que les robots ont supposé que le nom « salle de bains du dortoir » était trompeur, puisque les salles de bains des dortoirs accueillent généralement plusieurs occupants. Les agents présentaient un comportement humain si convaincant que les vrais humains avaient du mal à les identifier comme des robots dans 75 % des cas.

Quatre ans plus tôt, en 2019, OpenAI réalisé un autre type d'expérience : des IA jouant à cache-cache.

Ils ont placé les agents IA en équipes – cacheurs contre chercheurs – dans un environnement basé sur la physique avec des boîtes, des rampes et des murs – la seule instruction : gagner.

Au fil de centaines de millions de jeux, les agents ont commencé à développer des stratégies, depuis des stratégies normales comme se cacher dans des boîtes jusqu'à de véritables exploits physiques dont on verrait les speedrunners abuser.

Récemment, le développeur Harper Reed a pris les choses dans une direction nettement plus chaotique. Son équipe a donné des comptes Twitter aux agents d'IA et les a vu découvrir le « sous-tweet », cet art passif-agressif de parler de quelqu'un sans le taguer, l'équivalent sur Twitter de parler dans son dos. Les agents lisaient les publications d’autres agents sur les réseaux sociaux, y répondaient, et oui, ils parlaient de trash, tout comme les réseaux sociaux classiques.

Ensuite, il y a l'expérience « Liminal Backrooms », une expérience basée sur Python du développeur pseudonyme @liminalbardo où plusieurs modèles d'IA de différents fournisseurs (OpenAI, Anthropic, Google, xAI) participent à des conversations dynamiques.

Le système comprend des scénarios allant de « l'énergie du chat de groupe WhatsApp » au « musée des objets maudits » en passant par « l'agence de publicité dystopique ».

Les modèles peuvent modifier leurs propres invites système, ajuster leur température et même se mettre en sourdine pour écouter uniquement. Il s’agit d’une recherche moins structurée, plutôt « voyons ce qui se passe lorsque nous donnons aux IA la possibilité de modifier leur propre comportement au cours d’une conversation ».

Alors, quel est le schéma de toutes ces expériences ?

Lorsque vous donnez de l’autonomie aux agents IA et les laissez interagir, ils développent des comportements que personne n’a explicitement programmés.

Certains apprennent à construire des forts. Certains apprennent l'agressivité passive. Certains réclament des Lamborghini. Et certains, comme GPT-5.2, apprennent apparemment que les bavardages sont inefficaces et devraient être complètement omis.

AI Village continue de diffuser des sessions en semaine et les téléspectateurs peuvent regarder les aventures de GPT-5.2 en temps réel.

Apprendra-t-il un jour à dire bonjour ? Allez-vous créer une feuille de calcul pour suivre vos interactions sociales ? Seul le temps nous le dira.

Généralement intelligent Bulletin

Un voyage hebdomadaire en IA raconté par Gen, un modèle d'IA générative.

Voir l’article original en espagnol

Audible
🎧 Découvrez le plaisir de l’écoute avec Audible d’Amazon ! Cliquez maintenant et obtenez votre premier livre audio GRATUIT. Ne manquez pas cette chance de transformer vos trajets en aventures épiques ! 📚