Meta présente Voicebox : un outil d’IA révolutionnaire pour la génération de voix

Meta présente Voicebox : un outil d’IA révolutionnaire pour la génération de voix

En résumé

  • Meta annonce Voicebox, un outil d’intelligence artificielle capable de générer un dialogue parlé avec divers cas d’utilisation potentiels.
  • Voicebox peut produire de l’audio en six langues et créer un discours crédible à partir de clips audio et de texte d’entrée.
  • Meta n’a pas l’intention de diffuser Voicebox au public en raison des risques associés à la technologie de génération de la parole.

Meta a poursuivi vendredi sa poussée dans le domaine de plus en plus encombré de l’intelligence artificielle (IA), annonçant la création d’un outil appelé Voicebox, pour générer un dialogue parlé avec une variété de cas d’utilisation potentiels, mais qui est également susceptible d’être utilisé. détourné, comme l’admet Meta, c’est pourquoi le géant des médias sociaux ne publie pas encore Voicebox au public.

Contrairement aux plates-formes de génération vocale précédentes, Meta indique que Voicebox peut effectuer des tâches de génération vocale pour lesquelles il n’a pas été spécifiquement formé. En utilisant la saisie de texte et un court clip audio pour le contexte, l’outil d’IA peut créer un extrait potentiellement crédible d’un nouveau discours qui ressemble à la personne dans le clip source.

« Avant Voicebox, l’IA générative pour la parole nécessitait une formation spécifique à une tâche utilisant des données de formation soigneusement préparées », a déclaré Meta AI. « Voicebox utilise une nouvelle approche pour apprendre uniquement à partir de l’audio brut et d’une transcription qui l’accompagne. »

L’IA générative est un type de programme capable de générer du texte, des images ou d’autres médias en réponse aux demandes des utilisateurs. Meta AI a déclaré que Voicebox peut produire de l’audio en six langues, dont l’anglais, le français, l’allemand, l’espagnol, le polonais et le portugais, et peut se rapprocher de la façon dont les gens parlent naturellement dans le monde réel.

Meta suggère que l’outil peut être utilisé pour améliorer les conversations multilingues à l’aide d’outils technologiques ou pour offrir un dialogue plus naturel à partir de personnages de jeux vidéo. Mais Voicebox semble également être un moyen plus rapide et moins cher de créer un dialogue « deepfake » imitateur, donnant l’impression que quelqu’un (peut-être une personnalité publique ou une célébrité) a dit quelque chose qu’il n’a pas vraiment dit.

Bien qu’il puisse s’agir d’une percée dans le développement de l’IA, Meta AI a également reconnu le potentiel d’utilisation abusive, affirmant que la société a développé des classificateurs qui font la distinction entre les créations Voicebox et les humains. Comme les filtres anti-spam, les classificateurs d’IA sont des programmes qui classent les données en différents groupes ou classes, dans ce cas, humains ou générés par l’IA.

Meta a souligné le besoin de transparence dans le développement de l’IA dans son article de blog, affirmant qu’il est crucial d’être ouvert avec la communauté des chercheurs. Cependant, la société a également déclaré qu’elle n’envisageait pas de rendre Voicebox accessible au public en raison de la possibilité d’exploiter la technologie de manière potentiellement négative.

« Il existe de nombreux cas d’utilisation passionnants pour les modèles de parole génératifs, mais en raison des risques potentiels d’utilisation abusive, nous ne rendons pas le modèle ou le code Voicebox accessible au public pour le moment », a déclaré un porte-parole de Meta AI. Décrypter dans un e-mail.

« Bien que nous pensons qu’il est important d’être ouverts avec la communauté de l’IA et de partager nos recherches pour faire progresser l’état de l’art en matière d’IA », a poursuivi le porte-parole, « il est également nécessaire de trouver le bon équilibre entre ouverture et responsabilité ».

Plutôt que de publier l’outil dans un état de fonctionnement, Meta a partagé des échantillons audio et un document de recherche pour aider d’autres chercheurs à comprendre son potentiel.

Les risques liés à l’IA émergent

Alors que les outils d’intelligence artificielle, en particulier les chatbots IA, sont devenus plus courants depuis le lancement d’OpenAI ChatGPT en novembre dernier, les progrès rapides de l’intelligence artificielle ont conduit les dirigeants mondiaux à tirer la sonnette d’alarme sur les abus potentiels. de la technologie.

Lundi, le secrétaire général de l’ONU a réitéré la nécessité de prendre au sérieux les avertissements concernant l’IA générative.

« Les sonnettes d’alarme concernant la dernière forme d’intelligence artificielle, l’IA générative, sont assourdissantes, et elles sont plus fortes que les développeurs qui les ont conçues », a déclaré le secrétaire général de l’ONU, António Guterres, lors d’une conférence de presse. « Les scientifiques et les experts ont appelé le monde à agir, déclarant que l’IA est une menace existentielle pour l’humanité à égalité avec le risque de guerre nucléaire. »

Peut-être que pour l’instant, l’IA n’est pas aussi inquiétante que la menace d’une guerre nucléaire mondiale, cette possibilité faisant toujours partie de la science-fiction et des films hollywoodiens. Un abus plus probable de l’IA générative provient d’escroqueries qui ciblent des individus utilisant des images et des voix générées par l’IA pour tromper les victimes ou, comme l’ONU l’a dit dans un rapport récent, pour alimenter la haine et la désinformation en ligne. .

Un deepfake est un type de plus en plus courant de contenu vidéo ou audio créé par l’intelligence artificielle qui décrit de faux événements, mais qui est réalisé d’une manière qui peut être très difficile à identifier comme faux.

En avril, CNN a rapporté que des escrocs avaient utilisé la technologie de l’intelligence artificielle pour cloner la voix de la fille de 15 ans d’une femme de l’Arizona, affirmant avoir kidnappé l’adolescente et exigeant une rançon. Et en mars, une image générée par l’intelligence artificielle de l’ancien président atout de donald être arrêté est devenu viral après avoir été partagé sur les réseaux sociaux.

Restez au courant des actualités cryptographiques, recevez des mises à jour quotidiennes dans votre boîte de réception.



Voir l’article original sur decrypt.co