Plaisir et inconvénients – OpenAI a présenté Sora

Plaisir et inconvénients – OpenAI a présenté Sora

OpenAI-min

Le 15 février, OpenAI a présenté un nouveau modèle d’intelligence artificielle générative, Sora, qui permet de convertir du texte en vidéo. L’outil a fait le bonheur des réseaux sociaux, mais il nécessite encore de nombreuses améliorations avant son lancement complet.

Sora est capable de générer des vidéos d’une durée maximale de 60 secondes avec une résolution allant jusqu’à 1080p sur la base de simples invites textuelles. Ceux-ci peuvent inclure plusieurs personnages, des types de mouvements spécifiques et des détails précis sur le sujet et l’arrière-plan.

L’outil est basé sur les recherches de GPT et DALL-E 3. Il fonctionne sur ce que l’on appelle le modèle de diffusion : il transforme l’image originale en bruit statistique, puis la transforme, supprimant ce bruit étape par étape.

Les développeurs admettent qu’à ce stade, Sora présente encore un certain nombre de défauts. Il lui est difficile de modéliser avec précision la physique d’une scène complexe – elle se confond dans les relations de cause à effet.

« Par exemple, une personne peut mordre un morceau de cookie, mais après cela, il se peut qu’il ne reste plus de marque de morsure », explique OpenAI.

L’outil a des problèmes avec les détails spatiaux. Le résultat obtenu peut ne pas correspondre aux directions données, il peut être erroné là où se trouvent la droite et la gauche.

Pour l’instant, Sora est disponible pour « l’équipe rouge » de testeurs, ainsi que pour certains designers, artistes et cinéastes.

Réaction sur les réseaux sociaux

L’outil est fasciné sur les réseaux sociaux et est déjà une tendance X avec plus de 173 000 publications.

Pour démontrer clairement les capacités du modèle, Sam Altman, PDG d’OpenAI, a commencé à accepter les demandes des utilisateurs pour la génération de vidéos. Au moment de la rédaction de cet article, il a partagé un total de neuf vidéos créées par Sora.

Les experts en IA ont noté que les capacités de Sora sont « muettes ».

Selon Jim Fan, scientifique principal de Nvidia, Sora est bien plus qu’un simple « jouet créatif » comme le DALL-E 3. Il l’a défini comme un « moteur physique basé sur les données », car le modèle d’IA ne se contente pas de générer des vidéos abstraites. , mais crée également intuitivement la physique des objets dans la scène elle-même.

Parallèlement à cela, un certain nombre d’utilisateurs ont exprimé leur inquiétude quant au fait que des outils comme Sora pourraient aggraver le problème des deepfakes.

Selon un utilisateur, les grands réseaux sociaux devraient réfléchir à une protection intégrée contre les contrefaçons réalistes. Par ailleurs, il a souligné la menace de substitution des preuves vidéo des crimes.

Un autre utilisateur a exprimé la nécessité de recourir à la technologie d’ingénierie inverse De-AI pour éviter une mauvaise interprétation du contenu.

Auparavant, OpenAI avait commencé à tester une fonctionnalité de « mémoire » pour le chatbot ChatGPT, qui stocke les informations discutées dans les conversations pour améliorer l’expérience utilisateur.

Dans le même temps, l’entreprise s’oppose activement à l’utilisation de ses produits à des fins illégales.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !



Voir l’article original en russe

Prime Video sur Amazon.fr
Découvrez un monde infini de divertissement avec Prime Video d’Amazon. Inscrivez-vous dès maintenant pour profiter d’un essai gratuit de 30 jours et plongez dans vos séries et films préférés, où que vous soyez !