OpenAI présente Sora : l’IA de génération vidéo la plus avancée jamais conçue

OpenAI présente Sora : l’IA de génération vidéo la plus avancée jamais conçue

En résumé

  • OpenAI a présenté Sora, un nouveau modèle d’IA capable de créer des vidéos textuelles.
  • Sora cherche à améliorer la cohérence des vidéos d’une minute, un défi dans le domaine de l’IA.
  • Bien que Sora propose des visuels captivants, il reste confronté à des défis de fidélité et de censure.

OpenAI a présenté Sora, un nouveau modèle d’IA capable de prendre des instructions textuelles et de créer de longues vidéos attrayantes. Eh bien, des vidéos d’une minute.

Il s’agit actuellement d’une version bêta fermée, disponible uniquement pour les développeurs invités, et représente une entrée quelque peu tardive du leader mondial de l’IA. La conversion texte-vidéo n’est pas vraiment un territoire inconnu. Des sociétés comme RunwayML et Pika Labs sont dans le jeu depuis un certain temps et dominent actuellement la scène avec des modèles capables de créer des images époustouflantes en quelques secondes.

Mais il y a toujours un hic : ces vidéos ont tendance à être courtes, l’histoire perd de sa concentration et de sa cohérence à mesure qu’elle s’allonge.

Avec Sora, OpenAI vise à assurer la cohérence, en générant des vidéos détaillées d’une minute qui peuvent circuler et évoluer de manière transparente. Ce n’est pas un objectif facile, car les modèles d’IA improvisent chaque image à partir de zéro. Un petit défaut dans une seule image peut se transformer en une cascade d’hallucinations et d’images irréelles.

OpenAI semble avoir progressé, Sora démontrant des visuels fluides et captivants qui sont jusqu’à présent inégalés parmi les acteurs actuels du secteur. OpenAI a publié quelques exemples de vidéos en ligne et certaines ont été republiées officieusement sur YouTube.

OpenAI affronte d’autres sociétés d’IA qui testent également le nouvel écosystème vidéo génératif. Le populaire générateur de texte en image Midjourney a récemment annoncé qu’il travaillait sur un générateur de texte en vidéo, mais n’a pas proposé de date de sortie. De plus, Stability AI a récemment fait des vagues avec Stable Video Diffusion, son offre open source capable de générer des vidéos de 25 images à une résolution de 576 x 1 024.

Même Meta présente son générateur vidéo EMU, dans le cadre de ses efforts visant à intégrer l’intelligence artificielle dans les médias sociaux et le métaverse.

Sora, qui est pour l’instant en version limitée, avec OpenAI donnant accès aux « artistes visuels, designers et cinéastes » pour obtenir des commentaires, se distingue par sa façon de comprendre le langage. Génère des images vibrantes et très détaillées tout en interprétant les nuances des invites écrites. Avez-vous besoin d’un mouvement de caméra spécifique ? Plusieurs personnages avec des émotions réalistes ? Aucun problème.

Sora génère même des transitions fluides entre différents plans au sein de la même vidéo, imitant ce que font déjà certains outils de montage vidéo aujourd’hui. Voici une autre vidéo enthousiaste publiée aujourd’hui sur YouTube :

Cependant, la créativité alimentée par l’intelligence artificielle a ses particularités. Sora n’est pas encore un maître du cinéma. Des problèmes peuvent survenir avec la physique ou des causes et effets complexes. En d’autres termes, et bien qu’il soit déjà l’un des générateurs vidéo les plus cohérents, il n’atteint pas des niveaux de fidélité absolue, on peut donc s’attendre à des hallucinations.

De plus, venant d’OpenAI, il ne fait aucun doute que Sora sera un modèle fortement censuré. La société a mis l’accent sur les tests de sécurité et les outils de détection pour identifier les contenus potentiellement dangereux et trompeurs. Cependant, OpenAI travaille avec son équipe rouge pour affiner son modèle et espère que sa stratégie de publication anticipée mènera à une collaboration pour construire une IA de plus en plus sûre dans les années à venir.

Aucune date de sortie immédiate pour le déploiement plus large de Sora n’a été annoncée jusqu’à présent.

Édité par Ryan Ozawa.

Restez au courant de l’actualité crypto, recevez des mises à jour quotidiennes dans votre boîte de réception.

Voir l’article original en espagnol