Innovations NVIDIA AI pour les médias à l'IBC 2026

Amsterdam se transforme pendant quatre jours en laboratoire à ciel ouvert de l'industrie des médias, et lors de l'IBC 2026, qui se déroulera du 11 au 14 septembre, Nvidia il a choisi de relever la barre. Le Les innovations IA de NVIDIA pour les médias présentés lors de l'événement — qui rassemble cette année plus de 44 000 participants venus de plus de 170 pays parmi plus de 1 300 exposants — ne concernent plus seulement les effets spéciaux ou le montage : ils touchent à l'authenticité du contenu, à l'analyse sportive, à la qualité vidéo et même à la façon dont une diffusion en direct peut parler des dizaines de langues en même temps. La société a étendu sa suite NVIDIA AI for Media avec de nouveaux SDK, microservices NIM et playbooks destinés aux diffuseurs, aux plateformes de streaming et aux organisations sportives.

Points clés

  • NVIDIA a étendu sa suite AI for Media à l'IBC 2026 avec des SDK accélérés par GPU, des microservices NIM et des playbooks de flux de travail multimédia.
  • Le Détecteur vidéo synthétique NVIDIA atteint une précision allant jusqu'à 99,3 % dans la reconnaissance des vidéos générées par l'IA à partir du texte.
  • Des partenaires comme Dalet, TwelveLabs et Wowza intègrent le détecteur dans les workflows de vérification de contenu et de conformité.
  • Des outils tels que 3D Body Pose amènent l’analyse sportive basée sur l’IA à de nouveaux niveaux de précision.
  • NVIDIA Holoscan for Media avec Media Exchange Layer permet une production en direct définie par logiciel et une localisation multilingue en temps réel.

NVIDIA étend AI Suite for Media à l'IBC 2026

L'extension annoncée concerne un ensemble d'outils conçus pour comprendre le mouvement, vérifier et améliorer les vidéos, localiser les programmes et créer des applications multimédias basées sur l'intelligence artificielle. Ce n’est pas un petit détail : les diffuseurs intègrent de plus en plus l’IA dans les flux de production en direct, de sport, d’information et de streaming sans vouloir perturber des environnements qui doivent rester fiables et vérifiables.

Nouveaux SDK et microservices accélérés par GPU

Au cœur de la nouvelle offre se trouvent des SDK accélérés par GPU, des microservices NVIDIA NIM, des playbooks et des plans qui alimentent l'audio, la vidéo et les effets de réalité augmentée pour les flux de travail multimédias et de divertissement. C’est là que se concentre la majeure partie des informations Les innovations IA de NVIDIA pour les médias: Des outils prêts à être intégrés directement dans les pipelines existants, sans nécessiter d'infrastructure parallèle.

Les partenaires intègrent NVIDIA Synthetic Video Detector

L'élément le plus susceptible de susciter des discussions est le Détecteur vidéo synthétique NVIDIA (SVD), initialement présenté au SIGGRAPH et désormais mis à jour avec des chiffres qui parlent d'eux-mêmes : jusqu'à 99,3% de précision sur les contenus texte-vidéo et 97,7% sur les contenus image-vidéo, avec des améliorations particulièrement marquées sur les cas les plus complexes. Le microservice aide les équipes de rédaction, d'investigation numérique et d'authentification de contenu à estimer la probabilité qu'une séquence soit authentique ou générée artificiellement.

Trois partenaires montrent comment cette technologie entre déjà dans de vrais workflows. Dalet l'intègre dans un flux de révision cloud sécurisé conçu pour les rédactions, où les équipes peuvent soumettre des séquences, analyser les scores et consulter les métadonnées directement dans l'interface. DouzeLabs a lancé Compliance by TwelveLabs, la première application construite sur sa plateforme d'intelligence vidéo, qui intègre SVD pour ajouter des signaux d'authenticité au niveau de l'image dans le contrôle de conformité. Wowzadont la technologie de streaming alimente plus de 35 000 déploiements vidéo dans plus de 170 pays, déploiera SVD via le Wowza Video Intelligence Framework, permettant une analyse en temps réel des flux en direct – avec des déploiements possibles sur site, dans le cloud, dans des environnements hybrides ou complètement isolés.

Pourquoi cet élément de la publicité est-il important ? Parce qu’elle fait passer la détection des contenus synthétiques d’un thème théorique à un outil opérationnel au sein des rédactions et des plateformes de streaming, à l’heure où la confiance dans la vidéo est devenue un enjeu central pour l’information.

Innovations en matière d'IA pour l'analyse sportive et l'amélioration vidéo

Le sport est devenu le principal banc d'essai pour l'IA multimodale de NVIDIA, et les chiffres présentés à l'IBC confirment à quel point la spécialisation des modèles peut faire la différence par rapport aux solutions génériques.

Pose du corps NVIDIA 3D

Pose du corps NVIDIA 3D estime les positions et les angles des articulations humaines en 2D et 3D à partir de vidéos prises avec une seule caméra, sans avoir besoin de systèmes de capture de mouvement avec marqueurs. Pour les organisations sportives, cela signifie être capable de suivre les mouvements des athlètes, d'analyser la biomécanique, d'améliorer les rediffusions, de soutenir l'arbitrage et les applications liées à la sécurité des joueurs. Vizrt utilise déjà cette technologie dans des environnements de studio virtuel en direct, où le mouvement du corps suivi génère des effets d'éclairage 3D tels que des reflets et des ombres en temps réel.

Sur le devant deanalyse sportive avec intelligence artificielleNVIDIA propose des cadres structurés qui représentent peut-être le pari le plus ambitieux, permettant aux ligues, aux sociétés de médias et aux fournisseurs de technologie d'affiner les modèles NVIDIA ouverts sur leurs séquences et annotations sportives. Les résultats des premiers tests sont remarquables, avec des améliorations significatives en termes de précision tant dans les questions à choix multiples que dans les évaluations ouvertes. Certaines organisations sportives intègrent ces playbooks à leurs propres infrastructures et agents de données, transformant ainsi leurs médias et leur expertise propriétaires en intelligence déployable pour la production en direct et le contenu des fans. Ces modèles spécifiques au sport peuvent devenir une « intelligence experte » au sein d’agents capables de raisonner sur la vidéo, les données d’entreprise et les systèmes logiciels – une étape qui fait passer l’IA sportive de la compréhension à l’automatisation des décisions.

IA générative pour des vidéos plus fluides et de meilleure qualité

La génération d'images vidéo (VFG) utilise l'IA générative pour créer de nouvelles images à partir des images originales d'une vidéo, augmentant ainsi la fréquence d'images de 2x ou 4x tout en conservant la qualité visuelle et la cohérence temporelle – utile pour lisser les sports, les rediffusions au ralenti et le contenu en direct à haute vitesse. Ross Video intègre VFG à la plate-forme Rio Replay pour créer des vidéos au ralenti assistées par l'IA, avec une prise en charge déjà disponible pour le ralenti 6x et un développement en cours vers une interpolation 8x.

Aux côtés de VFG, NVIDIA Video Super Resolution (VSR), qui utilise l'IA pour mettre à niveau les vidéos en réduisant le bruit, le flou et les artefacts de compression, est disponible via le SDK et le microservice NIM pour le streaming, la diffusion, la vidéoconférence et la création de contenu. Pour compléter le package, NVIDIA TrueHDR convertit la vidéo à plage dynamique standard en sortie à plage dynamique élevée en temps réel, atteignant jusqu'à environ 2 000 nits tout en conservant le contraste local. VSR, VFG et TrueHDR peuvent être combinés en un seul pipeline d'effets vidéo, permettant aux sociétés de médias de réorganiser leurs bibliothèques de contenu existantes.

Infrastructure en direct pour la localisation de médias et de contenus en temps réel

À mesure que les diffuseurs, les plateformes de streaming et les organisations sportives adoptent les logiciels et l’IA, l’infrastructure derrière le contenu en direct devient plus flexible, plus connectée et de plus en plus basée sur une informatique accélérée partagée.

NVIDIA Holoscan pour les médias et Media Exchange Layer (MXL)

Une architecture de référence ouverte et une boîte à outils de développement pour créer des fonctions et des applications multimédias basées sur l'IA dans une production définie par logiciel en direct ajoutent également un moyen ouvert d'échanger de la vidéo, de l'audio et des données en direct entre ces fonctions logicielles dans un environnement distribué. Lorsque les fonctions de production migrent vers les logiciels, les développeurs peuvent créer des applications partageant une infrastructure accélérée, se connectant de manière dynamique et évoluant de manière indépendante, réduisant ainsi le besoin d'intégrations personnalisées entre les applications. Pour les fournisseurs de technologies, cela ouvre la porte à des écosystèmes multifournisseurs plus larges ; Pour les entreprises de médias, cela ouvre la voie à une infrastructure capable de s’adapter à l’évolution des formats et des capacités de l’IA.

Technologies de localisation pour les diffusions multilingues

Atteindre un public mondial avec une programmation en direct nécessite plus que simplement traduire des mots : la voix, le timing, les mouvements du visage, les sous-titres et les graphiques superposés doivent fonctionner ensemble en temps réel, préservant l'intention éditoriale et la qualité de la production originale. Les nouvelles technologies de localisation de contenu apportées à Holoscan for Media répondent exactement à ce besoin, en proposant des sous-titres, de l'audio traduit, du doublage, de la vidéo synchronisée et des graphiques localisés dans un seul flux de travail défini par logiciel.

Les développeurs peuvent choisir les fonctionnalités à activer pour chaque programme, marché ou canal de distribution, au lieu d'avoir à mettre en place des infrastructures distinctes pour chaque version localisée. Le système intègre également les dernières améliorations des microservices NVIDIA LipSync et Active Speaker Detection, qui gèrent désormais mieux les visages partiellement masqués et identifient plus précisément qui parle dans les scènes avec plusieurs personnes. Différentes technologies de localisation couvrent chacune un aspect spécifique du processus, de l'adaptation de la voix à la création de sous-titres multilingues en passant par la préservation de l'expression et de l'identité dans le contenu en direct et à la demande. NDI, pour sa part, utilise déjà NVIDIA LipSync pour générer des traductions en temps réel, des doublages synchronisés et des adaptations linguistiques régionales au sein des flux de diffusion existants – ce qui réduit la bande passante, l'infrastructure et la complexité de production traditionnellement requises pour la distribution multilingue.

C’est peut-être là le point le plus stratégique de toute l’annonce : en réunissant la détection d’authenticité, l’analyse avancée du sport et la localisation en temps réel dans une infrastructure unique et accélérée, les diffuseurs n’ont plus à choisir entre vitesse, évolutivité et confiance. Les technologies d’IA des médias en direct présentées à l’IBC 2026 visent à combler ce compromis, poussant l’ensemble du secteur vers des pipelines de plus en plus définis par logiciel.

FAQ

Quelles sont les principales innovations que NVIDIA présentera pour les flux de travail multimédias à l'IBC 2026 ?

NVIDIA a étendu sa suite AI for Media avec des SDK et des microservices accélérés par GPU, notamment Synthetic Video Detector pour la détection vidéo générée par l'IA, l'analyse sportive, l'amélioration vidéo et l'infrastructure de production multimédia en direct.

Quelle est la précision du détecteur vidéo synthétique NVIDIA dans la détection des vidéos générées par l'IA ?

Le détecteur vidéo synthétique NVIDIA atteint une précision allant jusqu'à 99,3 % sur le contenu texte-vidéo et une précision de 97,7 % sur le contenu image-vidéo.

Comment NVIDIA prend-il en charge la localisation multilingue en temps réel dans le domaine de la diffusion ?

Les technologies de localisation de contenu intégrées à Holoscan for Media permettent le doublage multilingue, le sous-titrage et les graphiques localisés en temps réel pour les diffusions en direct.

Quelles avancées NVIDIA propose-t-il en matière d'analyse et de rediffusions de vidéos sportives ?

NVIDIA 3D Body Pose estime le mouvement humain à partir de la vidéo pour l'analyse sportive, tandis que la génération d'images vidéo permet des mouvements plus fluides et des rediffusions au ralenti jusqu'à 6x, améliorant ainsi la qualité des retransmissions sportives.

Contenu créé avec l’aide de l’intelligence artificielle et de la révision éditoriale humaine.

Voir l’article original en italien

Prime Video sur Amazon.fr
Découvrez un monde infini de divertissement avec Prime Video d’Amazon. Inscrivez-vous dès maintenant pour profiter d’un essai gratuit de 30 jours et plongez dans vos séries et films préférés, où que vous soyez !