La mise à jour 2.5 des images Chatgpt est publiée

OpenAI a publié ChatGPT Images 2.5le nouveau modèle de génération d'images qui vise à rendre l'intelligence artificielle visuelle plus précise, plus rapide et collaborative. C'est la deuxième mise à jour majeure en quelques mois : après Images 2, lancée en avril avec une résolution 2K et une recherche web intégrée, celle-ci arrive désormais Mise à jour des images ChatGPT qui promet des détails plus nets, un montage plus fiable et des temps de génération réduits jusqu'à 50 % par rapport à la version précédente. Chaque semaine, entre ChatGPT Images et les modèles GPT-Image disponibles via API, les utilisateurs créent plus de 3 milliards d'images : un volume qui explique pourquoi OpenAI continue d'investir massivement dans ce domaine.

Points clés

  • ChatGPT Images 2.5 réduit la latence de génération jusqu'à 50 % par rapport à Images 2.0, avec une lumière et des textures plus naturelles.
  • Trois nouvelles fonctions arrivent : Sketch pour dessiner des références directement dans le chat, des modèles pour les formats populaires et des commentaires directs sur les images.
  • Le modèle est déjà actif pour tous les utilisateurs de ChatGPT, ChatGPT Work et Codex, sur ordinateur, mobile et Web.
  • Deux modèles d'API font leurs débuts pour les développeurs : GPT-Image-2.5 Flare Et GPT-Image-2.5 Sunburstavec Flare offrant une latence 50 % inférieure à celle de GPT-Image-2.
  • OpenAI maintient des contrôles de sécurité sur les invites et les sorties, avec des métadonnées et des filigranes C2PA invisibles.

Des images plus nettes, plus rapides et plus fidèles à la réalité

Génération d'images IA of Images 2.5 se concentre avant tout sur la qualité perçue : OpenAI décrit un éclairage plus naturel, des textures plus riches et une plus grande capacité à préserver les sujets dans les photos de référence. Ce n’est pas un détail mineur : ceux qui travaillent avec des photos personnelles ou des actifs de marque ont besoin que les visages, les objets et les proportions restent reconnaissables même après de multiples retouches.

Le progrès le plus concret concerne toutefois la rapidité. OpenAI rapporte une réduction de la latence de génération allant jusqu'à 50 % par rapport à Images 2.0, un gain qui se traduit par des flux de création plus rapides, aussi bien pour ceux qui utilisent ChatGPT occasionnellement que pour ceux qui intègrent le modèle dans des produits tiers via API.

Croquis, modèles et commentaires : plus de contrôle créatif

Le nouvelles fonctionnalités Images ChatGPT introduit avec cette version, déplacez l'attention de la simple invite de texte vers un contrôle plus précis du résultat final. La fonction Esquisse vous permet de dessiner directement dans ChatGPT — en tapant « @Sketch » — en transformant une esquisse approximative, qu'il s'agisse de la disposition d'une pièce ou du contour d'un vêtement, en une image complète basée sur cette référence visuelle.

À cela s'ajoutent les modèles conçus pour les formats créatifs les plus demandés, tels que les affiches et les produits de merchandising : au lieu de partir de zéro, l'utilisateur sélectionne un modèle et ajoute des détails spécifiques sur le style et les informations à communiquer. Le tableau est complété par la possibilité de laisser des commentaires directement sur l'image pour indiquer des modifications spécifiques, et de partager non seulement le résultat final mais aussi le message utilisé, afin que d'autres puissent reproduire l'idée avec leurs propres photos et détails.

Cette combinaison de Outils de création ChatGPT marque un changement d'approche : OpenAI ne se contente pas d'améliorer le moteur sous le capot, mais construit une interface conçue pour l'itération et la collaboration, des éléments jusqu'à présent peu développés dans la génération d'images via le chat.

Disponibilité immédiate et deux nouveaux modèles d'API

Images 2.5 est déjà disponible pour tous les utilisateurs ChatGPT, Travail de ChatGPT Et Manuscritsur ordinateur, mobile et web, sans distinction entre les différents plans tarifaires. Il s'agit d'une version horizontale qui affecte l'ensemble de la base d'utilisateurs, pas seulement les abonnements premium.

Pour ceux qui développent des applications basées sur la génération d'images, deux modèles distincts traversent leImagesAPI: GPT-Image-2.5 Flare et GPT-Image-2.5 Sunburst. Flare est le choix par défaut pour la plupart des applications, offrant des images de meilleure qualité que GPT-Image-2 avec une latence 50 % inférieure – un modèle polyvalent, adapté au contenu social, aux expériences de produits, à la recherche visuelle et à la génération de volumes élevés. Sunburst, en revanche, est conçu pour les flux de travail haut de gamme qui nécessitent un contrôle plus strict sur les modifications, avec des temps de construction plus longs mais des résultats plus soignés – conçus pour les campagnes publicitaires prêtes à la production ou les images de produits de niveau professionnel.

Cette distinction entre deux modèles d’API avancés n’est pas fortuite. OpenAI semble reconnaître que le marché des développeurs a des besoins différents : ceux qui créent des produits à grand volume ont besoin de rapidité et de faibles coûts, tandis que ceux qui travaillent sur des actifs de marque recherchent la précision, même au prix de délais plus longs. Il s'agit d'une segmentation qui pourrait également devenir une norme pour d'autres fournisseurs de modèles génératifs.

Édition multi-tours et compréhension visuelle plus sophistiquée

L'un des problèmes les plus fréquents dans les modèles de la génération précédente était la dégradation de la qualité après des modifications ultérieures. Images 2.5 répond directement à cette limitation : lors de conversations plus longues, le modèle suit les instructions d'édition de manière plus cohérente, conservant ainsi la stabilité des modifications précédentes sans que la qualité de l'image ne se dégrade à mesure que les demandes s'accumulent.

A cela s'ajoute un montage de précision plus ciblé : le modèle est capable de modifier uniquement l'élément souhaité – un produit, un fond, un texte – en laissant intact le reste de la composition, même en présence de sujets et de fonds complexes. Pour les développeurs utilisant l'API Images, cela signifie pouvoir mettre à jour un seul élément d'un actif de marque sans avoir à reconstruire l'intégralité de l'image à partir de zéro.

Il améliore également la compréhension d'instructions visuelles complexes : les mises en page avec des fonds transparents, les hiérarchies d'éléments dans une interface graphique ou les styles artistiques spécifiques sont interprétés avec une plus grande fidélité. Il s’agit d’un progrès qui importe avant tout pour ceux qui produisent des séries d’actifs cohérents avec une identité visuelle définie, où tout écart par rapport au style requis se traduit par un coût de révision.

Sécurité : contrôles de contenu et traçabilité des images

OpenAI réitère que la sortie d'Images 2.5 repose sur les mêmes mesures de sécurité déjà utilisées : contrôles automatisés des invites et des images pour empêcher les sorties malveillantes, ainsi que l'utilisation de métadonnées C2PA et de filigranes invisibles pour identifier le contenu généré avec ses outils. Ce sont les mêmes garanties qui accompagnaient déjà les versions précédentes du modèle, désormais également étendues aux nouvelles fonctions d'édition et de partage.

Il convient de noter que le lancement de cette mise à jour a eu lieu le jour même où la société a annoncé des problèmes techniques affectant la génération d'images dans ChatGPT et l'API Images, avec des erreurs généralisées signalées par les utilisateurs sur les plateformes de surveillance des pannes. Un épisode qui, bien que limité, montre à quel point l'équilibre est délicat entre le lancement de fonctions ambitieuses et la stabilité opérationnelle d'un service utilisé à l'échelle d'un milliard de dollars.

FAQ

Qu'est-ce que ChatGPT Images 2.5 ?

Il s'agit du nouveau modèle de génération d'images d'OpenAI, présenté comme le plus avancé à ce jour : il offre des détails plus nets, un éclairage amélioré, des textures plus riches et une génération plus rapide.

Quelles nouvelles fonctionnalités introduit-il pour les utilisateurs ?

Il introduit Sketch pour dessiner des références visuelles directement dans ChatGPT, des modèles pour les formats créatifs les plus populaires, des commentaires directs sur les images pour une édition collaborative et la possibilité de partager les invites utilisées.

Comment accéder aux images ChatGPT 2.5 ?

Il est disponible pour tous les utilisateurs de ChatGPT, ChatGPT Work et Codex, sur tous les plans tarifaires, sur ordinateur, mobile et Web.

Quels sont les nouveaux modèles d'API publiés avec Images 2.5 ?

GPT-Image-2.5 Flare, destiné aux applications à gros volume avec une faible latence, et GPT-Image-2.5 Sunburst, destiné aux flux de travail créatifs haut de gamme qui nécessitent une plus grande précision dans l'édition.

Contenu créé avec l’aide de l’intelligence artificielle et de la révision éditoriale humaine.

Voir l’article original en italien

Prime Video sur Amazon.fr
Découvrez un monde infini de divertissement avec Prime Video d’Amazon. Inscrivez-vous dès maintenant pour profiter d’un essai gratuit de 30 jours et plongez dans vos séries et films préférés, où que vous soyez !