
Restez à jour avec la chaîne WhatsApp de Criptotence: Instant News sur Bitcoin, Altcoins, Defi, NFT, Blockchain et Metaverso. S’abonner!
Le géant chinois de la technologie, Alibaba, lance son modèle d’intelligence artificielle (IA) prévu basé sur la génération avancée d’images. Il s’agit d’une étape importante, non seulement par l’émergence de cette entreprise dans le secteur, mais pour les caractéristiques techniques de son modèle. La soi-disant Image de Qwen, développée par la société Tongyi Qianwen de la société, promet de grandes avancées.
Ce modèle open source a 20 milliards de paramètres, ce qui vous permet d’établir de nouvelles normes dans le processus d’intégration de texte pour la génération visuelle. En termes simples, cette nouvelle proposition attaque directement le talon d’Achille de nombreux modèles de génération d’images actuels.
Jusqu’à présent, les modèles prédominants ont eu de sérieuses difficultés à représenter le texte de précision dans les images, un problème qui est aggravé dans des langues autres que l’anglais, comme les caractères chinois. En ce sens, c’est l’une des améliorations les plus pertinentes qui distingue le nouveau modèle Alibaba dans la concurrence mondiale de l’IA.
Avec le lancement de Qwen-Image, Alibaba est positionné au cœur du développement international de l’intelligence artificielle. Le modèle présume des capacités avancées dans trois domaines clés: rendu de texte, édition cohérente d’images et performances supérieures dans les mesures de référence.
L’ABIBABA AI atterrit fortement
Les trois domaines mentionnés sont fondamentaux dans la race actuelle de la suprématie dans l’intelligence artificielle. Par exemple, le rendu de texte est crucial pour la qualité finale du résultat, ce qui influence directement l’expérience utilisateur. Selon les tests de référence, le modèle dépasse GPT-IMAGE 1 et FLUX.1 dans le rendu des caractères chinois.
Cette performance avancée permet également à QWEN-IMAGE de générer des conceptions de plusieurs lignes à haute précision, selon la publication officielle citée au début de ce rapport. Cela comprend des textes au niveau des paragraphes et des détails fins, sans affecter la qualité même en ce qui concerne différents systèmes d’écriture.
En d’autres termes, le modèle maintient ses performances à la fois dans les langues d’alphabétisation et l’anglais et l’espagnol, et dans des écrits logographiques tels que le chinois. Le décalage du paradigme est que cela ne génère pas seulement du texte dans les images, mais comprend également complètement le langage visuel contextuel.
De cette façon, Alibaba présente une IA qui pourrait transformer le monde de l’art numérique. Ses utilisateurs peuvent créer des images détaillées pour les collections NFT et d’autres utilisations créatives en quelques minutes, en profitant des fonctions avancées de ce nouvel outil.
En rapport
