
En résumé
- MidJourney a lancé son nouveau modèle de génération d’images IA, qui promet une plus grande précision, cohérence et capacités de génération de texte.
- Le modèle V6 est présenté comme une révision majeure, offrant un suivi précis des indications, des indications plus longues et une connaissance du modèle, soulignant son amélioration par rapport au modèle V5.1 lancé en mai 2023.
- De plus, le nouveau modèle met en évidence une capacité unique à générer du texte, en concurrence avec des modèles leaders tels que Dall-E 3 et Ideogram, en privilégiant le style et l’esthétique, bien que parfois au détriment de la précision du texte.
MidJourney vient d’annoncer son nouveau modèle d’imageur IA, le modèle de base V6, dans la compétition acharnée pour dominer le domaine de la créativité numérique. Sorti aujourd’hui pour les tests alpha, l’équipe de développement affirme que le V6 offre une plus grande précision de repérage, une meilleure cohérence et, pour la première fois dans l’évolution de MidJourney, des capacités de génération de texte.
Annoncé dans un post officiel sur Discord, le V6 est présenté comme une refonte majeure.
La nouvelle version offrira « un suivi des indications plus précis, ainsi que des indications plus longues, une meilleure cohérence et une meilleure connaissance du modèle », révèle l’annonce, soulignant son amélioration par rapport au modèle V5.1 lancé en mai 2023. Le modèle V5, connu pour son court , des instructions faciles à utiliser et une esthétique améliorée, il a ouvert la voie au V6 plus sophistiqué et détaillé.
L’un des composants les plus remarquables de la V6 est sa capacité à dessiner du texte. Bien que ce ne soit pas l’objectif du modèle – l’équipe dit qu’il s’agit encore d’une fonctionnalité « mineure » – cette capacité met le MidJourney en concurrence directe avec d’autres modèles phares comme le Dall-E 3 et l’Ideogram. Cependant, l’approche de MidJourney en matière de génération de texte est unique.
Midjourney décrit cette capacité comme une « capacité mineure à dessiner du texte ». « Vous devez mettre votre texte entre « guillemets » et les valeurs –style raw ou inférieures –stylize peuvent vous aider. »
Décrypter a pu tester le modèle et le comparer avec Dall-E 3, connu pour sa précision dans la génération de texte. MidJourney semble donner la priorité au style et à l’esthétique, parfois au détriment de la précision du texte. La plupart du temps, cela générait un texte incorrect ou aucun texte du tout. Mais lorsque cela s’est produit, les images étaient comparables, voire meilleures, à celles générées par Dall-E 3, le modèle d’IA de conversion texte-image qui alimente ChatGPT et Microsoft Bing.

En comparant les générations de texte de MidJourney, Dall-E 3, SDXL avec Harrlogos et Ideogram AI, une recommandation simplifiée pourrait être d’utiliser MidJourney si l’esthétique est une priorité, Dall-E 3 pour sa facilité d’utilisation et son esthétique de dessin d’art numérique animé, SDXL pour ceux qui ont une connaissance avancée de A1111 et Ideogram AI pour les résultats où le texte est plus important que l’esthétique.
L’utilisation de MidJourney ou de Dall-E 3 avec ChatGPT est actuellement payante, tandis que SDXL et Ideogram AI sont gratuites. La version Bing de Dall-E 3 est gratuite, mais elle ne génère que des images carrées et les utilisateurs ne peuvent modifier que les invites plutôt que l’approche de conversation naturelle adoptée par OpenAI.
MidJourney V6 est également légèrement plus lent et plus cher que la v5, mais l’équipe met l’accent sur l’accélération du modèle au fil du temps. Le modèle V6 dispose également d’améliorations améliorées dans les modes « subtil » et « créatif », améliorant la résolution de l’image de 2x.
Ces fonctionnalités, ainsi qu’un large éventail d’arguments pris en charge tels que –ar (pour modifier la résolution), –chaos (pour modifier les variations entre les générations) et –stylize (pour modifier la créativité du modèle), offrent aux utilisateurs un large éventail de possibilités. possibilités créatives. Cependant, d’autres fonctionnalités telles que le remplissage d’image, la peinture et la description ne sont pas encore disponibles. Selon MidJourney, ils devraient arriver dans une mise à jour le mois prochain.
La publicité exhorte les utilisateurs à utiliser ces « pouvoirs incroyables avec joie, émerveillement, responsabilité et respect », ce qui a toujours fait partie de la philosophie de MidJourney. Mais ne vous énervez pas trop, car ils seront plus stricts en matière de censure.
« Ne soyez pas idiot et ne créez pas d’images pour semer le trouble », indique la publicité. Cela bloquera probablement les tentatives de création de waifus numériques ou de deepfakes politiques.
Edité par Ryan Ozawa.
Restez au courant de l’actualité crypto, recevez des mises à jour quotidiennes dans votre boîte de réception.
Voir l’article original en espagnol
