
En résumé
- Google a dévoilé sa première mise à jour majeure de son modèle d'IA phare, Gemini, avec le lancement de « Gems » personnalisables.
- Gemini intégrera directement le générateur d'images IA de la société, Image 3, mais il ne générera pas encore d'images de personnes.
- Les gemmes permettent aux utilisateurs de créer un ensemble modulaire d'assistants d'IA personnalisés pour des projets allant du codage aux conseils de carrière.
Pour tenter de concurrencer OpenAI, qui domine le marché de l'intelligence artificielle, Google a dévoilé sa première mise à jour majeure de son modèle d'IA phare, Gemini. L'entreprise a récemment annoncé le lancement de « Gems » personnalisables.
Gemini intégrera également directement le générateur d'images IA de la société, Image 3. Cependant, il ne générera pas encore d'images de personnes, après qu'une version antérieure ait produit des images problématiques et forcé Google à retirer l'outil du réseau.
Similaire à la fonctionnalité ChatGPT d'OpenAI, Gems, annoncée pour la première fois par Google lors de la conférence Google I/O en mai, offre aux utilisateurs la possibilité de créer un ensemble modulaire d'assistants IA personnalisés basés sur le modèle Gemini qui peuvent être utilisés pour des projets allant du codage aux conseils de carrière. Selon Google, Gems est disponible pour les utilisateurs Gemini Advanced, Enterprise et Corporate.
« Avec Gems, vous pouvez créer une équipe d’experts pour vous aider à réfléchir à un projet ambitieux, à réfléchir à des idées pour un événement à venir ou à rédiger la légende parfaite pour une publication sur les réseaux sociaux », a déclaré Google dans un communiqué. « Votre Gem peut également mémoriser un ensemble d’instructions détaillées pour vous aider à gagner du temps sur les tâches fastidieuses, répétitives ou difficiles. »
Pour les créateurs qui n'ont pas forcément en tête l'invite exacte pour créer leurs Gems, Gemini propose également une fonction de réécriture alimentée par l'IA pour affiner l'invite qui les configure. Les résultats de Gem peuvent être partagés via un lien sur les réseaux sociaux et peuvent également être partagés sur Google Docs et Gmail pour être ajoutés à un brouillon d'e-mail.
« En ce qui concerne le partage, les gemmes que vous créez sont destinées à un usage personnel pour le moment », a déclaré un représentant de Google Décrypter« Vous pouvez partager les discussions que vous avez eues avec des Gemmes en créant un lien public, mais les discussions partagées avec des Gemmes ne peuvent pas être poursuivies par d'autres personnes avec lesquelles vous partagez le lien. »
Il s’agit d’une offre plus limitée que les GPT d’OpenAI, qui peut être partagée plus complètement avec d’autres personnes susceptibles d’utiliser la même personnalisation.
L'intégration de son imageur Image 3 étend également les capacités intégrées de Gemini, et le géant de la technologie a réitéré son approche prudente concernant le lancement.
« Nous effectuons des tests approfondis sur le réseau interne et externe et collaborons avec des experts indépendants pour garantir une amélioration continue », a déclaré le représentant de Google. « Nous avons une politique d'utilisation interdite et interdisons les réponses qui enfreignent nos politiques. »
Google a lancé Image 3 début août, après l'avoir annoncé en mai. Il fait face à une concurrence féroce de la part d'outils comme Dall-E d'OpenAI, Midjourney et Flux, qui est intégré au chatbot Grok d'Elon Musk.

« L’image 3 établit une nouvelle norme en matière de qualité d’image, en générant des images avec seulement quelques mots », a déclaré Google. « Vous pouvez même demander à Gemini de créer des images dans une variété de styles, tels que des paysages photoréalistes, des peintures à l’huile texturées ou des scènes en pâte à modeler. »
Bien que les Gémeaux puissent créer des images d’animaux et d’objets, la seule chose qu’ils ne peuvent pas encore faire est de créer des images de personnes.
« L'imagerie humaine sera bientôt disponible sur Gemini Advanced », répondra le chatbot si vous y êtes invité.

« Avec Image 3, nous avons fait des progrès significatifs pour offrir une meilleure expérience utilisateur lors de la génération d'images de personnes », a déclaré Google. « Nous ne prenons pas en charge la génération d'individus photoréalistes identifiables, les représentations de mineurs ou les scènes excessivement sanglantes, violentes ou sexuelles. »
« Bien sûr, comme pour tout outil d'IA générative, toutes les images créées par Gemini ne seront pas parfaites, mais nous continuerons à écouter les commentaires des premiers utilisateurs à mesure que nous poursuivrons nos améliorations », a ajouté Google. « Nous allons déployer cette fonctionnalité progressivement, avec pour objectif de la proposer bientôt à davantage d'utilisateurs et de langues. »
Généralement intelligent Bulletin
Un voyage hebdomadaire de l'IA raconté par Gen, un modèle d'IA génératif.
Voir l’article original en espagnol
