Google a publié le réseau neuronal Nano Banana 2

Google a publié le réseau neuronal Nano Banana 2

Google a publié Nano Banana 2, un nouveau modèle de génération visuelle fonctionnant aux vitesses Gemini Flash.

Le produit utilise la base de connaissances de Gemini et les données de recherche Web en temps réel. Cette approche permet au réseau neuronal de dessiner avec plus de précision des objets complexes, de générer des infographies et de convertir des notes textuelles en diagrammes visuels.

Nano Banana 2 peut également générer du texte clair et lisible dans les images, des conceptions marketing aux cartes postales. La fonction de localisation intégrée vous permet d'adapter le texte à n'importe quel public.

imageimage
Infographie générée par Nano Banana 2 sur le cycle de l'eau. Source : Google

Le modèle génère des images photoréalistes détaillées sans perte de vitesse. Principales différences entre Nano Banana 2 et la version précédente :

  • cohérence des objets : le réseau neuronal préserve l'apparence de jusqu'à cinq caractères et la précision de 14 objets au sein d'un même projet ;
  • précision d'exécution : le système comprend mieux les invites textuelles complexes et prend en compte les petites nuances, en suivant strictement la demande de l'utilisateur ;
  • flexibilité du format : Contrôle total sur le format d'image et la résolution de 512 px à 4K – des publications verticales aux écrans larges ;
  • qualité visuelle : Un éclairage brillant, des textures riches et des détails nets tout en conservant la vitesse de la ligne Flash.

Nano Banana 2 remplacera la version Pro des modèles Fast, Thinking et Pro de l'application Gemini. Les abonnés Google AI Pro et Ultra continueront d'avoir accès à Nano Banana Pro.

Le modèle est également intégré à la recherche Google (en mode AI et Lens), et est disponible en avant-première dans AI Studio et Gemini API.

Mise à jour du flux

Google a également introduit une version mise à jour du service de génération vidéo Flow. Les développeurs ont complètement repensé l'interface, combinant les capacités de génération d'images et de vidéos dans un seul espace de travail.

Le service Flow a intégré les meilleures fonctionnalités des plateformes expérimentales Whisk et ImageFX. Nano Banana 2 fait désormais partie des fonctionnalités de base. Les utilisateurs peuvent désormais créer des images et les utiliser immédiatement comme cadres pour générer des vidéos sans quitter le service.

La nouvelle grille d'actifs facilite la recherche, le filtrage, le tri et l'organisation des images et des vidéos en collections. L'outil Lasso vous permet de sélectionner précisément une zone d'une image et d'apporter des modifications via des requêtes textuelles, telles que « supprimer une personne » ou « ajouter des poissons koi à l'eau ». Un dessin direct sur les images pour indiquer les changements est également disponible.

Depuis son lancement, les utilisateurs de Flow ont créé plus de 1,5 milliard d'images et de vidéos pour des projets créatifs, notamment des films, des clips vidéo et des campagnes publicitaires, selon la société.

Rappelons qu'en février Google a présenté Gemini 3.1 Pro et mis à jour l'outil d'IA pour codage d'ambiance Opale.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !



Voir l’article original en russe

Audible
🎧 Découvrez le plaisir de l’écoute avec Audible d’Amazon ! Cliquez maintenant et obtenez votre premier livre audio GRATUIT. Ne manquez pas cette chance de transformer vos trajets en aventures épiques ! 📚