Google lance le modèle d'IA « le plus puissant » Gemini

Google lance le modèle d'IA « le plus puissant » Gemini

Google a dévoilé Gemini 3.5 Flash, « le modèle d'IA le plus puissant pour programmer et créer des agents.

Elle est capable de coder de manière indépendante, de gérer des projets de recherche et de créer un système d'exploitation à partir de zéro.

Gemini 3.5 Flash est devenu le premier LLM dans la nouvelle gamme Gemini 3.5, une famille de modèles qui allie haut niveau de capacité et performance. Le réseau neuronal est conçu pour les tâches complexes en plusieurs étapes et les longs flux de travail.

imageimage
Performances Gemini 3.5 Flash dans les principaux benchmarks. Source : Google

Google affirme que 3,5 Flash génère quatre fois plus de jetons par seconde par rapport aux autres modèles avancés. Gemini 3.5 Pro devrait sortir le mois prochain.

La société présente ce lancement comme un passage de l’IA conversationnelle à l’IA basée sur des agents. Le modèle est conçu pour les tâches où le système doit non seulement répondre aux questions, mais également exécuter systématiquement les instructions.

Pour certaines actions, comme l'envoi de lettres ou la réalisation de transactions financières, l'agent demandera une autorisation supplémentaire.

Gemini 3.5 Flash est implémenté dans l'application Gemini, ainsi que dans d'autres produits de la société. Dans un blog destiné aux développeurs, Google écrit que le modèle devrait « accélérer la transition des invites aux actions ».

La société a également présenté Gemini Spark, un assistant personnel d'IA qui vous aide à accomplir vos tâches quotidiennes. Il fonctionne sur Gemini 3.5 et peut interagir de manière transparente avec les services Google.

Autres versions

Antigravité 2.0

Antigravity 2.0 est une autre nouvelle version. L'application agit « comme une plate-forme centrale pour les interactions des agents ». Il permet de coordonner le travail de plusieurs assistants numériques pour effectuer des tâches en parallèle.

Prend en charge les sous-agents dynamiques pour différents flux de travail, les tâches planifiées pour l'automatisation en arrière-plan et l'intégration de l'écosystème, notamment Google AI Studio, Android et Firebase.

Parmi les innovations :

  • Antigravity CLI – fournit « une interface légère et performante qui vous permet de créer instantanément de nouveaux agents sans utiliser d'interface utilisateur graphique ;
  • SDK Antigravity : accès par programmation au même ensemble d'outils d'agent que celui utilisé dans les produits Google ;
  • Antigravity sur Gemini Enterprise Agent Platform simplifie les charges de travail des entreprises en permettant aux clients Google Cloud de connecter le service directement à leurs projets.

Un nouveau forfait Google AI Ultra a été introduit pour 100 $ par mois. Il offre une limite d’utilisation en Antigravity cinq fois supérieure à celle de Google AI Pro.

Omni

La société a présenté le Gemini Omni, un modèle conçu pour « réaliser les fantasmes ».

« En combinant de manière transparente du texte, des images et des vidéos, le réseau neuronal vous permet de créer sans effort des vidéos époustouflantes de haute qualité », indique le communiqué.

Les utilisateurs peuvent appliquer des effets de zoom cinématographiques ou modifier les arrière-plans à l'aide d'une invite de texte.

Google Photos

Google Pics est un nouvel outil de création et d'édition d'images. Il peut être utilisé pour créer « presque n’importe quoi, des affiches de fête aux infographies ».

Pics met automatiquement en évidence les objets dans les photos et analyse leurs relations.

Agents gérés dans l'API Gemini

Google a introduit les agents gérés dans API Gémeaux. Avec un seul appel, vous pouvez lancer un assistant numérique capable de penser logiquement, d'utiliser des outils et d'exécuter du code dans un environnement Linux isolé.

Les assistants IA sont alimentés par la plateforme Antigravity, construite sur Gemini 3.5 Flash et accessible via API Interactions et Google AI Studio.

Google a également annoncé des travaux sur des lunettes intelligentes et a montré le design de la future collection d'automne.

Rappelons qu'en mai Google DeepMind a présenté un curseur de souris d'ordinateur doté d'une intelligence artificielle basée sur Gemini – l'entreprise entend repenser une technologie qui n'a pas changé depuis plus d'un demi-siècle.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !



Voir l’article original en russe