Mise à jour majeure de Chrome : barre latérale Gemini, Nano Banana et Personal Intelligence

Mise à jour majeure de Chrome : barre latérale Gemini, Nano Banana et Personal Intelligence

Google intègre de nouveaux outils d'IA optimisés par Gemini dans le navigateur Chrome. Les principales innovations étaient le générateur d'images Nano Banana, Personal Intelligence et Auto View.

Intégration dans l'interface

L'assistant IA, ajouté en septembre 2025 sous forme de fenêtre flottante, est désormais ancré dans la barre latérale. L'utilisateur pourra poser des questions sur le site Web exploré ou sur d'autres onglets ouverts.

Innovation – analyse de plusieurs onglets dans un seul tout. Lorsqu'un utilisateur ouvre différentes pages d'un même site, l'assistant numérique ne les voit pas séparément, mais comme un seul groupe contextuel.

Auparavant, Gemini dans Chrome n'était disponible que pour les utilisateurs Windows et macOS. Après la mise à jour, il est ouvert aux utilisateurs de Chromebook Plus.

Intelligence personnelle

La société utilise la fonctionnalité Personal Intelligence récemment lancée, qui se connecte aux comptes Gmail, Search, YouTube et Google Photos et vous permet de poser des questions basées sur des données personnelles.

La fonctionnalité arrivera dans les mois à venir et vous permettra d'interroger le chatbot sur des choses comme votre emploi du temps familial ou de rédiger un e-mail sans passer à Gmail.

Nano Banane

L'outil vous permet d'éditer et de modifier des images en utilisant d'autres images trouvées sur Internet comme références.

« Vue automatique »

L'agent IA est capable d'effectuer des tâches de manière autonome : suivre des liens, effectuer des achats ou rechercher des bons de réduction. Il vous demandera d'intervenir si vous devez manipuler des données confidentielles.

Risques de sécurité

Les navigateurs IA deviennent une tendance dans le secteur de l’intelligence artificielle, mais ils comportent des risques importants pour les utilisateurs. En décembre 2025, OpenAI parlait des vulnérabilités existantes.

La société a reconnu que les attaques par injection rapide constituent un problème.

« Il est peu probable qu'une telle vulnérabilité, comme la fraude et l'ingénierie sociale sur Internet, soit complètement éliminée », ont écrit les représentants d'OpenAI.

Anthropic et Google adoptent une position similaire, s'appuyant sur une protection multicouche et des tests de résistance réguliers.

Vision Agent chez Gemini

En parallèle, Google a introduit Agentic Vision, une fonctionnalité qui permet d'étudier les fichiers plus en détail en mode agent IA.

La société a expliqué que les LLM de nouvelle génération comme Gemini traitent généralement les informations sur le monde qui les entoure en un seul coup d'œil statique. S’ils oublient de petits détails comme un numéro de série sur une puce électronique ou un panneau routier retiré, ils « font des hypothèses ».

Agentic Vision dans Gemini 3 Flash transforme la compréhension des images d'une activité statique en un processus actif. Le modèle se comporte comme un analyste humain :

  • évalue l'image globale;
  • identifie les domaines prioritaires ;
  • construit un plan pour tester les hypothèses ;
  • étudie les petits éléments en détail.

En conséquence, la précision de la reconnaissance augmente de 5 à 10 %.

imageimage
Source : Google

Agentic Vision introduit le cycle de réflexion, d'action et d'observation dans les tâches de compréhension d'images :

  • pense — L'IA analyse la demande de l'utilisateur et l'illustration originale, formant un plan en plusieurs étapes ;
  • acte — le modèle génère et exécute du code Python pour travailler avec l'image (recadrage, rotation) ;
  • observation — l'image convertie est ajoutée à la fenêtre contextuelle du modèle.
imageimage
Source : Google

Gemini 3 Flash est formé pour agrandir l'image lors de la détection de petits détails.

La version bêta d'Agentic Vision est disponible gratuitement dans Google AI Studio, Vertex AI, Gemini API pour les développeurs et le chatbot Gemini en mode Thinking.

Rappelons qu'en décembre 2025, Google a publié le modèle de langage Gemini 3 Flash et l'a rendu standard dans l'application Gemini et le mode IA dans le moteur de recherche.

Abonnez-vous à ForkLog sur les réseaux sociaux

Vous avez trouvé une erreur dans le texte ? Sélectionnez-le et appuyez sur CTRL+ENTRÉE

Newsletters ForkLog : restez à l’écoute de l’industrie Bitcoin !



Voir l’article original en russe

Amazon music unlimited
Rejoignez dès maintenant Amazon Music Unlimited et plongez dans un univers de 100 millions de titres sans publicité. Profitez de 30 jours d’essai gratuit pour une expérience musicale inégalée !