Modèles Gemini lancés par Google

Modèles Gemini lancés par Google

Google a lancé trois nouveaux modèles AI Gemini qui remodèlent la relation entre coût, vitesse et spécialisation en intelligence artificielle appliquée. Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber ils arrivent à un moment où la concurrence – d’Anthropic à OpenAI, en passant par des rivaux chinois comme Moonshot AI et Alibaba – ne laisse aucun répit. Le message de Google est clair : l'efficacité et le prix peuvent compenser le retard de certaines catégories de produits.

Points clés

  • Gemini 3.6 Flash réduit l'utilisation des jetons en sortie 17% par rapport au 3,5 Flashavec de meilleures performances en matière de codage, de travail de connaissances et de capacités multimodales.
  • Gemini 3.5 Flash-Lite est le modèle le plus rapide de la famille 3.5, avec 350 jetons de sortie par seconde et un coût de seulement 0,30 $ par million de jetons d'entrée.
  • Gemini 3.5 Flash Cyber ​​​​est optimisé pour la cybersécurité et sera disponible exclusivement pour les gouvernements et les partenaires sélectionnés grâce à un programme pilote limité.
  • 3.6 Flash et 3.5 Flash-Lite sont désormais disponibles via l'API Gemini, Google AI Studio, Android Studio, Gemini Enterprise Agent Platform, les applications Gemini et la recherche Google.
  • Google a commencé la pré-formation de Gemini 4, définie comme la version la plus ambitieuse jamais réalisée, tandis que Gemini 3.5 Pro est testé avec des partenaires.

Google présente trois nouveaux modèles AI Gemini

La série Flash de Gemini est née avec un objectif spécifique : trouver l'équilibre entre qualité et efficacité pour ceux qui construisent des agents d'IA en production. Avec les trois nouveaux modèles, Google répond à une demande concrète des développeurs : plus de débit, moins de coûts, moins de latence – sans sacrifier les performances.

Gemini 3.6 Flash est le modèle principal du nouveau triptyque. Construit directement sur les commentaires des développeurs sur Flash 3.5, il améliore les performances en matière de codage, de travail de connaissances et de capacités multimodales, tout en consommant moins de ressources. Selon les données de l’Artificial Analysis Index, utilise 17 % de jetons en moins en sortie par rapport à son prédécesseur. Dans certains benchmarks spécifiques, tels que DeepSWE de Datacurve, les économies atteignent jusqu'à 65 %.

Il ne s'agit pas simplement d'un avantage technique abstrait : moins de jetons en sortie signifie des coûts opérationnels inférieurs pour ceux qui gèrent des flux de travail agents à volume élevé. Et la tarification reflète cette logique : 1,50 $ par million de jetons d'entrée et 7,50 $ par million de jetons de sortiemoins que son prédécesseur 3,5 Flash.

Comparaison des performances : ce qui change vraiment

Les benchmarks internes montrent des améliorations réparties sur plusieurs fronts. Dans DeepSWE, 3.6 Flash atteint 49 % contre 37 % pour 3.5 Flash, avec moins de changements de code indésirables et moins de cycles d'exécution. Chez MLE Bench, la hausse est encore plus nette : 63,9% contre 49,7%. Sur le plan de l'utilisation de l'ordinateur, OSWorld-Verified obtient un score de 83,0 % contre 78,4 %.

Les clients aiment Hebbia et Harvey ils ont déjà trouvé des capacités particulièrement solides dans les tâches multimodales : analyse de documents, analyse de graphiques et de données, rédaction de rapports. Ce sont exactement les cas d’utilisation en entreprise où la combinaison de vitesse, de précision et de coût fait la différence.

Rapidité et coût : le rôle de Gemini 3.5 Flash-Lite

Si 3.6 Flash est le modèle de travail, Gemini 3.5 Flash-Lite est le moteur pour ceux qui ont besoin de volume. C'est le modèle le plus rapide de toute la famille 3.5 : 350 jetons de sortie par seconde selon les mesures d'analyse artificielle. Avec un prix de 0,30 $ par million de jetons en entrée et de 2,50 $ par million en sortie, il offre un rapport prix/performance conçu pour le trafic de production à haut débit.

La comparaison avec les générations précédentes est significative. Dans Terminal-Bench 2.1, 3.5 Flash-Lite obtient un score de 54 % contre 31 % pour 3.1 Flash-Lite. Dans GDM-MRCR v2 pour les contextes longs, 72,2 % contre 60,1 %. Et dans certains benchmarks d'agents et de codage, il surpasse même 3 Flash : sur SWE-Bench Pro, 54,2 % contre 49,6 % ; sur OSWorld-Verified, 74,0 % contre 65,1 %.

Le modèle prend en charge différents niveaux de « réflexion » configurables : du mode minimal pour les tâches à volume élevé et à faible latence, jusqu'aux niveaux plus élevés pour les flux de travail en plusieurs étapes avec des sous-agents. L'utilisation de l'ordinateur est désormais un outil intégré natif, disponible à la fois via Gemini API et Gemini Enterprise.

Modèle spécialisé en cybersécurité et limites d'accès

Le lancement le plus stratégiquement pertinent est peut-être celui de Gemini 3.5 Flash Cyberle premier modèle de la famille Gemini optimisé spécifiquement pour la cybersécurité. Construit sur Flash 3.5 et optimisé pour détecter et corriger les vulnérabilités du code, il fonctionne dans CodeMenderL'agent de sécurité du code de Google.

L'architecture est conçue pour répondre à un problème réel : les modèles d'IA sont déjà capables de trouver les vulnérabilités plus rapidement que les systèmes actuels ne peuvent les corriger. CodeMender utilise plusieurs agents Flash Cyber ​​​​3.5 en parallèle pour produire un rapport combiné, obtenant ainsi des performances compétitives sur le benchmark CyberGym.

Accès réservé aux gouvernements et aux partenaires de confiance

La double nature de cette technologie – utile pour la défense, potentiellement dangereuse si elle est utilisée de manière offensive – a poussé Google à adopter une approche délibérément prudente. L'accès à 3.5 Flash Cyber ​​​​est limité aux gouvernements et aux partenaires de confiance uniquement via un programme pilote à disponibilité limitée via CodeMender.

L’objectif avancé est de donner aux défenseurs de première ligne une longueur d’avance pour identifier et corriger les vulnérabilités critiques avant qu’elles ne puissent être exploitées, tout en limitant le risque d’abus. C'est un choix qui positionne Google en concurrence directe avec Anthropic, qui a pris une longueur d'avance dans l'automatisation de la défense du code avec son modèle Mythos.

Disponibilité et protections de sécurité intégrées

Gemini 3.6 Flash et Gemini 3.5 Flash-Lite sont disponibles immédiatement via divers canaux : API Gemini via Google AI Studio et Android Studio pour les développeurs, Gemini Enterprise Agent Platform pour les entreprises, l'application Gemini pour les utilisateurs finaux. 3.5 Flash-Lite arrive également dans la recherche Google.

Protections Frontier Safety dans Gemini 3.6 Flash

Sur le plan de la sécurité, la version 3.6 Flash introduit des mesures de sécurité renforcées aux frontières dans les domaines CBRN – chimiques, biologiques, radiologiques, nucléaires – et dans la prévention des abus dans les cyber-environnements offensifs. Le modèle a été conçu pour être plus résistant aux jailbreaks, tout en conservant un faible seuil de rejet pour les utilisations légitimes.

C'est un équilibre difficile à trouver, et Google le reconnaît implicitement : le défi n'est pas seulement de rendre les modèles plus performants, mais de le faire de manière à ce que la capacité supplémentaire ne se transforme pas en vecteur de risque.

En arrière-plan, Google a confirmé que la pré-formation de Gemini 4 avait déjà commencé – considérée comme la version la plus ambitieuse de l'entreprise à ce jour – tandis que Gemini 3.5 Pro était en cours de test avec des partenaires avant sa sortie générale. La trajectoire est tracée : l’efficacité d’abord, puis la puissance. Mais la vraie question est de savoir si Google sera capable de maintenir le rythme de sortie nécessaire pour ne pas perdre du terrain dans les segments où accélèrent les concurrents Anthropic, OpenAI et chinois.

FAQ

Quelles sont les améliorations majeures de Gemini 3.6 Flash par rapport à 3.5 Flash ?

Gemini 3.6 Flash réduit l'utilisation des jetons de sortie de 17 %, améliore les performances de codage et de travail de connaissances et réduit le coût par jeton par rapport à 3,5 Flash. Le prix est de 1,50 $ par million de jetons en entrée et de 7,50 $ par million en sortie.

Qui peut accéder au modèle Gemini 3.5 Flash Cyber ​​​​?

L'accès à Gemini 3.5 Flash Cyber ​​​​est disponible exclusivement pour les gouvernements et les partenaires de confiance via un programme pilote à disponibilité limitée via la plateforme CodeMender.

Où sont disponibles Gemini 3.6 Flash et 3.5 Flash-Lite ?

Ils sont disponibles via l'API Gemini, Google AI Studio, Android Studio, Gemini Enterprise Agent Platform, l'application Gemini et la recherche Google, à partir du 21 juillet 2026.

Quelles mesures de sécurité Gemini 3.6 Flash inclut-il ?

Gemini 3.6 Flash inclut des mesures de sécurité renforcées aux frontières dans les domaines chimiques, biologiques, radiologiques, nucléaires et cyberoffensifs, avec une résistance accrue aux jailbreaks et un seuil de rejet réduit pour les utilisations légitimes.

Contenu créé avec l’aide de l’intelligence artificielle et de la révision éditoriale humaine.

Voir l’article original en italien