Avec Gemini 3.6 Flash et 3.5 Flash Lite, Google améliore ses modèles et baisse ses prix

Google déploie Gemini 3.6 Flash et 3.5 Flash-Lite pour les développeurs, et réserve 3.5 Flash Cyber aux gouvernements. Le modèle Pro se fait toujours attendre.

gemini-3-5_3-6_3-5-Cyber__key-ar.width-2200.format-webp – copie
Les 3 nouveaux modèles Gemini sont pensés pour l'agentique, avec une promesse de coûts réduits. © Google

Google poursuit l’expansion de sa famille de modèles Gemini. Dans un billet publié le mardi 21 juillet 2026, l’entreprise a présenté trois nouveaux modèles pensés pour l’exécution d’agents IA à grande échelle. Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber partagent le même objectif, à savoir plus d’efficacité, moins de latence et un coût réduit.

Trois modèles Gemini Flash orientés efficacité et coût

La série Flash de Gemini vise le compromis entre qualité et efficacité pour faire tourner des workflows agentiques. Les trois nouveaux modèles s’inscrivent dans cette logique :

  • Gemini 3.6 Flash : le modèle « workhorse » de la gamme, revendique de meilleures performances en développement, en travail de connaissance et en multimodal. Google indique qu’il réduit de 17 % la consommation de tokens de sortie par rapport à 3.5 Flash, selon l’Artificial Analysis Index, avec des pointes à 65 % sur certains benchmarks comme DeepSWE.
  • Gemini 3.5 Flash-Lite : le modèle le plus rapide et le plus économique de la série 3.5. Il génère 350 tokens par seconde et cible les tâches à fort volume, comme la recherche agentique ou le traitement de documents.
  • Gemini 3.5 Flash Cyber : un modèle spécialisé, affiné pour détecter et corriger des vulnérabilités de sécurité. Il fonctionne au sein de CodeMender, l’agent de sécurité de Google.

Une comparaison des modèles proposée par Google :

Les deux premiers modèles intègrent désormais l’usage de l’ordinateur (computer use) comme outil natif. Gemini 3.6 Flash et 3.5 Flash-Lite sont disponibles dès aujourd’hui pour les développeurs via l’API Gemini, pour les entreprises via Gemini Enterprise et pour tous dans l’application Gemini. Le modèle Cyber reste quant à lui réservé aux gouvernements et partenaires de confiance, dans le cadre d’un programme pilote à accès limité, en raison de son caractère à double usage.

Les tarifs des nouveaux modèles Flash

Pour un million de tokens :

  • Gemini 3.6 Flash : 1,50 $ en entrée, 7,50 $ en sortie
  • Gemini 3.5 Flash-Lite : 0,30 $ en entrée, 2,50 $ en sortie

Google précise que 3.6 Flash est facturé moins cher que son prédécesseur 3.5 Flash.

Toujours pas de Gemini 3.5 Pro à l’horizon

Ces lancements se distinguent autant par leur variété que par l’absence d’une version orientée performance. En effet, Google n’a toujours pas mis à jour son modèle haut de gamme, Gemini Pro, dont la dernière version remonte à février 2026. La firme avait pourtant évoqué l’arrivée prochaine d’un 3.5 Pro lors du lancement de Gemini 3.5 Flash, en mai dernier.

Dans son billet, Google indique que 3.5 Pro est en cours de test auprès de partenaires et sera déployé « dès qu’il sera prêt ». Selon Bloomberg, l’entreprise ferait face à des retards internes, le modèle peinant à atteindre ses objectifs de performance, notamment en matière de code. En parallèle, les équipes ont lancé le run de pré-entraînement décrit comme le plus ambitieux à ce jour pour Gemini 4.

Ce calendrier intervient dans un contexte de forte pression concurrentielle. Depuis février, OpenAI a déployé GPT-5.5 puis GPT-5.6, tandis qu’Anthropic a lancé Claude Opus 4.8, Sonnet 5 et étendu l’accès à son modèle Fable 5.

Sujets liés :
Publier un commentaire
Ajouter un commentaire

Votre adresse email ne sera pas publiée.

Visuel enquête Visuel enquête

Community managers : participez à notre enquête 2026

L'objectif est de comprendre comment évolue votre métier : missions, réseaux utilisés, outils...

Je participe

Les meilleurs agents IA