Google dévoile Gemini 3.8 Flash et une déclinaison dédiée à la cybersécurité

Le modèle Gemini Flash 3.8 progresse sur le code et les tâches agentiques. En contrepartie, il consomme davantage de tokens sur les demandes complexes.

gemini-3-8_flash-cyber
À peine trois semaines après la sortie de Gemini 3.7 Flash, Google présente déjà la version 3.8. © Google

Google enchaîne les sorties sur sa gamme Gemini. En seulement six semaines, la firme de Mountain View vient de publier sa troisième mouture Flash, la version 3.8, cette fois déclinée en deux variantes bâties sur la même base technique.

Gemini 3.8 Flash, un modèle qui multiplie les étapes de raisonnement

Gemini 3.8 Flash est la version destinée au plus grand nombre. Google la présente comme son « meilleur modèle de raisonnement et de code à ce jour », pour une vitesse et un coût – a priori – équivalents à ceux de son prédécesseur, 3.7 Flash. La démonstration s’appuie principalement sur DeepSWE v1.1, un benchmark d’ingénierie logicielle consacré aux tâches longues, où le modèle devance, selon l’entreprise, la plupart des modèles frontière plus volumineux.

Ces gains ont une contrepartie. Le modèle « travaille plus », écrit Google. Il exécute davantage d’étapes de raisonnement et appelle les outils de façon itérative, ce qui alourdit la consommation de tokens aux niveaux d’effort élevés. Pour les charges où le coût de calcul reste la contrainte principale, Google conseille de baisser le niveau d’effort ou de rester sur 3.7 Flash, toujours maintenu.

Ces gains de performance découlent d’un choix de conception fondamental : 3.8 Flash travaille davantage. Sur les tâches complexes, il fait preuve d’une plus grande rigueur, en exécutant des étapes de raisonnement supplémentaires et en appelant les outils de manière itérative. Le modèle peut parfois utiliser plus de jetons pour optimiser les performances, notamment lorsque le niveau d’effort est élevé.

Le modèle est d’ores et déjà disponible pour :

  • Les développeurs, avec Google Antigravity, l’API Gemini via Google AI Studio, Android Studio et Stitch.
  • Les entreprises, avec Gemini Enterprise.
  • Les abonnés Google AI Pro et Ultra, dans l’application Gemini, dans l’AI Mode de Search et dans Google Sheets.

Les tarifs de Gemini 3.8 Flash

Google reconduit le tarif d’introduction appliqué à 3.7 Flash jusqu’au 31 décembre 2026 :

  • 0,75 $ par million de tokens en entrée
  • 3,75 $ par million de tokens en sortie

Au 1er janvier 2027, ces montants doubleront, à 1,50 $ en entrée et 7,50 $ en sortie.

Une version cyber réservée à un cercle fermé

La seconde variante, Gemini 3.8 Flash Cyber, cible la détection de vulnérabilités et la correction automatisée. Google indique avoir priorisé cette correction sur les capacités offensives comme l’exploitation… un petit tacle glissé à ses concurrents ! L’accès reste conditionné à une candidature au programme Fairwind, ouvert aux autorités publiques, aux opérateurs d’infrastructures critiques et aux mainteneurs de logiciels. Le principe n’est pas nouveau, 3.5 Flash Cyber était déjà réservé aux gouvernements.

Google avance un effet de bord à cet entraînement spécialisé. Les progrès en code et en raisonnement du socle commun aux deux variantes viendraient en partie du travail mené sur la cybersécurité, un domaine que l’entreprise décrit comme « particulièrement exigeant ».

Les garde-fous diffèrent d’une variante à l’autre. 3.8 Flash embarque des protections contre les usages détournés dans les domaines CBRN (Arme nucléaire, radiologique, bactériologique et chimique, ndlr) et cyberoffensif, au titre du Frontier Safety Framework de Google. La version Cyber applique, elle, des mitigations plus permissives en cybersécurité, ce qui explique son accès restreint.

Sujets liés :
Publier un commentaire
Ajouter un commentaire

Votre adresse email ne sera pas publiée.

Les meilleurs agents IA