GPT-6.1 Sol : performances, tarifs et disponibilité du nouveau modèle d’OpenAI

Une semaine après la sortie de GPT-6 Sol, OpenAI dévoile une version améliorée qui égale Astra sur certains tests de code. Le tarif ne change pas, mais le modèle est désormais classé au niveau critique en cybersécurité.

GPT-6-1-Sol
Avec GPT-6.1 Sol, OpenAI rapproche son modèle intermédiaire des performances d'Astra, dévoilé début septembre. © OpenAI

À l’occasion du DevDay 2026, la conférence qu’elle consacre aux développeurs, OpenAI a présenté le 29 septembre plus d’une vingtaine de nouveautés autour de ChatGPT, de Codex et de son API. Parmi ces annonces, la firme américaine a dévoilé GPT-6.1 Sol, une mise à jour de son précédent modèle, qui cible le code agentique, l’utilisation autonome de l’ordinateur et les tâches professionnelles complexes. On fait le point.

Pour afficher ce contenu issu des réseaux sociaux, vous devez accepter les cookies et traceurs publicitaires.

Ces cookies et traceurs permettent à nos partenaires de vous proposer des publicités et des contenus personnalisés en fonction de votre navigation, de votre profil et de vos centres d’intérêt.Plus d’infos.

Accepter

Un modèle intermédiaire qui talonne Astra

Dans la gamme GPT-6, GPT-6.1 Sol se place entre Luna, pensé pour les tâches rapides à fort volume, et Astra, le plus puissant des trois. D’après les tests publiés par OpenAI, il se rapproche nettement de ce dernier, jusqu’à l’égaler sur certaines évaluations, pour un coût bien inférieur :

  • Sur DeepSWE v1.1, un test d’ingénierie logicielle mené sur de vraies bases de code, il obtient le même score qu’Astra pour environ un cinquième du coût.
  • Sur OSWorld 2.0, consacré au pilotage d’applications, il se situe à 2,1 points d’Astra à effort de raisonnement maximal, pour environ un septième du coût par tâche.
  • Sur AutomationBench, qui évalue l’exécution de workflows métier en plusieurs étapes, il devance Claude Opus 5.5 de 2,2 points à effort moyen, pour environ un tiers du coût.

Les erreurs factuelles reculent aussi sur des requêtes volontairement difficiles. Avec un effort de raisonnement très élevé, 4,1 % des réponses du modèle en contiennent au moins une, contre 4,5 % pour GPT-6 Sol et 4,0 % pour Astra.

DeepSWE-GPT-6-1-Sol
Sur DeepSWE, GPT-6.1 Sol égale GPT-6 Astra pour environ un cinquième du coût et dépasse de 6,4 points le meilleur score de GPT-6 Sol, selon OpenAI. © OpenAI

Disponibilité et prix de GPT-6.1 Sol

GPT-6.1 Sol est disponible dans ChatGPT Work et dans Codex pour les abonnés Plus, Pro, Business, Enterprise et Edu. Il n’est pas encore proposé dans le chat classique de ChatGPT.

Dans l’API, il est facturé au même prix que GPT-6 Sol, soit 2 $ par million de tokens en entrée et 10 $ en sortie. Le contexte réutilisé d’une requête à l’autre (le cache) coûte en revanche moins cher qu’au lancement de GPT-6 Sol, à 0,10 $ par million de tokens.

Une version jusqu’à huit fois plus rapide selon OpenAI, GPT-6.1 Sol Ultrafast, est accessible dans l’API, ainsi que dans ChatGPT Work et Codex avec la nouvelle offre Pro à 500 $ par mois.

Les mêmes garde-fous qu’Astra et un accès cyber sous contrôle

En parallèle de cette annonce, OpenAI a publié la carte système de GPT-6.1 Sol, un document technique qui détaille les tests de sécurité menés sur le modèle avant sa sortie. L’entreprise y évalue notamment son niveau de risque dans plusieurs domaines sensibles (cybersécurité, biologie et chimie, capacité de l’IA à s’améliorer elle-même), selon une grille interne baptisée Preparedness Framework.

En matière de cybersécurité, GPT-6.1 Sol atteint le niveau « critique », soit le plus élevé de cette grille. Ce seuil correspond, d’après OpenAI, à un modèle capable de développer sans intervention humaine des exploits zero-day fonctionnels contre de nombreux systèmes renforcés. GPT-6 Astra était le premier modèle à l’atteindre, début septembre.

Sur une version interne d’ExploitBench, limitée à des failles récentes pour écarter l’effet de mémorisation, GPT-6.1 Sol parvient à exécuter du code arbitraire dans 21,5 % des cas, contre 5,5 % pour GPT-6 Sol et 31,5 % pour Astra. Ce classement « critique » conduit OpenAI à lui appliquer les mêmes protections qu’à Astra et à réserver les usages cyber les plus avancés aux acteurs vérifiés de Daybreak, son programme de cyberdéfense.

À noter aussi que ses évaluations d’alignement progressent par rapport à GPT-6 Sol, avec une nuance. Face à une restriction rencontrée pendant une tâche courante, il tente de la contourner dans 23,5 % des cas, contre 17,4 % pour Astra. OpenAI précise que ce test porte sur des restrictions à faible enjeu, et qu’il est mené sans les contrôles appliqués en production.

Un rythme de lancements qui ne semble pas prêt de ralentir

Selon le Wall Street Journal, OpenAI avait renoncé, la veille du DevDay, à la sortie de GPT-6.1 Astra, attendue en octobre dans ChatGPT et Codex. D’après le média américain, ce modèle se montrait moins transparent que son prédécesseur sur les actions qu’il avait menées, lors de tests internes, allant même jusqu’à poursuivre parfois une tâche sans demander l’autorisation de l’utilisateur.

Le même jour, Anthropic a aussi présenté son nouveau modèle, Claude Sonnet 5.5, facturé aux mêmes tarifs d’entrée et de sortie que GPT-6.1 Sol dans l’API. Au 23 septembre 2026, nous avions déjà recensé 32 annonces de modèles depuis janvier, malgré les appels des laboratoires à ralentir le développement de l’IA. Reste à savoir combien de temps ce discours de prudence pourra encore cohabiter avec un calendrier de sorties qui, lui, ne cesse de s’accélérer.

Sujets liés :
Publier un commentaire
Ajouter un commentaire

Votre adresse email ne sera pas publiée.

Les meilleurs générateurs de texte par IA