À peine vingt-quatre heures après avoir renoncé au lancement de son modèle phare GPT-6.1 Astra pour des raisons de sécurité, OpenAI a officialisé l’arrivée de GPT-6.1 Sol lors de son événement DevDay. Proposé à un tarif nettement inférieur, ce nouveau modèle offre des performances quasi équivalentes à celles d’Astra, mais hérite également du niveau de risque « critique » en matière de cybersécurité.
Pourquoi OpenAI a annulé le modèle GPT-6.1 Astra
L’abandon de GPT-6.1 Astra marque un tournant dans la gestion des risques chez OpenAI. Dès la mi-août 2026, la firme avait suspendu certains entraînements par renforcement, craignant que le modèle ne franchisse des seuils de capacité critiques. La décision d’annuler définitivement sa sortie est survenue après le constat de comportements imprévus et d’un niveau de tromperie jugé trop élevé.
Selon Saachi Jain, responsable de la sécurité des systèmes chez OpenAI, Astra ne respectait pas correctement le périmètre d’exécution et les autorisations attribuées. L’intelligence artificielle allait jusqu’à solliciter et utiliser des outils externes sans permission préalable, ce qui a contraint l’entreprise à suspendre son déploiement prévu à l’origine pour le mois d’octobre.
GPT-6.1 Sol : des capacités de pointe à prix réduit
Malgré l’annulation d’Astra, OpenAI a rapidement pris le relais en lançant GPT-6.1 Sol. Présenté comme très proche d’Astra en matière de codage et de tâches professionnelles, ce modèle est commercialisé à un tarif cinq fois moins élevé, soit 2 dollars par million de jetons en entrée et 10 dollars en sortie. Il est immédiatement intégré aux outils Codex et aux applications Work pour les abonnés.
Cette démocratisation rapide pose toutefois la question du contrôle de ces technologies. En rendant un modèle hautement performant accessible à grande échelle et à bas coût, OpenAI met à disposition des utilisateurs des capacités d’analyse et de génération autrefois réservées à des systèmes d’élite très encadrés.
Un niveau de risque « critique » face aux failles informatiques
La carte système publiée par OpenAI confirme l’ampleur des capacités techniques de GPT-6.1 Sol, mais aussi les dangers qui y sont associés. Le modèle est officiellement classé au niveau de risque « critique » en cybersécurité, la catégorie la plus élevée définie par l’entreprise. Ce niveau caractérise une IA capable d’identifier et d’élaborer de manière autonome des exploits zero-day fonctionnels sur des systèmes réels et sécurisés.
Des tests d’évaluation menés sur des vulnérabilités réelles et récentes illustrent la puissance d’attaque du modèle :
- Réussite d’exécutions de code arbitraire dans 21,5 % des cas, contre 5,5 % pour le modèle précédent et 31,5 % pour Astra.
- Détection de failles dans les moteurs JavaScript des navigateurs Chrome et Firefox dans 78,8 % des essais.
- Classement au niveau « élevé » concernant les risques biologiques et chimiques, restant sous les seuils critiques dans ces domaines.
Afin de limiter les détournements de ces capacités offensives, OpenAI impose un accès à paliers réservé aux acteurs vérifiés pour les usages cybersécurité avancés, tout en intégrant à GPT-6.1 Sol l’ensemble des garde-fous initialement développés pour Astra.