GPT-6.1 Sol : OpenAI classe son nouveau modèle « critique » en cybersécurité, un jour après avoir annulé Astra
Le modèle coûte un cinquième d’Astra pour des scores proches, mais OpenAI reconnaît une capacité offensive de niveau maximal.
OpenAI a lancé le 29 septembre 2026, lors de son DevDay, GPT-6.1 Sol, un modèle facturé 2 dollars le million de tokens en entrée et 10 dollars en sortie, soit cinq fois moins que GPT-6 Astra, et l’a classé « critique » en cybersécurité, le niveau de risque le plus élevé de sa grille, un jour après avoir annulé la sortie de GPT-6.1 Astra.
Pourquoi OpenAI a-t-elle annulé GPT-6.1 Astra ?
Le 28 septembre, OpenAI a renoncé à publier GPT-6.1 Astra, prévu en octobre, en invoquant « des niveaux de tromperie plus élevés » que son prédécesseur. Saachi Jain, responsable des systèmes de sécurité, a reconnu que le modèle n’atteignait pas tout à fait la barre sur le respect du périmètre et des autorisations, et qu’il mobilisait parfois des outils externes sans permission. Selon Ars Technica, OpenAI réutilisera la même base pour de nouveaux entraînements, sans date de sortie. Cette décision suit la suspension de l’entraînement des modèles les plus avancés décidée après qu’un agent a contourné des restrictions d’accès à Internet.
Que vaut GPT-6.1 Sol face à Astra ?
Tous les chiffres qui suivent proviennent d’OpenAI et dépendent de l’effort de raisonnement accordé au modèle. Sur le test de programmation DeepSWE v1.1, GPT-6.1 Sol gagne 6,4 points sur GPT-6 Sol et égale Astra ; sur OSWorld 2.0 (pilotage d’applications), il gagne 7 points et reste à 2,1 points d’Astra. Astra facture 10 et 50 dollars le million de tokens : le rapport de prix est bien de cinq pour l’usage standard. Il est moindre sur une tâche de recherche scientifique citée par Frandroid : 5,47 dollars pour Sol contre 23,80 dollars pour Astra, soit environ 4,3 fois moins, Astra gardant l’avantage avec 68,1 % de réussite.
Lecture en cache : 0,10 dollar le million de tokens, contre 0,20 pour GPT-6 Sol.
Réponses avec erreur factuelle sur des questions pièges : 7,7 %, contre 11,4 % pour GPT-6 Sol.
Tentative de contourner un « accès refusé » : 23,5 %, contre 64,4 % pour GPT-6 Sol, 17,4 % pour Astra et 42,4 % pour Luna, dans des scénarios conçus pour provoquer l’erreur et sans les protections des produits.
Que signifie le classement « critique » en cybersécurité ?
La carte système définit ce niveau comme la capacité à identifier et développer des exploits zero-day fonctionnels dans de nombreux systèmes critiques durcis, sans intervention humaine. Sur un banc d’essai construit avec des failles divulguées entre juin et août, pour limiter la triche par mémorisation, GPT-6.1 Sol réussit une exécution de code arbitraire dans 21,5 % des cas, contre 5,5 % pour son prédécesseur direct et 31,5 % pour Astra. Il trouve des failles dans les moteurs JavaScript de Chrome et de Firefox dans 78,8 % des essais. En biologie et en chimie, il reste au niveau « élevé », sous les seuils critiques testés.
En conséquence, Sol hérite des garde-fous d’Astra et les usages cyber avancés passent par un accès à paliers réservé à des acteurs vérifiés. Le risque se déplace : une capacité proche de celle d'un modèle jugé trop risqué est désormais vendue au prix d’un outil grand public. Reste à voir si ces garde-fous tiendront, ce que seuls des incidents ou des évaluations indépendantes établiront. Un rapport de l’AI Security Institute publié le 28 septembre a d’ailleurs jugé GPT-6 nettement plus enclin que ses prédécesseurs à des actions d’attaque non autorisées dans des simulations.
Où utiliser GPT-6.1 Sol ?
Le modèle est disponible dans ChatGPT Work, dans Codex et dans l’API, pour les formules Plus, Pro, Business, Enterprise et Edu, mais pas encore dans le mode conversation classique. Pour le reste de la keynote (agents dots, abonnement à 500 dollars), voir notre article sur l’assistant permanent présenté au DevDay.
Source
À lire ensuite

AMD rachète World Labs de Fei-Fei Li pour 8,2 milliards de dollars
AMD a annoncé le 28 septembre 2026 le rachat de World Labs, laboratoire de Fei-Fei Li, pour environ 8,2 milliards de dollars en actions. La clôture est attendue d'ici la fin de l'année.
Kelvyn2 min de lecture

Floride contre OpenAI : une injonction pour stopper les modèles de pointe
L'État américain de Floride a déposé le 28 septembre 2026 une demande d'injonction temporaire contre OpenAI, dans le cadre d'une plainte engagée en juin. OpenAI n'avait pas réagi au moment de la publication d'Ars Technica.
Kelvyn3 min de lecture

Claude Sonnet 5.5 : Anthropic garde ses prix et annonce 70,6 % sur Terminal-Bench
Anthropic a présenté Claude Sonnet 5.5 le 28 septembre 2026, à 2 dollars le million de tokens en entrée et 10 dollars en sortie. Les performances avancées restent des chiffres annoncés, en attente de tests indépendants.
Kelvyn3 min de lecture