GPT-6.1 Sol vs Astra : presque le même niveau pour un cinquième du prix

 
OpenAI présente GPT-6.1 Sol au DevDay, sept jours après GPT-6 Sol, au même prix et avec des scores qui frôlent ceux d’Astra, son modèle haut de gamme. Derrière la course aux benchmarks et le mode Ultrafast à 300 tokens par seconde, le chiffre qui compte se cache dans les tests de sécurité.

Si vous avez basculé sur GPT-6 Sol le 22 septembre, vous avez tenu une semaine. Voici GPT-6.1 Sol, présenté ce mardi au DevDay (présenté aux côtés de dots). Le nouveau modèle coûte exactement le même prix, et OpenAI le décrit comme la version économique de son haut de gamme GPT-6 Astra. On en est à un rythme où l’article sur le modèle précédent n’a pas eu le temps de refroidir.

Pour aller plus loin
Claude Opus 5.5 vs GPT 6-Sol : une bataille entre la puissance et le prix

GPT-6.1 Sol est le nouveau milieu de gamme de la famille GPT-6, entre Astra, le modèle le plus puissant d’OpenAI sorti le 3 septembre, et Luna, la version légère. Sur scène, Sam Altman a résumé la demande des développeurs depuis la sortie d’Astra en deux mots, « moins cher » et « plus rapide », et présenté GPT-6.1 Sol comme la réponse au premier : « presque le niveau d’Astra pour un cinquième du prix », « plus intelligent qu’Astra sur certains points », et appelé à devenir « votre cheval de trait quotidien ».

Via l’API, l’accès payant qui permet de brancher les modèles dans ses propres logiciels, il est facturé 2 dollars le million de tokens en entrée et 10 dollars en sortie. Un million de tokens, c’est environ 750 000 mots, soit une dizaine de romans.

Ce tarif est celui de GPT-6 Sol depuis le 22 septembre, et il reste cinq fois inférieur à celui d’Astra, qui demande 10 et 50 dollars. La seule ligne qui bouge sur la facture concerne le cache : relire un contexte déjà envoyé coûte désormais 0,10 dollar le million, contre 0,20 la semaine dernière, soit 95 % de remise sur le tarif d’entrée standard. Les agents IA, qui renvoient en boucle les mêmes instructions et les mêmes documents, seront donc les premiers bénéficiaires. OpenAI l’a dit sans détour : c’est pour eux que ce prix a été pensé.

Même prix, sept jours plus tard : ce que gagne le modèle

Tous ces chiffres sortent des tests d’OpenAI, et ils dépendent de l’« effort de raisonnement », le temps que le modèle passe à réfléchir avant de répondre. Plus on lui en accorde, meilleur il est, et plus la note grimpe.

CaractéristiquesGPT-6 Sol (22 sept.)GPT-6.1 Sol (29 sept.)
Prix API entrée / sortie (par million de tokens)2 $ / 10 $2 $ / 10 $
Lecture en cache0,20 $0,10 $
DeepSWE v1.1 (code)Référence+6,4 points, égale Astra
OSWorld 2.0 (pilotage d’applications)Référence+7 points, à 2,1 d’Astra
Terminal-Bench ScienceRéférenceScore plus que doublé
Réponses avec erreur factuelle (questions pièges)11,4 %7,7 %
Tente de contourner un « accès refusé »64,4 %23,5 %
Données OpenAI, effort de raisonnement variable selon les tests.

En programmation, sur DeepSWE, il fait jeu égal avec Astra pour un cinquième du coût. En recherche scientifique, une tâche lui revient à 5,47 dollars contre 23,80 pour Astra, mais Astra garde la tête avec 68,1 % de réussite et reste conseillé pour les problèmes difficiles.

OpenAI se compare aussi à Claude Opus 5.5 d’Anthropic, sorti lui aussi le 22 septembre, qu’il dit devancer de 2,2 points sur AutomationBench pour un tiers du coût, en reprenant les scores publiés par son concurrent.

On retiendra surtout la dernière ligne du tableau. Face à un message « accès refusé », GPT-6 Sol tentait de passer outre dans près de deux cas sur trois. Son successeur le fait encore dans un cas sur quatre. Astra descend à 17,4 %, Luna grimpe à 42,4 %. OpenAI précise que ces scénarios sont conçus pour provoquer l’erreur, portent sur des situations à faible enjeu et tournent sans les protections de ses produits.

Ultrafast : huit fois plus vite, six fois plus cher

La réponse au « plus rapide » s’appelle Ultrafast, et elle sort du stade de la preview. OpenAI l’ouvre dès ce mardi dans l’API, dans ChatGPT et dans Codex. La grille est simple : le mode Fast doublait déjà la vitesse pour le double du prix, Ultrafast multiplie la vitesse par huit pour six fois le tarif standard, soit environ 300 tokens par seconde selon Sam Altman. Sur scène, deux modèles ont reçu la même consigne, construire et lancer une fusée aux couleurs du DevDay : celle d’Ultrafast avait décollé avant que l’autre ait fini d’être assemblée. Le mode est disponible aujourd’hui sur Astra et doit arriver « bientôt » sur GPT-6.1 Sol, où OpenAI promet jusqu’à huit fois plus de vitesse dans Codex.

Ces vitesses servent de vitrine aux nouveaux abonnements. ChatGPT Pro 500, à 500 dollars par mois, offre les plafonds d’usage les plus élevés, 25 fois ceux d’un abonné Plus, l’accès à Ultrafast dans le chat et dans Codex, et fonctionne dans les applications partenaires via « Se connecter avec ChatGPT ». OpenAI rouvre au passage l’abonnement Pro à 200 dollars, fermé aux nouveaux venus depuis le début du mois, avec l’accès à tous les modèles de pointe. En marge, l’entreprise a montré une Decisions API en preview : on donne à Luna une liste d’options prédéfinies, router une requête, classer une image, choisir la prochaine action d’un agent, et il tranche en une fraction de seconde.

Ralentir, disait-il

Le calendrier donne à cette annonce un goût particulier. Le 12 septembre, Dario Amodei, patron d’Anthropic, publiait un essai appelant l’industrie à ralentir l’amélioration des modèles, et Sam Altman l’approuvait le jour même.

Pour aller plus loin
« Nous devons ralentir » : Dario Amodei demande à l’industrie de ralentir l’IA, Sam Altman et Elon Musk approuvent dans la foulée

Dix jours plus tard, Anthropic sortait Claude Opus 5.5 et OpenAI GPT-6 Sol, à 90 minutes d’écart. Une semaine encore et voici Sonnet 5.5 et GPT-6.1 Sol, alors qu’OpenAI a suspendu l’entraînement de ses modèles les plus avancés après qu’un agent a contourné ses restrictions réseau le 20 septembre dernier, deuxième incident du genre depuis l’affaire Hugging Face de juillet. Le même Sam Altman a rappelé sur scène que son « stagiaire de recherche IA », promis il y a un an, est désormais opérationnel en interne.

Pour aller plus loin
Anthropic brûle trois dollars pour un dollar gagné, mais tout va bien

Ce mardi, un document d’introduction en Bourse d’Anthropic, obtenu par Reuters, prévient de son côté les investisseurs de « risques catastrophiques ou existentiels ». Une trentaine de modèles ont été annoncés par les grands laboratoires depuis janvier.

Pour l’abonné ChatGPT, GPT-6.1 Sol arrive dès aujourd’hui pour les formules Plus, Pro, Business, Enterprise et Edu, dans ChatGPT Work et dans Codex, l’outil de programmation d’OpenAI. Il n’est pas encore dans le mode conversation classique.

GPT-6.1 Sol est une bonne affaire pour qui construit des agents, et une mauvaise nouvelle pour qui espérait que les appels à la prudence changent quelque chose au calendrier. Un modèle mis au rebut au bout de sept jours, ce n’est plus une itération, c’est une cadence. Le prix du token baissera encore. La colonne « contourne une restriction », elle, affiche toujours 23,5 %, et c’est celle qu’on relira la prochaine fois.

Pour aller plus loin
dots d’OpenAI expliqué : un ordinateur dans le cloud, 4 000 apps et un agent qui ne dort jamais


Retrouvez un résumé du meilleur de l’actu tech tous les matins sur WhatsApp, c’est notre nouveau canal de discussion Frandroid que vous pouvez rejoindre dès maintenant !

Recherche IA boostée par
Perplexity