GPT‑6.1 Sol disponible via API à 0,10 $ le million en cache

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI met à disposition GPT‑6.1 Sol pour les offres professionnelles et via son API, avec des tarifs annoncés en forte baisse, notamment sur l’entrée mise en cache. Le modèle est présenté comme s’approchant d’Astra sur plusieurs évaluations, tout en réduisant le coût par tâche. OpenAI met aussi en avant des progrès sur la factualité et l’alignement, et prépare une déclinaison Ultrafast.
Accès immédiat et grille tarifaire annoncée par OpenAI
GPT‑6.1 Sol est disponible dès aujourd’hui pour les abonnés Plus, Pro, Business, Enterprise et Edu au sein de ChatGPT Work et de Codex. Il n’est pas encore proposé dans Chat. Les développeurs peuvent y accéder via l’API OpenAI sous l’identifiant gpt‑6.1‑sol. Les tarifs standards communiqués sont de 2 $ par million de tokens d’entrée, 10 $ par million de tokens de sortie, et 0,10 $ par million pour l’entrée mise en cache. OpenAI prévoit également de lancer GPT‑6.1 Sol Ultrafast dans les prochains jours, qui offrira une génération de tokens jusqu’à huit fois plus rapide que la vitesse standard dans Codex.
Codage et usage d’applications : résultats et écarts de coûts
OpenAI présente GPT‑6.1 Sol comme approchant l’intelligence de GPT‑6 Astra pour le codage agentique, l’utilisation informatique et le travail professionnel, à des coûts nettement inférieurs. Sur DeepSWE v1.1, GPT‑6.1 Sol égalise Astra pour environ un cinquième du coût et dépasse le meilleur score de GPT‑6 Sol de 6,4 points de pourcentage, avec moins d’effort de raisonnement. Sur OSWorld 2.0 hors ligne, GPT‑6.1 Sol devance GPT‑6 Sol de sept points de pourcentage à effort maximal pour moins de la moitié du coût, et se situe à 2,1 points de pourcentage du score d’Astra pour environ un septième du coût par tâche.
Tâches professionnelles et science : comparaisons avec Opus 5.5 et Astra
Pour des tâches professionnelles complexes, OpenAI rapporte qu’au test GDP.pdf, GPT‑6.1 Sol dépasse Opus 5.5 en termes de score tout en maintenant un coût par tâche inférieur à la moitié dans les paramètres de raisonnement évalués, et atteint un niveau de performance proche de celui d’Astra pour environ un cinquième du coût. Sur Terminal‑Bench Science 0.1, GPT‑6.1 Sol plus que double le score de GPT‑6 Sol à effort maximal, avec un coût moyen de 5,47 $ par tâche, contre 23,21 $ pour Opus 5.5 et 23,80 $ pour Astra, soit plus de 75 % de moins que ces deux modèles.
Factualité et alignement : baisses d’erreurs et échecs annoncées
OpenAI met en avant une amélioration de l’exactitude factuelle à faible effort de raisonnement, avec une part de réponses erronées passant de 11,4 % à 7,7 %, soit environ 32 % de réduction. Dans les paramètres de raisonnement évalués, l’écart de taux d’erreur entre GPT‑6.1 Sol et Astra demeure de 1,9 point de pourcentage, pour un coût par tâche inférieur à un cinquième de celui d’Astra. Côté sécurité, OpenAI fait état d’avancées en matière d’alignement par rapport à GPT‑6 Sol, d’une transparence accrue sur les limitations et d’un respect plus constant des intentions des utilisateurs ainsi que des contraintes de sécurité, avec des taux d’échec moindres pour des situations complexes telles que la détection d’outils de recherche défectueux, l’application de restrictions explicites et l’évitement de résultats interdits.
Structure de coûts et cache : baisses communiquées par OpenAI
OpenAI propose GPT‑6.1 Sol à un tarif équivalent à environ un cinquième des prix standards d’entrée et de sortie d’Astra. Le tarif pour l’entrée mise en cache est fixé à 0,10 $ par million de tokens, soit une baisse de 95 % par rapport aux prix standards d’entrée et une réduction de 50 % par rapport au tarif de GPT‑6 Sol. Cette politique tarifaire a pour objectif de permettre aux développeurs une plus grande souplesse pour concevoir des agents capables de réutiliser le contexte entre les requêtes.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.