OpenAI : Ultrafast en préversion, GPT-5.6 Sol 14× plus rapide

Le brief IA que les pros lisent chaque soir
Les 7 actus IA du jour, décryptées en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI propose un accès limité à Ultrafast pour GPT-5.6 Sol et prévoit d'élargir l'offre au fur et à mesure de l'augmentation des capacités. En parallèle, l'entreprise s'en sert déjà pour la réponse aux incidents et la recherche interne, tandis que des clients pilotes testent la vitesse annoncée, propulsée par Cerebras, jusqu'à 750 tokens par seconde.
L’accès est limité et s’élargira avec la capacité
GPT-5.6 Sol en mode Ultrafast est proposé dans une prévisualisation limitée pour un groupe sélectionné de clients. OpenAI prévoit d’élargir l’accès à mesure que la capacité augmentera. Les entreprises peuvent s’inscrire pour être informées de cette ouverture. L’inscription a pour but de notifier quand l’accès s’étendra.
OpenAI s’en sert pour la gestion d’incidents et la recherche
Un groupe de développeurs d’OpenAI a testé Ultrafast pour repérer les flux de travail tirant profit de réponses en temps réel. L’équipe l’utilise déjà pour la réponse aux incidents. Lors d’alertes, les ingénieurs doivent établir une image précise alors que le système et les preuves évoluent encore. Les équipes recourent à Ultrafast pour parcourir des journaux, examiner des traces, résumer des discussions, identifier les prochaines vérifications à effectuer et contribuer à la préparation ou à la validation d’une correction, le tout en un temps nettement réduit. D’après OpenAI, cette approche raccourcit la période séparant la détection d’un signal, la vérification d’une hypothèse et la prise de décision sur la suite, tout en conservant aux ingénieurs la charge du jugement et du déploiement. Sur le plan de la recherche, l’équipe exploite Ultrafast pour identifier des sources, interroger des ensembles de données et collecter, structurer ainsi que synthétiser des informations à l’aide d’outils connectés. Là où une série d’expériences était lancée la nuit pour un examen le matin, OpenAI constate que la boucle se resserre jusqu’à permettre plusieurs itérations dans la journée.
Des clients pilotes expérimentent Ultrafast en production
OpenAI a déployé GPT-5.6 Sol en mode Ultrafast auprès d’un premier groupe d’entreprises, couvrant des domaines comme le développement logiciel, le commerce, l’analyse financière, le support ainsi que d’autres usages interactifs. Selon la société, démarrer par des processus commerciaux permet d’observer ces situations dans des contextes de production concrets. OpenAI indique que ces expérimentations servent à identifier les cas où une accélération significative apporte le plus de bénéfices et à observer l’évolution des produits lorsque le modèle s’aligne sur le rythme de l’utilisateur. Durant la phase de prévisualisation, OpenAI collabore avec un groupe restreint de clients et cherche à déterminer dans quels cas la rapidité a l’impact le plus marqué, afin que ces retours alimentent progressivement ses produits.
Quatre retours d’expérience : Jane Street, Podium, Basis, Rogo
Chez Jane Street, John Crepezzi juge l’augmentation de la vitesse apportée par Cerebras impressionnante et estime qu’elle ouvre de nouvelles manières d’utiliser les modèles, en rendant le travail des développeurs plus ciblé et productif. Courtland Lykins, chez Podium, explique qu’Ultrafast s’est révélé inestimable dans la pile vocale et que la vitesse modifie complètement l’expérience d’appel pour les tâches complexes. Pour Mitch Troyanovsky, co‑fondateur de Basis, la solution autorise des expériences synchrones qui étaient auparavant limitées par l’intelligence et combine débit en tokens par seconde et intelligence du modèle. Alex Wang, chez Rogo, affirme que la vitesse change ce que les utilisateurs peuvent raisonnablement exploiter et que la recherche financière complexe devient comparable à une interaction en temps réel.
Performances annoncées : 14× et 750 tokens/s, via Cerebras
OpenAI annonce qu’Ultrafast exécute GPT‑5.6 Sol jusqu’à 14 fois plus vite que le traitement standard, avec un lancement d’abord dans l’API OpenAI. Propulsée par Cerebras, l’offre générerait jusqu’à 750 tokens de sortie par seconde. L’entreprise affirme que cette vitesse rend son modèle le plus intelligent accessible à des produits et des flux de travail sensibles au temps et que GPT‑5.6 améliore l’efficacité à tous les niveaux de l’infrastructure, rendant l’intelligence avancée plus abordable et utile pour davantage de personnes. OpenAI soutient que la recherche de la vitesse en temps réel impliquait souvent de recourir à des modèles plus petits ou spécialisés et présente Ultrafast comme un pas vers davantage de travail utile par seconde. Selon l’entreprise, ne plus sacrifier l’intelligence pour la vitesse permet d’intégrer l’IA dans les segments les plus contraints en temps. OpenAI dit avoir déjà observé des cas d’usage encourageants : réponse aux incidents et fiabilité, recherche financière et sécurité, support client et voix, commerce, ainsi que recherche et expérimentation en direct.
Brief IA — L'actualité IA en français
L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.