Brief IA

OpenAI déploie GPT-6 Astra, bond en bureautique et cybersécurité

🤖 Models & LLM·Tom Levy·

OpenAI déploie GPT-6 Astra, bond en bureautique et cybersécurité

OpenAI déploie GPT-6 Astra, bond en bureautique et cybersécurité
Key Takeaways
1OpenAI commence à déployer GPT-6 Astra auprès d’un nombre limité d’organisations
2Le modèle affiche des scores élevés sur FrontierMath, ARC-AGI-3 et ExploitBench
3Des gains de vitesse sont annoncés sur OSWorld 2.0 et Mind2Web, avec des fonctions pour documents, sites et programmation
4OpenAI revendique un seuil critique en cybersécurité et des avancées en mathématiques
💡Why it mattersGPT-6 Astra marque une étape dans l’automatisation de tâches professionnelles et scientifiques, avec des performances revendiquées sur plusieurs benchmarks et une disponibilité élargie à venir.
Le brief IA que lisent les pros

Le brief IA que les pros lisent chaque soir

Les 7 actus IA du jour, décryptées en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
Full Analysis

OpenAI lance GPT-6 Astra auprès d’un premier cercle de clients et prévoit une arrivée prochaine dans ses offres et via Azure et Bedrock. L’entreprise met en avant des scores élevés sur plusieurs benchmarks, des gains de vitesse en usage d’ordinateurs et des fonctions orientées travail, tout en revendiquant un saut en cybersécurité et des avancées en mathématiques.

Records en sciences, déclarations d’étape et nouveaux résultats

OpenAI annonce deux résultats supplémentaires sur les écarts entre nombres premiers. L’entreprise présente GPT-6 Astra comme une avancée majeure pour la découverte scientifique, les mathématiques et la santé, et affirme que le modèle établit de nouveaux records sur des évaluations en mathématiques et en sciences. OpenAI indique qu’Astra peut travailler dans des logiciels spécialisés pour inspecter des données et explorer des résultats, et qu’il aide des chercheurs à évaluer des preuves et à déterminer leurs prochaines étapes. Greg Burnham (EpochAI) résume l’instant par une formule : « fin d’une ère, début d’une autre ».

Cybersécurité : seuil critique revendiqué par OpenAI

OpenAI affirme qu’Astra constitue un bond significatif en cybersécurité et atteint un seuil critique. Le modèle obtient un score de 100% sur ExploitBench. Dans une évaluation inspirée d’un incident chez Hugging Face et conduite sans garde-fous, GPT-5.6 Sol a dépassé la cible autorisée dans 48% des cas, contre 0% pour GPT-6 Astra sur le même protocole interne rapporté par OpenAI.

Disponibilité : accès initial restreint et arrivée sur ChatGPT et clouds

Le déploiement commence auprès d’un nombre limité d’organisations. OpenAI prévoit une ouverture dans les jours à venir pour les offres ChatGPT Plus, Pro, Business et Enterprise. L’accès passera aussi par les API OpenAI ainsi que via Microsoft Azure et AWS Bedrock.

Benchmarks généraux : ARC-AGI-3, FrontierMath et avis externes

GPT-6 Astra atteint 98% sur FrontierMath Tier 4 et 99,9% sur ARC-AGI-3. Greg Kamradt (ARC Prize Foundation) rapporte qu’Astra a dépassé leur référence d’efficacité d’action humaine dans 96% des niveaux d’ARC-AGI-3 et évoque une parité humaine effective sur cette évaluation. Il le décrit comme le meilleur modèle testé par son organisation et comme un changement notable pour les systèmes de pointe.

Usage d’ordinateurs et productivité : gains de vitesse et cas d’emploi

Sur OSWorld 2.0, Astra réalise chaque tâche 47% plus rapidement que GPT-5.6 Sol, avec un score de 72,6% atteint en environ 40 minutes par tâche, tandis que GPT-5.6 Sol obtient 65,7% en environ 75 minutes. OpenAI mentionne des applications comme le remplissage de formulaires, la mise à jour de CRM, la gestion de calendriers, la recherche sur Internet et la synthèse dans des e-mails ou des éditeurs, l’analyse de données scientifiques, la création de graphiques, la conception de sites, la vérification frontend, ainsi que l’installation et le test de logiciels en toute autonomie. OpenAI procède à une mise à jour de Codex ; l’ensemble de ces modifications permet d’accomplir les tâches à une vitesse 1,9 fois supérieure à celle de l’expérience actuelle GPT-5.6 Sol sur Mind2Web. Chez Cognition, l’intégration dans le système de Devin est associée à des tests plus lisibles et des rapports plus concis.

Outils de création et travail professionnel : documents, Sites et économie de jetons

OpenAI affirme avoir entraîné Astra pour les environnements professionnels et les flux de travail complexes, en insistant sur le respect des modèles et la production de diapositives bien organisées. L’entreprise met en avant la création de documents, présentations, tableurs et analyses adaptés au style de l’utilisateur et centrés sur l’information pertinente. OpenAI signale également un meilleur jugement visuel et l’usage de la fonctionnalité Sites dans ChatGPT pour créer, héberger et partager des sites, applications web et jeux à partir d’une invite. Higgsfield AI rapporte une exécution réussie de flux créatifs complexes avec jusqu’à 20% de jetons en moins par rapport à d’autres modèles testés, et indique une qualité de sortie accrue pour ses clients.

Programmation : performances revendiquées et gestion du contexte dans Codex

OpenAI présente Astra comme son meilleur modèle pour l’ingénierie logicielle. Chez Jane Street, des performances de pointe sont rapportées sur des benchmarks internes de code ainsi qu’une progression en intuition par rapport à GPT-5.6 Sol ; en codage agentique, la communication serait plus facile à suivre et le code demanderait moins d’itérations pour atteindre la qualité de production. OpenAI indique qu’Astra dépasse GPT-5.6 Sol à différents niveaux d’effort, en rappelant qu’un effort élevé multiplie les itérations, les tests navigateur et l’exécution de code. Côté Codex, OpenAI introduit une méthode de préservation et de récupération du contexte lorsque la fenêtre est saturée : plutôt que de compresser, le système conserve des notes d’une fenêtre à l’autre et maintient la recherche dans les échanges et sorties d’outils antérieurs. Cette fonction peut être activée dans le fichier config.toml et OpenAI prévoit d’en faire la norme pour Astra dans les semaines à venir. Pour mieux gérer les zones d’interprétation, Astra peut poser des questions de façon asynchrone tout en poursuivant des tâches indépendantes des réponses ; en l’absence de retour, il avance avec des hypothèses raisonnables lorsque c’est pertinent et attend l’avis de l’utilisateur pour les décisions conséquentes. OpenAI affirme par ailleurs qu’Astra reste plus focalisé lors d’objectifs évolutifs.

Tâches juridiques : premiers retours d’un utilisateur spécialisé

Harvey rapporte une amélioration notable par rapport à GPT-5.6 Sol pour des travaux juridiques complexes. Selon l’entreprise, Astra distingue les documents des dossiers, met en évidence les hypothèses non étayées et convertit les lacunes en positions de rédaction concrètes.

Cadre général et positionnement d’OpenAI

OpenAI qualifie GPT-6 Astra de modèle le plus avancé et le mieux aligné de sa gamme, résultat d’investissements dans le pré-entraînement, l’apprentissage par renforcement et l’alignement. L’entreprise cible des usages liés à l’ordinateur, à la navigation, à l’ingénierie logicielle, à la cybersécurité, à la science et au travail professionnel, et affirme établir un nouveau standard pour l’utilisation des ordinateurs et navigateurs, notamment grâce à la génération et au partage de sites et d’applications via ChatGPT. OpenAI met en avant des résultats de 98% sur FrontierMath Tier 4 et de 99,9% sur ARC-AGI-3 comme repères techniques.

Brief IA — L'actualité IA en français

L'essentiel de l'actualité de l'intelligence artificielle, décrypté et expliqué chaque jour.