Brief IA : OpenAI propose une API publique pour déployer des agents Codex

OpenAI propose une API publique pour déployer des agents Codex

Brief IA
Tom Levy·4 min·2 vues

OpenAI propose en bêta publique une API managée donnant accès au harnais utilisé pour Codex et ChatGPT for Work L’API Agents est accessible à tous les développeurs, sans frais supplémentaires pour l’API elle-même : seuls les tokens et outils sont facturés Les agents peuvent être déployés dans différents environnements et bénéficient de fonctionnalités comme le compactage automatique du contexte et la prise en charge multi-agents.

En bref
1OpenAI propose en bêta publique une API managée donnant accès au harnais utilisé pour Codex et ChatGPT for Work
2L’API Agents est accessible à tous les développeurs, sans frais supplémentaires pour l’API elle-même : seuls les tokens et outils sont facturés
3Les agents peuvent être déployés dans différents environnements et bénéficient de fonctionnalités comme le compactage automatique du contexte et la prise en charge multi-agents
4L’API repose sur une version open source de Codex et sera ajustée selon les retours de la bêta
💡Pourquoi c'est importantCette API permet aux développeurs de créer et d’orchestrer des agents durables sans avoir à bâtir leur propre infrastructure, avec une flexibilité de déploiement et des outils avancés.
Le brief IA que lisent les pros

Tu veux les meilleurs outils IA avant les autres ?

On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

OpenAI propose en bêta publique une API managée qui expose le harnais utilisé pour Codex et ChatGPT for Work. Le service, facturé aux tarifs standard des tokens et des outils, promet des agents durables, multi‑agents et orchestrés, déployables dans un bac à sable, chez des partenaires ou sur l’infrastructure des clients.

OpenAI dissocie le harnais de Codex pour les développeurs

OpenAI transforme le harnais, jusqu’ici principalement intégré à ses outils de codage, en un produit distinct que les développeurs peuvent utiliser pour leurs propres agents. Cette séparation permet d’éviter de créer une couche d’orchestration spécifique. Selon OpenAI, l’expérience acquise avec Codex et ChatGPT for Work a permis de maîtriser la gestion du contexte, l’utilisation efficace des outils et la coordination de sous-agents pour des agents de longue durée. L’entreprise indique que son infrastructure peut faire fonctionner un agent pendant plusieurs jours. L’API Agents repose sur une version open source de Codex dont le code est consultable. OpenAI prévoit d’ajuster le service en fonction des retours de la bêta avant une disponibilité générale.

Accès immédiat et facturation sans surcoût API

L’API Agents est accessible en bêta publique dès l’annonce du 10 septembre 2026 et ouverte à tous les développeurs. OpenAI ne facture pas l’accès à l’API elle-même : seuls les tokens consommés et les outils utilisés sont facturés, selon les tarifs standards de la plateforme.

Exécution flexible et orchestration des outils

Les développeurs peuvent choisir d’exécuter leurs agents dans un bac à sable géré par OpenAI, sur leur propre infrastructure ou chez des fournisseurs partenaires. Ce choix détermine la puissance de calcul, la mémoire et le stockage disponibles pour l’agent. OpenAI fait évoluer le harnais en continu. L’API Agents pilote le harnais, transmet les appels d’outils à l’environnement choisi et renvoie les résultats. L’appel d’outils programmatique permet d’exécuter des appels en parallèle, de les enchaîner ou de filtrer les résultats dans le code, en ne réinjectant dans le contexte du modèle que les données utiles.

Mémoire de session, multi-agents et optimisation du contexte

L’API Agents effectue automatiquement une compression du contexte, synthétisant les échanges antérieurs à mesure que la session se rapproche de sa limite, ce qui autorise l’utilisation de multiples fenêtres de contexte sans adaptation particulière du côté du développeur. Lorsqu’une recherche d’outils est effectuée, seules les définitions utiles à la tâche actuelle sont chargées, ce qui permet de limiter la consommation de tokens et de préserver le cache du modèle. Le service est compatible avec des architectures multi-agents : un agent principal a la possibilité d’attribuer des sous-tâches à des sous-agents fonctionnant en parallèle, chacun disposant de son propre contexte. La session conserve son état d’un tour à l’autre, évitant de reconstruire la conversation à chaque nouvelle tâche.

Déroulé d’une session : de la création au pilotage en cours d’exécution

Présentée le 10 septembre 2026, l’API Agents donne accès à l’infrastructure et au harnais derrière Codex et ChatGPT for Work. Un appel API suffit à créer un agent en définissant la tâche, le modèle, les outils et l’environnement d’exécution. Une session commence par la configuration de l’agent et le choix d’un environnement, qu’OpenAI provisionne. Dès que l’environnement est opérationnel, l’envoi d’une tâche lance un tour de travail. Il est possible de suivre l’avancement via la diffusion continue d’événements ou par l’intermédiaire de webhooks, qui informent de la complétion d’une tâche ou d’un besoin d’intervention. Une nouvelle tâche peut être transmise à la même session pour prolonger l’activité, ou l’agent peut être redirigé alors qu’il traite encore la tâche en cours.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires