Brief IA : Webwright de Microsoft Research : GPT-5.4 passe de 33,5 % à 60,1 % de réussite

Webwright de Microsoft Research : GPT-5.4 passe de 33,5 % à 60,1 % de réussite

Brief IA
Tom Levy·1 min·0 vues

Microsoft Research présente Webwright, qui permet au modèle d'écrire un programme dans un terminal. Sur des tâches longues, GPT-5.4 passe de 33,5 % à 60,1 % de réussite, selon Microsoft Research. Le système produit un outil en ligne de commande réutilisable.

En bref
1Microsoft Research présente Webwright, qui permet au modèle d'écrire un programme dans un terminal.
2Sur des tâches longues, GPT-5.4 passe de 33,5 % à 60,1 % de réussite, selon Microsoft Research.
3Le système produit un outil en ligne de commande réutilisable.
💡Pourquoi c'est importantMicrosoft Research rapporte une nette amélioration du taux de réussite sur des tâches longues et la création d'un livrable exploitable.
Le brief IA que lisent les pros

La recherche en IA te passionne ?

Les papers et avancées qui comptent, expliqués simplement, chaque soir. Gratuit.

Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.

Choisis ton rythme

Gratuit · Pas de spam · Désabonnement en 1 clic

📄
L'analyse en français

Webwright, de Microsoft Research, mise sur un modèle qui écrit du code plutôt que d’enchaîner les clics. Sur des tâches longues, Microsoft Research rapporte que le même GPT-5.4 passe de 33,5 % à 60,1 % de réussite, en produisant un outil en ligne de commande réutilisable.

Succès rapporté sur tâches longues et livrable réutilisable

Microsoft Research indique que sur des tâches à long terme, le modèle GPT-5.4 voit son taux de réussite passer de 33,5 % à 60,1 % avec Webwright. Le système génère également un outil en ligne de commande, qui peut être réutilisé après l'exécution initiale.

Principe : un terminal pour écrire un programme

Webwright, développé par Microsoft Research, propose de donner au modèle un terminal et de le laisser écrire un programme. Cette approche remplace la logique d'interaction pas à pas par la génération directe de code exécutable.

Contexte : les limites du clic par clic

Pendant des années, les agents web ont fonctionné en cliquant étape par étape. Ils échouaient souvent sur des tâches longues, et ces méthodes ne produisaient qu'une suite d'actions, sans livrable réutilisable.

Suivez Brief IA

L'actu IA du jour, aussi dans votre fil.

Commentaires