Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
L'IA d'OpenAI dépasse les médecins dans les diagnostics d'urgence
Une étude récente publiée dans la revue Science met en lumière la performance impressionnante d'un modèle de langage avancé d'OpenAI, qui a surpassé des médecins humains dans diverses tâches cliniques. En analysant des données réelles issues de services d'urgence et en les comparant aux décisions de centaines de médecins, le modèle a démontré une supériorité notable dans le choix des diagnostics, le triage d'urgence et la planification des étapes de gestion des patients.
Les chercheurs soulignent cependant que ces résultats ne signifient pas que l'IA est prête à remplacer les médecins. Ils appellent à des normes d'évaluation plus strictes et à des règles claires pour l'intégration de l'IA dans le secteur médical.
Détails de l'étude
Le modèle de langage testé appartient à la série o1 d'OpenAI, lancée en 2024. Il a été soumis à six expériences combinant des cas cliniques standardisés et un échantillon aléatoire de patients d'un service d'urgence au Massachusetts. Le modèle a particulièrement brillé lors du triage initial, où les décisions doivent être prises avec des informations limitées. Bien que les médecins et le modèle s'améliorent avec plus de données, l'IA a montré une gestion plus efficace de l'incertitude, utilisant des données fragmentées et des notes de manière plus pertinente.
Cette étude s'appuie sur des décennies de recherche sur les systèmes de calcul médical, mais se distingue par l'ampleur de la comparaison directe entre médecins et IA dans un contexte clinique réel.
Perspectives futures
Les auteurs de l'étude appellent à la prudence face à ces résultats. Le travail clinique repose souvent sur des indices visuels et auditifs que l'IA ne peut pas encore interpréter pleinement. Des recherches supplémentaires sont nécessaires pour comprendre comment humains et machines peuvent collaborer efficacement en utilisant des signaux non textuels.
L'évaluation de la sécurité, de l'équité et de la rentabilité des soins médicaux assistés par l'IA est cruciale, des aspects qui n'ont pas été abordés dans cette étude.
Conclusion
Arjun Manrai, professeur adjoint en informatique biomédicale à la Harvard Medical School, a déclaré que le modèle a surpassé une large référence de médecins, y compris des praticiens certifiés et actifs. Il a précisé que cela ne signifie pas que l'IA remplacera les médecins, mais que nous assistons à un changement technologique majeur nécessitant une évaluation rigoureuse.
Les régulateurs, les hôpitaux et les prestataires de soins doivent collaborer pour tester ces outils avant leur déploiement afin d'assurer la sécurité et l'équité pour tous les patients.
Dans un commentaire publié dans Science, Ashley M. Hopkins et Eric Cornelisse de l'Université Flinders en Australie ont souligné que l'étude est un pas vers une meilleure évaluation des systèmes d'IA en santé, mais que la médecine nécessite une supervision stricte pour garantir des soins de qualité. "Nous ne permettons pas aux médecins de pratiquer sans supervision, et l'IA devrait être soumise à des normes comparables", a déclaré Cornelisse.
