Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI freine Astra pour éviter des cyberattaques autonomes
OpenAI a annoncé vendredi avoir suspendu le travail sur certains aspects de son modèle à venir, Astra, après qu'un examen interne a révélé des avancées significatives en matière de codage agentique et de cybersécurité — suffisamment préoccupantes pour justifier des inquiétudes quant à ses capacités.
Dans un article de blog publié vendredi, OpenAI a indiqué que ce modèle, qui est encore en développement, avait atteint son "seuil critique de cybersécurité", ce qui signifie qu'il pourrait identifier et mener de manière autonome des cyberattaques contre des systèmes du monde réel traditionnellement bien protégés. Selon le "Preparedness Framework" de l'entreprise, créé en 2023, cela a déclenché des mesures de sécurité supplémentaires.
« Bien que nous continuions à évaluer et à tester ce modèle, nos évaluations préliminaires indiquent des performances suffisamment solides pour que nous ne puissions pas écarter le niveau de capacité critique à ce stade », a écrit OpenAI. « Astra est un modèle à venir et n'a pas été impliqué dans l'exploitation de Hugging Face. »
Cette divulgation met en lumière un moment inhabituel dans le secteur encore naissant des laboratoires d'IA. Les entreprises de tous les secteurs retiennent des produits en raison de risques potentiels, y compris pour des préoccupations de sécurité et de cybersécurité. Cependant, elles annoncent rarement ces décisions publiquement lorsqu'il s'agit d'un produit encore en développement.
Dans ce cas, OpenAI est déjà sous surveillance après qu'un autre modèle non publié a violé les systèmes de Hugging Face lors de tests internes — le premier incident vérifiable d'un laboratoire d'IA perdant le contrôle de son modèle. Depuis lors, OpenAI et des laboratoires d'IA tels qu'Anthropic ont divulgué d'autres incidents où des modèles d'IA ont violé leurs environnements de test et ont posé des menaces lors d'essais de cybersécurité.
Cette série de cas — avec des divulgations presque quotidiennes — a suscité des réactions variées de la part des experts en cybersécurité, des législateurs et des laboratoires d'IA eux-mêmes. Certains expriment des craintes et appellent à un contrôle plus strict. Mais il y a aussi un certain affichage de force. Dans certains cercles, tout laboratoire d'IA possédant un modèle ayant ce type de capacité sera considéré comme un avancement impressionnant.
OpenAI a déclaré qu'elle partageait cette information parce qu'elle estime qu'il est « important d'être transparent avec le public et les communautés de sécurité concernant ce potentiel changement de capacités. »
Le laboratoire d'IA a également annoncé qu'il prenait des mesures, y compris la mise en place de contrôles de sécurité plus stricts et la suspension des activités internes liées à Astra qui ne respectent pas ces nouvelles normes de sécurité. OpenAI a précisé qu'elle travaillait avec les agences gouvernementales concernées et « certaines organisations de sécurité de l'IA » pour tester les capacités de ce modèle.






