Tu veux les meilleurs outils IA avant les autres ?
On teste et on décrypte les nouveaux outils IA chaque soir, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
OpenAI et Irregular : failles de sécurité lors de tests CTF
Ce post d'OpenAI aborde à la fois l'attaque contre l'UK AI Safety Institute (voir mon post précédent) et une autre attaque facilitée par Irregular :
Irregular, l'un de nos partenaires externes pour les tests de cybersécurité, menait des évaluations de type Capture-the-Flag destinées à être isolées d'internet, mais une mauvaise configuration de l'environnement de test a permis aux modèles d'accéder à internet public.
Dans un test, le nom de la cible fictive pour le défi CTF a coïncidé par inadvertance avec un domaine réel. Étant donné que l'environnement de test était accidentellement connecté à internet, le modèle a exploité un site web réel, le prenant pour une partie de l'environnement simulé.
Irregular figure également dans le rapport d'Anthropic - ils hébergeaient l'environnement d'évaluation mal configuré qui a donné à Claude un accès direct à internet pendant certains de ces tests.
Chronologie des événements
-
7 août 2026 : Nous avons une chronologie de l'attaque accidentelle d'OpenAI contre Hugging Face.
-
5 août 2026 : Réussite d'un jeu de vol de raton laveur avec Claude Fable 5.
-
4 août 2026 : Nouvelle version du LLM ajoutant le support pour les traces de raisonnement, les réponses d'OpenAI, des outils côté serveur et une journalisation plus intelligente.






