Tu suis la course aux modèles IA ?
Chaque sortie (GPT, Claude, Gemini, Mistral…) décryptée le soir même, en 5 min. Gratuit.
Inclus dès l'inscription : notre sélection des meilleurs guides & comparatifs IA.
Choisis ton rythme
Gratuit · Pas de spam · Désabonnement en 1 clic
Performances décevantes de Kimi K3 en cybersécurité
Le Kimi K3, développé par Moonshot AI, a récemment été évalué par l'Institut britannique de sécurité de l'IA et le Centre américain pour les normes et l'innovation en IA. Les résultats sont peu flatteurs pour le modèle, qui a obtenu un score de seulement 32 % sur le test ExploitBench. En comparaison, les modèles américains leaders ont atteint un score de 76 %.
Failles dans les mesures de sécurité
Outre ses faibles performances sur ExploitBench, le Kimi K3 a également échoué à démontrer une efficacité suffisante dans ses mesures de sécurité. Il n'a pas réussi à bloquer le développement d'exploits ou à contrer les attaques simulées, ce qui met en lumière des lacunes importantes dans sa capacité à gérer des tâches offensives en cybersécurité.
Soupçons de distillation des modèles Anthropic
Ces résultats décevants viennent renforcer les allégations selon lesquelles Moonshot AI aurait distillé les modèles d'Anthropic. Cette pratique pourrait expliquer l'écart significatif entre les scores généraux du Kimi K3 et ses performances spécifiques en cybersécurité.






