AI Daily
Retour à l'accueil

· KrASIA

Z.ai affirme que son modèle open source GLM-5.3 devance de justesse Mythos 5 d'Anthropic dans la détection de failles logicielles

Z.ai affirme que son modèle open source GLM-5.3 devance de justesse Mythos 5 d'Anthropic dans la détection de failles logicielles

Photo: Markus Spiske sur Unsplash

L'entreprise chinoise d'IA Z.ai a publié des résultats de tests affirmant que son nouveau modèle open source GLM-5.3 surpasse légèrement le modèle à accès restreint Mythos 5 d'Anthropic dans l'identification de vulnérabilités logicielles. L'entreprise a indiqué qu'elle retarderait la publication d'environ deux semaines pour des travaux de sécurité supplémentaires et qu'elle réserverait ses fonctions de cybersécurité les plus sensibles à un programme d'utilisateurs vérifiés.

L'entreprise chinoise d'intelligence artificielle Z.ai a publié les résultats de tests de référence pour GLM-5.3, un nouveau modèle phare dont elle affirme qu'il peut égaler ou légèrement dépasser les principaux systèmes américains dans l'identification de vulnérabilités logicielles, tout en réduisant l'écart avec Anthropic sur les tâches de programmation de longue durée. Le modèle utilise la même base que son prédécesseur GLM-5.2 mais affiche de meilleurs résultats dans les évaluations de programmation et de cybersécurité. Sur CyberGym, un test de référence qui évalue la capacité d'un modèle à inspecter du code source, localiser des vulnérabilités et les vérifier, Z.ai indique que GLM-5.3 a obtenu 84,5 %, légèrement devant Mythos 5 d'Anthropic à 83,8 % et GPT-5.6 Sol d'OpenAI à 83,6 %. Ces chiffres ont été publiés par Z.ai elle-même et n'ont pas été vérifiés de manière indépendante. Le tableau change lorsque la tâche passe de la découverte d'une faille à son exploitation offensive. Z.ai a indiqué que GLM-5.3 a obtenu 54,4 % sur ExploitBench, contre 78,0 % pour Mythos 5. Lors de tests chronométrés, GLM-5.3 a réalisé 105 tâches de développement d'attaques en deux heures et 130 en six heures, bien en deçà de Mythos 5. Z.ai a également indiqué que le modèle avait mis au jour 1 097 vulnérabilités critiques dans de grandes bases de code open source, dont Linux, WebKit et FreeBSD, au cours des tests, et que le raisonnement sur les chaînes d'exploitation avait émergé du post-entraînement plutôt que d'une conception délibérée. Citant ces capacités, Z.ai a déclaré qu'elle retarderait la publication d'environ deux semaines afin de procéder à des vérifications de sécurité supplémentaires et de renforcer les garde-fous, les fonctions de cybersécurité les plus sensibles étant dans un premier temps limitées à des partenaires sélectionnés et à des utilisateurs vérifiés dans le cadre d'un programme d'accès de confiance. Anthropic a adopté une voie plus restrictive avec Mythos, une version de son modèle Claude Fable 5 dont les garde-fous de cybersécurité ont été retirés et qui n'est mise à disposition que d'organisations préalablement contrôlées. Les marchés n'ont pas réagi comme ils l'avaient fait lors des annonces précédentes. Les actions de Z.ai cotées à Hong Kong ont clôturé en baisse de 3,6 % le 14 août, jour de l'annonce de GLM-5.3, contrastant avec l'enthousiasme qui avait accueilli GLM-5.2 plus tôt dans l'été, lorsque le titre avait grimpé de plus de 2 000 % par rapport à son introduction de janvier à la fin juin.

Sources & crédits

Source originale: KrASIA

Z.ai affirme que son modèle open source GLM-5.3 devance de justesse Mythos 5 d'Anthropic dans la détection de failles logicielles — AI Daily