L’ouverture face au modèle fermé d’Anthropic : le chinois Z.ai dévoile le monstre du codage GLM-5.3
L'open source et l'open weight peuvent-il terrasser les modèles fermés sur la cybersécurité ? La startup Z.ai a de nouveau dévoilé une arme redoutable avec GLM-5.3. Ce modèle de 743 milliards de paramètres semble capable de détecter les failles logicielles mieux que le très sélectif Mythos 5 d'Anthropic. Pendant que les grands éditeurs américains réservent...
L’open source et l’open weight peuvent-il terrasser les modèles fermés sur la cybersécurité ? La startup Z.ai a de nouveau dévoilé une arme redoutable avec GLM-5.3. Ce modèle de 743 milliards de paramètres semble capable de détecter les failles logicielles mieux que le très sélectif Mythos 5 d’Anthropic.
endant que les grands éditeurs américains réservent leurs outils d’audit de sécurité les plus puissants à une poignée d’organisations triées sur le volet, le logiciel libre abat une nouvelle carte maîtresse. Ce vendredi, la jeune pousse chinoise Zhipu AI annonce dans une publication technique sur le blog de Z.ai le lancement de GLM-5.3, son modèle de fondation à 743 milliards de paramètres. Cette itération est conçue pour rivaliser directement avec Mythos 5, la version spécialisée et ultra-sécurisée de Claude Fable 5 réservée par Anthropic à ses partenaires certifiés. Cette annonce s’inscrit dans le prolongement de la riposte observée cet été, où le lancement précipité de l’alternative ouverte GLM-5.2 sous licence MIT avait pallié les restrictions d’embargo sur les technologies occidentales.
Une efficacité supérieure sur la détection de failles logicielles
La particularité de GLM-5.3 réside dans ses capacités d’audit logiciel émergentes, obtenues sans modifier son modèle de base, mais en intensifiant l’apprentissage par renforcement et l’entraînement sur des tâches complexes à long horizon. Sur le banc d’essai de cybersécurité CyberGym, conçu pour évaluer la capacité d’une IA à passer un code au peigne fin et à confirmer la réalité d’un bogue, le modèle de Z.ai enregistre un score de 84,5 % de réussite, devançant légèrement les 83,8 % attribués à Mythos 5.
Outre la pure recherche de vulnérabilités, l’architecture s’impose au sommet des classements de programmation généraliste :
- Audit et détection de bugs : une progression de 50 % par rapport à la version 5.2 sur le banc de test interne Z.ai Code Bench.
- Commandes système et terminaux : score de 28,3 points sur Terminal-Bench 3.0, établissant un nouveau record pour un modèle aux poids ouverts devant Kimi K3.
- Génie logiciel : un résultat de 66,9 sur l’évaluation DeepSWE 1.1, égalant presque les performances globales de Claude Fable 5.
Le modèle marque néanmoins ses limites lors de la création d’exploits fonctionnels, une étape clé de la recherche défensive. Sur le test ExploitBench, GLM-5.3 se contente de 54,4 % de réussite contre 78,0 % pour la solution fermée d’Anthropic.
Ouverture des poids dans deux semaines et programme « Open Source Shield »
Face aux inquiétudes d’utilisation malveillante que suscite un outil d’audit aussi aiguisé, Z.ai adopte une démarche de gouvernance inédite pour un acteur chinois. La publication complète des poids du modèle interviendra dans environ **deux semaines**, le temps de finaliser les audits de sécurité et le renforcement des garde-fous. Les fonctions de test d’intrusion les plus sensibles resteront quant à elles encadrées au sein d’un programme d’accès restreint réservé aux chercheurs vérifiés.
En parallèle, Z.ai lance l’initiative Open Source Shield, un programme destiné à fournir gratuitement des audits automatiques aux projets logiciels ouverts stratégiques et à intégrer nativement ces fonctionnalités de détection au sein de son environnement de développement ZCode et de sa documentation pour développeurs.
🦋 L’actualité de l’open source en français dans votre flux. Suivez Goodtech sur Bluesky (or vos applications AT Protocol comme W Social et Mu) grâce à notre compte officiel. Suivez, partagez, abonnez-vous à @goodtech.info !
Did you enjoy this article?
Recommend it — Standard Reader surfaces well-loved writing to more readers across the network.