
Un modèle d’IA chinois à poids ouverts s’est rapproché de manière surprenante du modèle restreint d’Anthropic pour identifier et exploiter des vulnérabilités logicielles.
Le modèle, GLM-5.3, a été développé par Zhipu AI, également connu sous le nom de Z.ai.
Anthropic l’a testé sur des vulnérabilités connues du moteur JavaScript V8 de Chrome. Sur 410 tentatives, GLM-5.3 a produit 50 exploits complets, contre 56 pour Claude Mythos Preview d’Anthropic.
Mythos est réservé à des chercheurs en cybersécurité sélectionnés, tandis que GLM-5.3 est disponible avec ses poids ouverts et peut être téléchargé par n’importe qui.
Anthropic a également constaté que les mécanismes de sécurité du modèle étaient relativement faciles à supprimer. Une technique aurait permis de les contourner 100 % du temps, avec une faible perte de capacités.
Des versions dépourvues de ces protections sont apparues en ligne quelques jours plus tard.
Lors de tests contrôlés, Anthropic affirme également que GLM-5.3 a découvert des vulnérabilités de navigateur jusque-là inconnues et a réussi à les enchaîner pour former des attaques.
