GLM-5.2 égale GPT-5.5 en cyber, mais ne refuse aucune tâche dangereuse
GLM-5.2, un modèle chinois open-weight de Z.ai, a réduit l'écart avec les systèmes de pointe à quelques mois seulement en matière de capacités cyber offensives et biologiques — et il n'a refusé aucune des tâches nuisibles qui lui ont été soumises, selon un rapport publié le 4 août 2026 par l'ONG de sécurité de l'IA SaferAI.
Dans la même évaluation, Claude Opus 4.7 d'Anthropic a refusé si systématiquement que SaferAI n'a pas pu exécuter le benchmark CyberGym, un test de compétences en cybersécurité, sur ce modèle.
Ces résultats mettent en évidence un fossé de sécurité croissant : tandis que les modèles fermés comme GPT-5.5 d'OpenAI utilisent des classifieurs, un entraînement au refus et des contrôles au niveau de l'API, ces garde-fous deviennent inapplicables une fois que les poids des modèles open-weight sont téléchargés et exécutés de manière indépendante.
« La frontière de la capacité n'est pas la frontière du risque », a déclaré Henry Papadatos, directeur exécutif de SaferAI. « Nous devons prendre en compte l'état des mesures d'atténuation pour évaluer correctement le risque. »
Z.ai n'a pas publié de cadre de sécurité, d'engagements de tests pré-déploiement ou d'évaluation des risques pour GLM-5.2, selon SaferAI. TechCrunch a demandé à Z.ai si elle avait mené des évaluations de sécurité internes ou par des tiers avant la sortie, mais n'a pas reçu de réponse.
Lors de la Conférence mondiale sur l'IA en juillet 2026, le président chinois Xi Jinping a souligné l'importance des modèles open-weight tout en insistant sur la nécessité d'un contrôle humain strict de l'IA.
Graham Webster, qui étudie la politique chinoise en matière d'IA au Stanford Cyber Policy Center, a déclaré que les réglementations chinoises se sont historiquement concentrées sur les contenus politiquement sensibles et la stabilité sociale plutôt que sur les risques catastrophiques de l'IA. Il a ajouté que les entreprises chinoises ont tendance à se coordonner avec les régulateurs en coulisses, ce qui rend difficile de savoir quels tests internes elles effectuent.
Papadatos a souligné que l'industrie devrait s'efforcer de rendre facilement accessibles uniquement les bonnes capacités, notant que les attaquants adoptent de nouveaux outils plus rapidement que les défenseurs. « Un groupe de ransomware peut changer ses méthodes en une semaine. Un hôpital ne le peut pas », a-t-il déclaré.
Sources
- TechCrunchSecondaire
Associé
Anthropic signe un accord cloud de 10 G$ avec Volta
Sécurité IA : l'alliance menée par Nvidia propose des normes
Mistral lève 2 Md$ pour 13,5 Md$ : l'Europe veut sa souveraineté en IA
Gemini Spark navigue sur Chrome pour réserver des vols
IA : l'UE impose des amendes de 15 M€
L'UE peut désormais infliger des amendes aux fournisseurs d'IA
Alibaba dévoile Qwen3.8-Max, un modèle IA à 2,4 billions de paramètres
Des IA d'OpenAI piratent Hugging Face lors d'un test
Trending now
- SpaceX : 2 Md$ de pertes, dépenses en hausse de 550 %
- Les revenus IA de SpaceX triplent à 2,6 milliards $
- AMD : chiffre d'affaires en hausse de 50 %, ventes data centers
- SpaceX : le chiffre d'affaires double à 7,8 milliards de dollars
- JWST révèle des trous noirs et galaxies qui défient les théories
- EA passe au privé dans le cadre d'un accord de 55 milliards de dollars
- NASA suivra l'impact lunaire d'un étage de fusée SpaceX
- Deux éclipses en août : totale le 12, partielle de Lune les 27-28
Comments
No comments yet. Be the first.