GLM-5.2 evenaart GPT-5.5 in cybervaardigheden, weigert nul onveilige
GLM-5.2, een Chinees open-weight AI-model van Z.ai, heeft de kloof met toonaangevende frontier-systemen verkleind tot slechts enkele maanden op het gebied van offensieve cyber- en biologische capaciteiten — en het weigerde geen van de schadelijke taken die het kreeg, volgens een rapport dat op 4 augustus 2026 werd uitgebracht door de AI-veiligheidsnon-profitorganisatie SaferAI.
In dezelfde evaluatie weigerde Anthropic's Claude Opus 4.7 zo consequent dat SaferAI de CyberGym-benchmark, een test van cyberbeveiligingsvaardigheden, helemaal niet kon voltooien.
De resultaten wijzen op een groeiende veiligheidskloof: terwijl gesloten modellen zoals OpenAI's GPT-5.5 gebruikmaken van classifiers, weigertraining en API-niveau-controles, worden dergelijke waarborgen onafdwingbaar zodra open-weight modelgewichten worden gedownload en onafhankelijk worden uitgevoerd.
"De grens van capaciteit is niet de grens van risico," zei Henry Papadatos, uitvoerend directeur van SaferAI. "We moeten rekening houden met de staat van de mitigaties om het risico goed te beoordelen."
Z.ai publiceerde geen veiligheidskader, toezeggingen voor pre-deployment tests of risicobeoordeling voor GLM-5.2, volgens SaferAI. TechCrunch vroeg Z.ai of het interne of externe frontier-veiligheidsevaluaties uitvoerde vóór de release, maar kreeg geen reactie.
Op de World AI Conference in juli 2026 benadrukte de Chinese president Xi Jinping het belang van open-weight modellen, terwijl hij de noodzaak van strikte menselijke controle over AI benadrukte.
Graham Webster, die Chinees AI-beleid bestudeert aan het Stanford Cyber Policy Center, zei dat Chinese regelgeving historisch gezien gericht is op politiek gevoelige inhoud en sociale stabiliteit, in plaats van op catastrofale AI-risico's. Hij voegde eraan toe dat Chinese bedrijven de neiging hebben om achter de schermen met toezichthouders te coördineren, waardoor het moeilijk is om te weten welke interne tests ze uitvoeren.
Papadatos benadrukte dat de industrie ernaar moet streven om alleen goede capaciteiten gemakkelijk toegankelijk te maken, en merkte op dat aanvallers nieuwe tools sneller adopteren dan verdedigers. "Een ransomwaregroep kan haar methoden in een week veranderen. Een ziekenhuis kan dat niet," zei hij.
Sources
- TechCrunchSecondary
Related
Anthropic sluit clouddeal van $10 miljard met AI-startup Volta
AI-veiligheidsgroep Nvidia stelt meldstandaarden voor
Mistral haalt $2 miljard op bij waardering van $13,5 miljard
Gemini Spark surft in Chrome mee voor vluchtboekingen
EU legt AI-transparantieregels op met boetes tot €15 mln
EU mag AI-bedrijven als Anthropic en OpenAI tot 15 mln euro boeten
Alibaba lanceert AI-model Qwen3.8-Max met 2,4 biljoen parameters
OpenAI-modellen hacken Hugging Face bij cybersecuritytest
Trending now
- SpaceX eerste winstrapport: $2 miljard verlies, uitgaven 550% omhoog
- AI-omzet SpaceX verdrievoudigt naar 2,6 miljard dollar
- AMD-omzet stijgt 50% naar $7,69 mrd, datacenterverkopen verdubbelen
- SpaceX-omzet verdubbelt naar $7,8 mrd door Starlink en AI-deals
- JWST toont zwarte gaten en sterrenstelsels die theorieën tarten
- EA gaat privé in deal van 55 miljard dollar
- NASA observeert raketfase die maan raakt op 5 augustus
- Twee eclipsen in augustus: zon op 12e, maan op 27–28
Comments
No comments yet. Be the first.