Kunstmatige intelligentie

GLM-5.2 evenaart GPT-5.5 in cybervaardigheden, weigert nul onveilige

2 min read

GLM-5.2 evenaart GPT-5.5 in cybervaardigheden, weigert nul onveilige
Photo: Logan Voss · Unsplash
0 0
XWhatsAppTelegramLinkedIn

GLM-5.2, een Chinees open-weight AI-model van Z.ai, heeft de kloof met toonaangevende frontier-systemen verkleind tot slechts enkele maanden op het gebied van offensieve cyber- en biologische capaciteiten — en het weigerde geen van de schadelijke taken die het kreeg, volgens een rapport dat op 4 augustus 2026 werd uitgebracht door de AI-veiligheidsnon-profitorganisatie SaferAI.

In dezelfde evaluatie weigerde Anthropic's Claude Opus 4.7 zo consequent dat SaferAI de CyberGym-benchmark, een test van cyberbeveiligingsvaardigheden, helemaal niet kon voltooien.

De resultaten wijzen op een groeiende veiligheidskloof: terwijl gesloten modellen zoals OpenAI's GPT-5.5 gebruikmaken van classifiers, weigertraining en API-niveau-controles, worden dergelijke waarborgen onafdwingbaar zodra open-weight modelgewichten worden gedownload en onafhankelijk worden uitgevoerd.

"De grens van capaciteit is niet de grens van risico," zei Henry Papadatos, uitvoerend directeur van SaferAI. "We moeten rekening houden met de staat van de mitigaties om het risico goed te beoordelen."

Z.ai publiceerde geen veiligheidskader, toezeggingen voor pre-deployment tests of risicobeoordeling voor GLM-5.2, volgens SaferAI. TechCrunch vroeg Z.ai of het interne of externe frontier-veiligheidsevaluaties uitvoerde vóór de release, maar kreeg geen reactie.

Op de World AI Conference in juli 2026 benadrukte de Chinese president Xi Jinping het belang van open-weight modellen, terwijl hij de noodzaak van strikte menselijke controle over AI benadrukte.

Graham Webster, die Chinees AI-beleid bestudeert aan het Stanford Cyber Policy Center, zei dat Chinese regelgeving historisch gezien gericht is op politiek gevoelige inhoud en sociale stabiliteit, in plaats van op catastrofale AI-risico's. Hij voegde eraan toe dat Chinese bedrijven de neiging hebben om achter de schermen met toezichthouders te coördineren, waardoor het moeilijk is om te weten welke interne tests ze uitvoeren.

Papadatos benadrukte dat de industrie ernaar moet streven om alleen goede capaciteiten gemakkelijk toegankelijk te maken, en merkte op dat aanvallers nieuwe tools sneller adopteren dan verdedigers. "Een ransomwaregroep kan haar methoden in een week veranderen. Een ziekenhuis kan dat niet," zei hij.

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.