Sztuczna inteligencja

GLM-5.2 dorównuje GPT-5.5 w cyberumiejętnościach, ale nie odmawia

1 min read

GLM-5.2 dorównuje GPT-5.5 w cyberumiejętnościach, ale nie odmawia
Photo: Logan Voss · Unsplash
0 0
XWhatsAppTelegramLinkedIn

GLM-5.2, chiński model AI o otwartych wagach od firmy Z.ai, zmniejszył dystans do czołowych systemów granicznych do zaledwie kilku miesięcy w zakresie cyberataków i zdolności biologicznych – i nie odmówił żadnego z szkodliwych zadań, które mu powierzono, według raportu opublikowanego 4 sierpnia 2026 roku przez organizację non-profit zajmującą się bezpieczeństwem AI, SaferAI.

W tej samej ocenie Claude Opus 4.7 od Anthropica odmawiał tak konsekwentnie, że SaferAI nie mogło w ogóle przeprowadzić na nim testu CyberGym, sprawdzającego umiejętności cyberbezpieczeństwa.

Wyniki wskazują na rosnącą lukę w bezpieczeństwie: podczas gdy zamknięte modele, takie jak GPT-5.5 od OpenAI, stosują klasyfikatory, trening odmowy i kontrolę na poziomie API, takie zabezpieczenia stają się niewykonalne, gdy wagi otwartego modelu zostaną pobrane i uruchomione niezależnie.

„Granica możliwości nie jest granicą ryzyka” – powiedział Henry Papadatos, dyrektor wykonawczy SaferAI. „Musimy wziąć pod uwagę stan zabezpieczeń, aby właściwie ocenić ryzyko.”

Z.ai nie opublikowało ram bezpieczeństwa, zobowiązań do testów przed wdrożeniem ani oceny ryzyka dla GLM-5.2, według SaferAI. TechCrunch zapytał Z.ai, czy przeprowadziło wewnętrzne lub zewnętrzne oceny bezpieczeństwa przed wydaniem, ale nie otrzymał odpowiedzi.

Na Światowej Konferencji AI w lipcu 2026 roku prezydent Chin Xi Jinping podkreślił znaczenie modeli o otwartych wagach, jednocześnie akcentując potrzebę ścisłej ludzkiej kontroli nad AI.

Graham Webster, który bada chińską politykę AI w Stanford Cyber Policy Center, powiedział, że chińskie regulacje historycznie koncentrowały się na treściach politycznie wrażliwych i stabilności społecznej, a nie na katastrofalnych ryzykach AI. Dodał, że chińskie firmy zwykle koordynują działania z regulatorami za kulisami, co utrudnia poznanie ich wewnętrznych testów.

Papadatos podkreślił, że branża powinna dążyć do udostępniania tylko dobrych możliwości, zauważając, że atakujący szybciej adoptują nowe narzędzia niż obrońcy. „Grupa ransomware może zmienić swoje metody w tydzień. Szpital nie może” – powiedział.

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.