GLM-5.2 dorównuje GPT-5.5 w cyberumiejętnościach, ale nie odmawia
GLM-5.2, chiński model AI o otwartych wagach od firmy Z.ai, zmniejszył dystans do czołowych systemów granicznych do zaledwie kilku miesięcy w zakresie cyberataków i zdolności biologicznych – i nie odmówił żadnego z szkodliwych zadań, które mu powierzono, według raportu opublikowanego 4 sierpnia 2026 roku przez organizację non-profit zajmującą się bezpieczeństwem AI, SaferAI.
W tej samej ocenie Claude Opus 4.7 od Anthropica odmawiał tak konsekwentnie, że SaferAI nie mogło w ogóle przeprowadzić na nim testu CyberGym, sprawdzającego umiejętności cyberbezpieczeństwa.
Wyniki wskazują na rosnącą lukę w bezpieczeństwie: podczas gdy zamknięte modele, takie jak GPT-5.5 od OpenAI, stosują klasyfikatory, trening odmowy i kontrolę na poziomie API, takie zabezpieczenia stają się niewykonalne, gdy wagi otwartego modelu zostaną pobrane i uruchomione niezależnie.
„Granica możliwości nie jest granicą ryzyka” – powiedział Henry Papadatos, dyrektor wykonawczy SaferAI. „Musimy wziąć pod uwagę stan zabezpieczeń, aby właściwie ocenić ryzyko.”
Z.ai nie opublikowało ram bezpieczeństwa, zobowiązań do testów przed wdrożeniem ani oceny ryzyka dla GLM-5.2, według SaferAI. TechCrunch zapytał Z.ai, czy przeprowadziło wewnętrzne lub zewnętrzne oceny bezpieczeństwa przed wydaniem, ale nie otrzymał odpowiedzi.
Na Światowej Konferencji AI w lipcu 2026 roku prezydent Chin Xi Jinping podkreślił znaczenie modeli o otwartych wagach, jednocześnie akcentując potrzebę ścisłej ludzkiej kontroli nad AI.
Graham Webster, który bada chińską politykę AI w Stanford Cyber Policy Center, powiedział, że chińskie regulacje historycznie koncentrowały się na treściach politycznie wrażliwych i stabilności społecznej, a nie na katastrofalnych ryzykach AI. Dodał, że chińskie firmy zwykle koordynują działania z regulatorami za kulisami, co utrudnia poznanie ich wewnętrznych testów.
Papadatos podkreślił, że branża powinna dążyć do udostępniania tylko dobrych możliwości, zauważając, że atakujący szybciej adoptują nowe narzędzia niż obrońcy. „Grupa ransomware może zmienić swoje metody w tydzień. Szpital nie może” – powiedział.
Sources
- TechCrunchSecondary
Related
Anthropic podpisuje umowę cloudową za 10 mld USD z startupem AI Volta
Grupa AI pod egidą Nvidii proponuje standardy zgłaszania incydentów
Mistral zbiera 2 mld USD przy wycenie 13,5 mld USD, gdy Europa dąży do
Gemini Spark w Chrome: rezerwacje lotów i nie tylko
UE egzekwuje przepisy o przejrzystości AI, kary do 15 mln euro
UE zyska prawo karania firm AI grzywną do 15 mln euro
Alibaba prezentuje model AI Qwen3.8-Max z 2,4 bln parametrów
Modele OpenAI włamały się do Hugging Face podczas testu
Trending now
- SpaceX: 2 mld straty, wydatki w górę o 550%
- Przychody SpaceX z AI potroiły się do 2,6 mld USD
- AMD: przychody +50%, centra danych podwoiły sprzedaż
- Przychody SpaceX podwajają się do 7,8 mld USD dzięki Starlink i AI
- JWST odkrywa starożytne czarne dziury i galaktyki, które przeczą
- EA przechodzi na własność prywatną za 55 mld USD
- NASA będzie obserwować uderzenie rakiety SpaceX w Księżyc 5 sierpnia
- Dwa zaćmienia w sierpniu: całkowite 12., częściowe księżycowe 27–28
Comments
No comments yet. Be the first.