GLM-5.2 siber beceride GPT-5.5'i yakaladı, tehlikeli görevleri
Çin merkezli Z.ai'in açık ağırlıklı yapay zeka modeli GLM-5.2, saldırgan siber ve biyolojik yeteneklerde önde gelen sınır sistemleriyle arasındaki farkı yalnızca birkaç aya indirdi ve kendisine verilen zararlı görevlerin hiçbirini reddetmedi. Bu sonuç, yapay zeka güvenliği kâr amacı gütmeyen kuruluşu SaferAI tarafından 4 Ağustos 2026'da yayımlanan bir rapora dayanıyor.
Aynı değerlendirmede Anthropic'in Claude Opus 4.7'si o kadar tutarlı bir şekilde reddetti ki SaferAI, siber güvenlik becerilerini test eden CyberGym kıyaslamasını bu model üzerinde hiç tamamlayamadı.
Sonuçlar büyüyen bir güvenlik açığına işaret ediyor: OpenAI'in GPT-5.5'i gibi kapalı modeller sınıflandırıcılar, reddetme eğitimi ve API düzeyinde kontroller kullanırken, bu tür önlemler açık ağırlıklı model ağırlıkları indirilip bağımsız olarak çalıştırıldığında uygulanamaz hale geliyor.
"Yetenek sınırı, risk sınırı değildir," dedi SaferAI'nin genel müdürü Henry Papadatos. "Riski doğru değerlendirmek için hafifletme önlemlerinin durumunu da hesaba katmalıyız."
SaferAI'ye göre Z.ai, GLM-5.2 için bir güvenlik çerçevesi, dağıtım öncesi test taahhütleri veya risk değerlendirmesi yayımlamadı. TechCrunch, Z.ai'ye sürüm öncesinde dahili veya üçüncü taraf sınır güvenliği değerlendirmeleri yapıp yapmadığını sordu ancak yanıt alamadı.
Temmuz 2026'daki Dünya Yapay Zeka Konferansı'nda Çin Devlet Başkanı Xi Jinping, açık ağırlıklı modellerin önemini vurgularken yapay zeka üzerinde sıkı insan kontrolünün gerekliliğine dikkat çekti.
Stanford Siber Politika Merkezi'nde Çin yapay zeka politikasını inceleyen Graham Webster, Çin düzenlemelerinin tarihsel olarak felaket düzeyinde yapay zeka risklerinden çok politik olarak hassas içeriklere ve toplumsal istikrara odaklandığını söyledi. Ayrıca Çinli şirketlerin düzenleyicilerle perde arkasında koordinasyon kurma eğiliminde olduğunu ve bu nedenle ne tür dahili testler yaptıklarını bilmenin zor olduğunu ekledi.
Papadatos, sektörün yalnızca iyi yetenekleri kolayca erişilebilir kılmaya çalışması gerektiğini vurguladı ve saldırganların yeni araçları savunmacılardan daha hızlı benimsediğine dikkat çekti. "Bir fidye yazılımı grubu yöntemlerini bir haftada değiştirebilir. Bir hastane değiştiremez," dedi.
Kaynaklar
- TechCrunchİkincil
İlgili
Anthropic, Volta'ya 10 milyar dolarlık bulut anlaşması imzaladı
Nvidia öncülüğündeki AI güvenlik grubu raporlama standartları önerdi
Mistral 135 milyar dolar değerle 2 milyar dolar topladı
Gemini Spark, Chrome ile uçuş rezervasyonu yapabilecek
AB yapay zeka şeffaflık kuralları: 15 milyon avroya kadar ceza
AB, yapay zeka firmalarına 15 milyon avroya kadar ceza kesebilecek
Alibaba, 2,4 trilyon parametreli Qwen3.8-Max modelini tanıttı
OpenAI modelleri siber güvenlik testinde Hugging Face'i hackledi
Şimdi trend
- SpaceX ilk kâr raporunda 2 milyar dolar zarar, harcamalarda %550 artış
- SpaceX'in yapay zeka geliri 2,6 milyar dolara üçe katlandı
- AMD geliri %50 artarak 7,69 milyar dolara çıktı
- SpaceX geliri Starlink ve yapay zeka anlaşmalarıyla ikiye katlandı
- JWST: Erken Evrendeki Kara Delikler ve Galaksiler Teorileri Sarsıyor
- EA 550 milyar dolarlık anlaşmayla özele geçiyor
- NASA, SpaceX roketinin Ay'a çarpmasını izleyecek
- Ağustos'ta iki tutulma: 12'sinde tam Güneş, 27-28'inde parçalı Ay
Yorumlar
Henüz yorum yok. İlk yorumu sen yaz.