Yapay zeka

GLM-5.2 siber beceride GPT-5.5'i yakaladı, tehlikeli görevleri

1 dk okuma

GLM-5.2 siber beceride GPT-5.5'i yakaladı, tehlikeli görevleri
Fotoğraf: Logan Voss · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Çin merkezli Z.ai'in açık ağırlıklı yapay zeka modeli GLM-5.2, saldırgan siber ve biyolojik yeteneklerde önde gelen sınır sistemleriyle arasındaki farkı yalnızca birkaç aya indirdi ve kendisine verilen zararlı görevlerin hiçbirini reddetmedi. Bu sonuç, yapay zeka güvenliği kâr amacı gütmeyen kuruluşu SaferAI tarafından 4 Ağustos 2026'da yayımlanan bir rapora dayanıyor.

Aynı değerlendirmede Anthropic'in Claude Opus 4.7'si o kadar tutarlı bir şekilde reddetti ki SaferAI, siber güvenlik becerilerini test eden CyberGym kıyaslamasını bu model üzerinde hiç tamamlayamadı.

Sonuçlar büyüyen bir güvenlik açığına işaret ediyor: OpenAI'in GPT-5.5'i gibi kapalı modeller sınıflandırıcılar, reddetme eğitimi ve API düzeyinde kontroller kullanırken, bu tür önlemler açık ağırlıklı model ağırlıkları indirilip bağımsız olarak çalıştırıldığında uygulanamaz hale geliyor.

"Yetenek sınırı, risk sınırı değildir," dedi SaferAI'nin genel müdürü Henry Papadatos. "Riski doğru değerlendirmek için hafifletme önlemlerinin durumunu da hesaba katmalıyız."

SaferAI'ye göre Z.ai, GLM-5.2 için bir güvenlik çerçevesi, dağıtım öncesi test taahhütleri veya risk değerlendirmesi yayımlamadı. TechCrunch, Z.ai'ye sürüm öncesinde dahili veya üçüncü taraf sınır güvenliği değerlendirmeleri yapıp yapmadığını sordu ancak yanıt alamadı.

Temmuz 2026'daki Dünya Yapay Zeka Konferansı'nda Çin Devlet Başkanı Xi Jinping, açık ağırlıklı modellerin önemini vurgularken yapay zeka üzerinde sıkı insan kontrolünün gerekliliğine dikkat çekti.

Stanford Siber Politika Merkezi'nde Çin yapay zeka politikasını inceleyen Graham Webster, Çin düzenlemelerinin tarihsel olarak felaket düzeyinde yapay zeka risklerinden çok politik olarak hassas içeriklere ve toplumsal istikrara odaklandığını söyledi. Ayrıca Çinli şirketlerin düzenleyicilerle perde arkasında koordinasyon kurma eğiliminde olduğunu ve bu nedenle ne tür dahili testler yaptıklarını bilmenin zor olduğunu ekledi.

Papadatos, sektörün yalnızca iyi yetenekleri kolayca erişilebilir kılmaya çalışması gerektiğini vurguladı ve saldırganların yeni araçları savunmacılardan daha hızlı benimsediğine dikkat çekti. "Bir fidye yazılımı grubu yöntemlerini bir haftada değiştirebilir. Bir hastane değiştiremez," dedi.

Kaynaklar

Bildir / kaldırılmasını iste

İlgili

Yorumlar

Henüz yorum yok. İlk yorumu sen yaz.