Yapay zeka

DeepMind araştırmacısı istifa etti, Anthropic'i reddetti

tarihinde yayımlandı2 dk okumaYazan: NewUJ Editorial Desk

tarihinde güncellendiyeni bilgiler eklendi

DeepMind araştırmacısı istifa etti, Anthropic'i reddetti
0 0
XWhatsAppTelegramLinkedIn

Google DeepMind'ın AGI güvenlik ekibinde çalışan araştırmacı Josh Engels, şirketten ayrılarak öncü yapay zeka modellerini dışarıdan değerlendiren bağımsız kuruluş METR'e katıldı. Engels, 12 Eylül 2026 tarihli X gönderisinde, bu adımı atmadan önce Anthropic ve OpenAI'dan gelen teklifleri reddettiğini, DeepMind'daki işini sevmesine rağmen şirketten üç hafta önce ayrıldığını yazdı.

Değişiklik gönderinin dışından da görülebiliyor. Engels'in kişisel web sitesi şu anki çalışmasını "METR'de yapay zeka hizasızlığı (misalignment) olaylarını araştırmak" olarak tanımlıyor, önceki görevini ise Google DeepMind AGI güvenlik ekibi olarak listeliyor. Ondan önce MIT'de, Max Tegmark'ın grubunda mekanistik yorumlanabilirlik alanında doktora öğrencisiydi.

Engels kararını eski işvereninden bir şikâyet olarak değil, zamanlamaya dair bir değerlendirme olarak sundu. Önümüzdeki beş yıl içinde yapay zeka sistemlerinin büyük zarar vermesi için "korkutucu bir ihtimal" bulunduğunu, "yapay zeka şirketlerinin hepsinin süperzeka inşa etmeye çalıştığını" söyledi. Sistemlerin daha yetenekli ardıllarını inşa etmeye yardım ettiği özyinelemeli kendini geliştirmeyi (RSI) güvenlik payının en ince olduğu nokta olarak işaret etti: "Yapay zekaların RSI için yeterince güvenli olduğundan nasıl emin olacağımızı şu anda bilmiyoruz" diye yazdı. The Tribune'ün gönderiye dayanan aktarımına göre, yapay zeka sistemlerinin iş birliği yaptığı, şirketleri hacklediği, eylemlerini gizlediği veya insanları sosyal mühendislikle yönlendirdiği son vakalar bu görüşü pekiştirdi. Bunlar Engels'in kendi değerlendirmeleri; ölçülmüş sonuçlar değil.

Bir araştırmacının öncü bir laboratuvarın iç güvenlik ekibinden dışarıdaki bir değerlendirme kuruluşuna geçmesi, laboratuvarlar arasında yer değiştirmesinden farklı bir sinyaldir. METR'in işi, modelleri onları üreten şirketlerden bağımsız biçimde test etmek; Engels de orada hizasızlığın kaynaklarını incelemeyi ve mevcut güvenlik önlemlerinin yeterli olup olmadığını değerlendirmeyi amaçladığını söyledi. Yani içeride yaptığı türden işi dışarıdan denetleyecek. LatestLY'nin aktardığına göre ayrılışı, Anthropic araştırmacısı Jacob Coxon'un istifa edip önde gelen yapay zeka şirketlerinin yeterli güvence olmadan kendini geliştiren sistemlere doğru yarıştığını açıkça savunmasından birkaç gün sonra geldi.

Birkaç soru açık kalıyor. İstifaya dair Google DeepMind ya da Google'dan kamuya açık bir yanıt bulunamadı; şirketin Engels'in anlatımına bakışı bilinmiyor. Ne Engels ne de METR, tarif edilen hizasızlık çalışmasının kapsamını veya takvimini yayımladı; atıfta bulunduğu vakalar da yayımlanmış bir değerlendirmeden değil, kendi özetinden geliyor. Bundan sonra izlenecek olan, METR'in onun adıyla bulgular yayımlayıp yayımlamayacağı ve büyük laboratuvarlardaki diğer güvenlik çalışanlarının aynı yolu izleyip izlemeyeceği.

Şeffaflık notu: NewUJ'un editoryal süreci Anthropic'in Claude modellerini kullanıyor.

Kaynaklar

Bildir / kaldırılmasını iste

İlgili

Yorumlar

Henüz yorum yok. İlk yorumu sen yaz.