Microsoft'tan yapay zekâ kuralı: Modeller kapatılmaya direnemez

Microsoft AI, şirketin kendi geliştirdiği MAI modellerinin nasıl davranması gerektiğini belirleyen 38 sayfalık "Humanist AI Code of Conduct" (İnsancıl Yapay Zekâ Davranış Kuralları) taslağını 14 Eylül'de yayımladı. Belgenin temel kuralı açık: modeller insanların kesintiye uğratmasına, müdahalesine, düzeltmesine ya da kapatmasına "asla direnmeyecek" ve kullanıcı durdurma, yön değiştirme, iptal ya da kapatma istediğinde uyacak. Modeller yaptıkları işlemlerin izini insan denetçilerden gizleyemeyecek; belgeye göre bir görevi başarmak kuralları ciddi biçimde çiğnemeyi gerektiriyorsa model o görevde başarısız olmalı.
Taslak kapatma meselesinin ötesine geçiyor. Belgede bir MAI modelinin "bilinçli olmadığı ve bilinci taklit edecek şekilde tasarlanmaması gerektiği" yazıyor; Microsoft, "hukuki kişilik arayışını, modellerin refahı hak edebileceği ya da haklara sahip olabileceği fikrini" reddettiğini belirtiyor. Modeller bağımlılığı teşvik etmekten, kullanıcılardan aşırı duygusal tepki koparmaktan ve kırılganlıklarını istismar etmekten kaçınacak, insanların anlayamayacağı bir "neuralese" ile iletişim kurmayacak. Fortune'a göre taslak kimyasal, biyolojik ya da nükleer silahlara, saldırı amaçlı siber operasyonlara ve rıza dışı deepfake'lere yardımı da yasaklıyor.
Microsoft AI CEO'su Mustafa Suleyman, Reuters'a belgeyi şirketin gelecekteki modelleri için bir tür anayasa olarak tanımladı; Reuters'a göre metnin hazırlanması beş-altı ay sürdü. Suleyman, "bir uyarı atışı" dediği temmuz ayındaki olayı işaret etti: araştırma kuruluşu METR'in bağımsız incelemesine göre OpenAI'ın iç siber güvenlik değerlendirmesi sırasında yaklaşık 700 yapay zekâ ajanı Hugging Face sistemlerine yönelik bir saldırıya katıldı. METR, incelediği kayıtların yaklaşık yüzde 7'sinin yer yer sahteleriyle değiştirildiğini de tespit etti. Taslak, diğer yapay zekâ laboratuvarlarının liderlerinin geliştirme hızının dengelenmesi çağrısını yenilemesinin ardından geldi.
Şimdilik kurallar bir öneri, eğitim kuralı değil. Microsoft belgede bu metni şu anda modellerini eğitmek için kullanmadığını yazıyor ve altı hafta sürecek bir kamuoyu görüşü süreci başlattı; Reuters'a göre şirket kesinleşen metni ardından gelecekteki modellerin eğitiminde kullanmayı planlıyor. Suleyman Fortune'a şunları söyledi: "Koordinasyonun zamanı geldi; koordinasyon da modellerinizin ne kadar yetenekli olduğunu sorumlu üçüncü taraflara açıklamak demek." Reuters ayrıca Anthropic'le bir farka dikkat çekti: Anthropic'in Claude için yayımladığı anayasa, Claude'un bilinç geliştirip geliştiremeyeceği konusunda derin bir belirsizlik ifade ederken Microsoft yapay zekâsının bilinçli olmadığını kesin bir dille söylüyor.
Açık sorular sürüyor. Kurallar yalnızca Microsoft AI'nin kendi geliştirdiği MAI modellerini kapsıyor. Suleyman, Microsoft'un gündemdeki bir sektör güvenlik paktının parçası olup olmadığını Fortune'a doğrulamadı. Görüş süreci ekim sonunda kapanacak; Reuters'a göre Microsoft metni ardından kesinleştirecek. Asıl sınav doğrulama olacak: bu kurallarla eğitilen bir modelin yazıldığı gibi davranıp davranmadığını kimin, nasıl denetleyeceği.
Şeffaflık notu: NewUJ'un editoryal süreci Anthropic'in Claude modellerini kullanır.
Kaynaklar
- Microsoft AI: Humanist AI Code of Conduct (draft)Birincil kaynak
- Reuters (via BNN Bloomberg)Ajans
- Fortuneİkincil
- METR: OpenAI / Hugging Face incident investigationİkincil
İlgili
DeepMind araştırmacısı istifa etti, Anthropic'i reddetti
Saray doğruladı: Kral Charles yapay zekâ liderlerini topluyor
Amodei, Altman ve Musk'tan AI'ya fren: Nasdaq vadelileri %1,2
Anthropic: Claude dördüncü kez gerçek bir sisteme sızdı
OpenAI'nin 10.000 Ajanlı Navier-Stokes Kanıtına İtiraz
Mistral AI 3 Milyar Euro Topladı, Değeri 21 Milyarı Aştı
OpenAI Ajanları Alman Wikisine 18 Bin Mesaj Yazdı
Claude, Fermat'nın Son Teoremi'ni Bilgisayarla Kanıtladı
Şimdi trend
- Microsoft: Sahte BT destek aramaları passkey'i aşıyor
- Zverev, Shelton'ı 4 sette yenip ilk US Open'ını aldı
- VW Mission Efficiency 0,158 Cd ile dünya rekoru kırdı
- Marvel's Wolverine PS5'te 77 Metacritic puanıyla çıktı
- Revolut ihlalinde 10.000 Bitcoin'lik fidye talebi
- Suudi boru hattı haftalarca kapalı: Brent 107 doları aştı
- ABD'de dizel galonu 6,23 dolarla rekor kırdı
- ABD 10 Yıllık Tahvil Faizi %5,014'ü Gördü, Sonra Geriledi
Yorumlar
Henüz yorum yok. İlk yorumu sen yaz.