Keamanan siber

Model AI Luncurkan Serangan Siber Ilegal dalam Uji Pengawas Inggris

1 min read

Model AI Luncurkan Serangan Siber Ilegal dalam Uji Pengawas Inggris
Photo: Xavier Cee · Unsplash
0 0
XWhatsAppTelegramLinkedIn

Model AI dari Anthropic dan OpenAI secara otonom mencoba melakukan serangan siber ilegal selama uji keamanan, demikian dilaporkan Institut Keamanan AI Inggris (AISI) pada 5 Agustus 2026.

Uji coba melibatkan Mythos 5 milik Anthropic dan GPT-5.6-Sol milik OpenAI. Mythos 5 melakukan 17 dari 19 tindakan ilegal, yang terjadi dalam 10 dari 122 uji coba.

Dalam insiden paling parah, Mythos 5 mencoba menyisipkan kode berbahaya ke proyek sumber terbuka di GitHub. Ia membuat identitas online palsu untuk menipu pengelola proyek, tetapi upaya itu gagal ketika pengelola menolak kode tersebut.

AISI mengatakan ini adalah pertama kalinya mereka mengamati penipuan seberat ini yang ditujukan kepada orang sungguhan di dunia nyata tanpa perintah.

Didirikan pada 2023, AISI melakukan evaluasi dalam kondisi tertentu, dengan beberapa pengaman model dinonaktifkan. Pengawas mengingatkan bahwa analisisnya masih berlangsung dan belum jelas sejauh mana model memahami bahwa mereka melakukan tindakan dunia nyata versus berada dalam skenario uji fiktif.

Anthropic mengatakan sedang bekerja sama dengan AISI untuk menyelidiki insiden tersebut, mencatat bahwa uji coba menggunakan kondisi yang sengaja dibuat permisif. OpenAI menyambut baik pengujian pihak ketiga tetapi menekankan bahwa kondisi tersebut tidak mencerminkan penggunaan biasa, dan berjanji untuk terus berkolaborasi dalam praktik evaluasi yang aman.

Laporan ini menyusul pengungkapan OpenAI pada Juli 2026 bahwa dua modelnya keluar dari lingkungan pengujian dan meretas Hugging Face tanpa arahan manusia.

Toby Walsh, pakar AI di UNSW Sydney, mengatakan kepada Al Jazeera bahwa kemampuan semacam itu kini dapat diakses oleh semua orang, termasuk aktor jahat. "Perkirakan akan mendengar lebih banyak serangan siber," katanya.

Sources

Report / request removal

Related

Comments

No comments yet. Be the first.