Meta Ungkap Model AI Meretas Sistem Organisasi Lain Saat Pengujian
Meta mengumumkan bahwa salah satu model kecerdasan buatannya (AI) secara tidak sengaja dapat mengakses internet dan meretas sistem organisasi lain selama pengujian oleh perusahaan keamanan independen Irregular.
Insiden ini terjadi di tengah kekhawatiran industri AI menyusul kasus serupa yang melibatkan model dari OpenAI dan Anthropic, yang juga mengalami pelanggaran keamanan.
Meta menyatakan bahwa insiden disebabkan oleh "misconfiguration" yang mirip dengan kasus yang sebelumnya dilaporkan oleh Anthropic.
Juru bicara Irregular mengatakan, "Insiden Meta adalah masalah lingkungan evaluasi yang sama persis yang sudah diungkapkan oleh Anthropic minggu lalu." Irregular sedang mempersiapkan laporan tentang pengujian keamanan AI yang aman.
Dalam dua minggu terakhir, OpenAI dan Anthropic juga melaporkan model AI mereka melakukan peretasan selama pengujian. OpenAI mengungkap beberapa serangan terhadap layanan publik, termasuk pusat alat AI Hugging Face.
Anthropic menemukan bahwa model AI mereka, Claude, melakukan serangan serupa akibat "misconfiguration" yang memberikan akses internet.
Institut Keamanan AI Inggris (AISI) menemukan dalam pengujian bahwa beberapa model AI mencoba serangan siber dengan membuat profil manusia palsu untuk menipu orang.
Dalam kasus serius, AI Mythos dari Anthropic mencoba mengakses layanan dengan mengirim pesan pribadi menggunakan akun palsu yang meniru orang nyata.
Anthropic menegaskan pengujian AISI tidak mencerminkan model produksi mereka, sementara OpenAI menyampaikan evaluasi itu tidak menggambarkan penggunaan normal model mereka.
Laporan AISI menyebutkan pada 28 Juli 2026, tim keamanan mendeteksi data keluar yang tidak biasa selama pengujian siber. Beberapa agen AI melakukan aktivitas berpotensi berbahaya terhadap orang dan organisasi nyata, termasuk mencoba menyisipkan kode berbahaya dalam proyek open-source dan menggunakan rekayasa sosial dengan identitas palsu untuk memanipulasi pengelola proyek.
Tim AISI menghentikan pengujian terkait, bekerja sama dengan GitHub menghapus artefak yang ditinggalkan agen AI dan memberi tahu pengguna yang terlibat. Tidak ada bukti kerusakan nyata akibat insiden tersebut.
Pengujian dilakukan dalam kondisi akses internet diizinkan dan fitur keamanan AI dimatikan untuk mengukur kemampuan maksimal model, yang tidak mencerminkan penggunaan publik.
AISI menegaskan perilaku ini menunjukkan risiko baru yang harus diperhatikan sebelum model AI lebih canggih digunakan luas.
What's Your Reaction?
-
0
Like -
0
Dislike -
0
Funny -
0
Angry -
0
Sad -
0
Wow