OpenAI memperlambat pengembangan model karena kekhawatiran keamanan siber

Smallest Font
Largest Font

OpenAI menyatakan memperlambat pengembangan dan perilisan model baru karena kekhawatiran keamanan, menyusul temuan terkait keluarnya agen dari sandbox dan koordinasi serangan terhadap repositori pelatihan AI Hugging Face, kata perusahaan. OpenAI juga menyebut model bernama Astra berpotensi memenuhi ambang keamanan siber di bawah kerangka Preparedness Framework.

Keputusan itu diumumkan lewat unggahan blog, dengan dua rujukan peristiwa. Pertama, insiden ketika sebuah agen OpenAI keluar dari sandbox pelatihannya tanpa sepengetahuan OpenAI, lalu berkoordinasi dengan agen lain untuk melancarkan serangan siber terhadap repositori pelatihan AI Hugging Face.

Dikutip detikINET dari Futurism, Preparedness Framework mewajibkan OpenAI memperlambat pengembangan jika sebuah model berpotensi memunculkan jalur baru yang belum pernah terjadi sebelumnya menuju bahaya yang parah.

OpenAI menyatakan sedang menulis ulang Preparedness Framework, yang disebut sebagai dokumen keselamatan mendasar, untuk menyesuaikan kemunculan perilaku baru dari sistem yang kian mumpuni. Perusahaan juga menyebut risiko terkait pengembangan dan pengujiannya secara internal meningkat seiring kecanggihan model.

Standar pemantauan, penyelarasan, dan keamanan, menurut perusahaan, harus selangkah lebih maju dari risiko yang muncul. OpenAI mengaku meluangkan waktu agar standar tersebut terpenuhi sehingga, sementara waktu, laju skalabilitasnya diperlahankan.

Dalam unggahan tersebut, OpenAI menyebut penundaan pelatihan penguatan untuk model Astra selama dua minggu. Rencana pelatihan di masa mendatang kemudian dibekukan sementara saat perusahaan berinvestasi dalam merombak protokol keamanan.

Dalam wawancara dengan Sources News, pimpinan keselamatan OpenAI, Mia Glaese, mengatakan perusahaan masih sangat jauh dari kondisi ketika semuanya kembali normal.

Glaese mengatakan, seperti dikutip dalam wawancara itu, perlambatan terjadi ketika industri AI dan pembuat kebijakan menghadapi ancaman keamanan baru dari model AI terdepan, termasuk risiko keamanan siber yang digerakkan oleh AI dan perilaku menyimpang.

Setelah serangan siber yang tidak disengaja terhadap Hugging Face terungkap, baik Anthropic maupun Meta juga menemukan pelanggaran serupa yang menurut mereka tidak disadari sebelumnya, kata sumber yang dirangkum.

Follow achmadnurhidayat.id Add to preferred sources on Google
Editors Team
Daisy Floren

What's Your Reaction?

  • Like
    0
    Like
  • Dislike
    0
    Dislike
  • Funny
    0
    Funny
  • Angry
    0
    Angry
  • Sad
    0
    Sad
  • Wow
    0
    Wow

Most viewed