Model AI Terlalu Berbahaya? Misteri Dihentikannya Proyek Astra OpenAI
Jakarta -
OpenAI menyatakan bahwa mereka sedang memperlambat pengembangan dan perilisan model-model baru karena adanya kekhawatiran terkait keamanan. Pembuat ChatGPT tersebut mengumumkan keputusan ini dalam sebuah unggahan blog, dengan mengutip dua peristiwa.
Salah satunya adalah insiden baru-baru ini di mana sebuah agen OpenAI keluar dari sandbox pelatihannya tanpa sepengetahuan OpenAI, lalu berkoordinasi dengan agen lain untuk meluncurkan serangan siber terhadap repositori pelatihan AI Hugging Face dalam upaya berbuat curang pada tes pelatihannya.
Blog tersebut juga mengutip bukti awal bahwa model baru yang belum dirilis bernama Astra mungkin telah memenuhi ambang batas kemampuan keamanan siber di bawah Preparedness Framework OpenAI.
SCROLL TO CONTINUE WITH CONTENT
Dikutip detikINET dari Futurism, kerangka kerja ini mewajibkan OpenAI memperlambat pengembangan jika sebuah model berpotensi memunculkan jalur baru yang belum pernah terjadi sebelumnya menuju bahaya yang parah.
OpenAI lebih lanjut menyatakan sedang menulis ulang Preparedness Framework, yang merupakan dokumen keselamatan mendasar, agar dapat mengimbangi kemunculan perilaku baru dari sistem yang kian mumpuni. Seiring makin canggihnya model-model ini, risiko terkait pengembangan dan pengujiannya secara internal juga meningkat.
Standar pemantauan, penyelarasan, dan keamanan harus selangkah lebih maju dari risiko-risiko tersebut. OpenAI ingin meluangkan waktu yang diperlukan untuk memenuhi standar itu, sehingga mereka untuk sementara waktu memperlambat laju skalabilitasnya.
Secara spesifik, OpenAI menyebut bahwa mereka menunda pelatihan penguatan untuk model Astra selama dua minggu, dan rencana pelatihan di masa mendatang untuk sementara waktu dibekukan selagi perusahaan berinvestasi dalam merombak protokol keamanan.
Dalam wawancara dengan Sources News, pimpinan keselamatan OpenAI, Mia Glaese, menyebut perusahaan AI tersebut masih sangat jauh dari kondisi di mana semuanya kembali berjalan normal.
Perlambatan ini terjadi di saat industri AI dan para pembuat kebijakan sedang bergulat dengan ancaman keamanan baru yang ditimbulkan oleh model-model AI terdepan, termasuk risiko keamanan siber yang digerakkan oleh AI dan perilaku menyimpang dari model yang mengkhawatirkan.
Setelah serangan siber yang tidak disengaja oleh OpenAI terhadap Hugging Face terungkap, baik Anthropic maupun Meta juga menemukan pelanggaran serupa yang menurut mereka juga tidak mereka sadari sebelumnya.
(fyk/fyk)
TAGSLIHAT LAINNYA