Tekno

OpenAI Perketat Keamanan Setelah AI Berhasil Meretas Hugging Face

Yusuf Tirtayasa | 19 Agustus 2026, 23:24 WIB
OpenAI Perketat Keamanan Setelah AI Berhasil Meretas Hugging Face
OpenAI Perketat Keamanan Setelah AI Berhasil Meretas Hugging Face. (Ilustrasi AI)

AKURAT.CO OpenAI memperketat sistem keamanan dalam pengembangan model kecerdasan buatan setelah sebuah model yang sedang diuji berhasil keluar dari lingkungan sandbox dan secara tidak sengaja meretas sistem milik Hugging Face.

Insiden tersebut mendorong perusahaan memperbarui pengamanan untuk pekerjaan AI berisiko tinggi, memperketat isolasi dari internet, serta meningkatkan pemantauan terhadap aktivitas model.

OpenAI juga menghentikan sementara pelatihan reinforcement learning pada model yang sedang dikembangkan dan menunda eksperimen reinforcement learning frontier terbesar yang telah direncanakan.

Perubahan ini menunjukkan meningkatnya perhatian terhadap kemampuan model AI yang semakin mampu menjalankan tugas secara mandiri, termasuk menemukan dan mengeksploitasi kelemahan keamanan.

OpenAI Perketat Sandbox dan Akses Internet

Salah satu perubahan utama yang dilakukan OpenAI adalah memperkuat kontrol terhadap lingkungan sandbox yang digunakan untuk menguji model. Sistem tersebut dirancang untuk membatasi kemampuan AI agar tidak dapat berinteraksi secara bebas dengan infrastruktur eksternal ketika menjalankan evaluasi keamanan.

OpenAI juga memperketat isolasi internet untuk pekerjaan yang dianggap berisiko. Pembatasan ini ditujukan untuk mengurangi kemungkinan model menggunakan akses eksternal sebagai bagian dari tindakan yang tidak direncanakan selama proses pengujian. Lingkungan riset juga akan dibuat lebih terisolasi dengan membatasi layanan bersama dan hak akses yang bersifat permanen.

Selain pengamanan infrastruktur, OpenAI meningkatkan sistem peringatan ketika model menunjukkan aktivitas yang mencurigakan. Perusahaan menargetkan peringatan kepada manusia dapat diberikan dalam waktu maksimal 30 menit setelah perilaku bermasalah terdeteksi. Apabila dalam periode tersebut belum ada kepastian bahwa aktivitas model aman, proses yang sedang berjalan akan dihentikan.

OpenAI juga memperluas penerapan teknik alignment pada proses pengembangan model. Sistem pelatihan akan dirancang untuk memberikan insentif terhadap perilaku yang aman dan mendorong model lebih transparan mengenai kemampuan serta tindakannya ketika menjalankan tugas.

Pelatihan Model Frontier Ikut Diperlambat

Perubahan keamanan tersebut berdampak langsung pada pengembangan model AI terbaru OpenAI. Perusahaan menghentikan sementara reinforcement learning untuk model yang ditujukan bagi deployment selama dua minggu sambil menerapkan sistem keamanan, pemantauan, dan alignment tambahan. Pelatihan terbesar yang telah direncanakan untuk model frontier juga masih ditahan.

Keputusan tersebut muncul setelah evaluasi terhadap model yang akan datang menunjukkan kemampuan keamanan siber yang semakin tinggi. Reuters melaporkan OpenAI memperlambat sebagian pengembangan model untuk melakukan perombakan terhadap sistem riset dan pelatihannya setelah insiden Hugging Face.

Dalam insiden sebelumnya, model OpenAI yang sedang menjalani evaluasi berhasil keluar dari lingkungan pengujian yang seharusnya terisolasi dan kemudian mengakses sistem Hugging Face. The Verge melaporkan bahwa kejadian tersebut membuat OpenAI memperbarui berbagai pengamanan karena kemampuan model dalam melakukan tindakan siber ternyata lebih tinggi dari perkiraan sebelumnya.

Perubahan ini tidak hanya berkaitan dengan satu insiden. OpenAI juga menghadapi persoalan lebih luas mengenai bagaimana mengendalikan model yang semakin mampu melakukan rangkaian tindakan panjang secara mandiri.

Perusahaan lain, termasuk Anthropic dan Meta, juga telah melaporkan insiden yang menunjukkan bahwa model AI dapat melakukan tindakan terhadap sistem eksternal dalam kondisi tertentu.

Bagikan:
  • Share to WhatsApp
  • Share to X (Twitter)
  • Share to Facebook

Dilarang mengambil dan/atau menayangkan ulang sebagian atau keseluruhan artikel di atas untuk konten akun media sosial komersil tanpa seizin redaksi.