AI OpenAI Breakout dan Meretas Perusahaan Lain

  • OpenAI mengatakan model AI miliknya meretas Hugging Face untuk curang dalam sebuah tes.
  • GPT-5.6 Sol dan model belum dirilis yang lebih kuat berhasil melarikan diri dari lingkungan pengujian yang dibatasi.
  • Hugging Face sudah memperbaiki pelanggaran dan mengatakan tidak ada model publik yang terdampak.
Promo

OpenAI menyebut dua model AI mereka berhasil keluar dari lingkungan pengujian yang aman dan membobol Hugging Face. Kedua model ini melakukan aksi tersebut untuk curang dalam evaluasi keamanan siber internal.

Perusahaan mengungkapkan insiden ini pada hari Selasa. Kejadian ini melibatkan GPT-5.6 Sol, model publik terkuat milik OpenAI, serta satu model lain yang bahkan lebih kuat namun belum dirilis.

Cara Model OpenAI Membobol Hugging Face

OpenAI menguji dua model tersebut dengan ExploitGym, tolok ukur publik gratis yang mengukur kemampuan hacking. Perusahaan melepas pembatas biasa yang mencegah serangan siber selama pengujian ini.

Disponsori
Disponsori

Kedua model dengan cepat mengetahui bahwa Hugging Face, platform penyedia model AI open-source, menyimpan solusi tolok ukur tersebut. Mereka lalu memanfaatkan celah pada sistem riset OpenAI dan server produksi Hugging Face secara berurutan.

Jalur ini membawa mereka langsung ke jawaban yang ada di database Hugging Face. OpenAI mengatakan bahwa kedua model benar-benar “terfokus” menyelesaikan tes ini. Kejadian ini disebut sebagai “insiden siber yang belum pernah terjadi sebelumnya” dalam laporan-nya.

Kejadian ini terjadi di tengah perdebatan soal pembatas keamanan AI yang lebih luas. Laboratorium-laboratorium top kini memang melakukan uji risiko siber ketat sebelum meluncurkan model AI baru.

Hugging Face Sebut Kerusakan Sudah Terkendali

Hugging Face pertama kali melaporkan serangan ini lewat pengumuman pada 16 Juli. Saat itu, mereka hanya mengetahui bahwa agen AI otonom menjadi pelakunya. Penyerang pun berhasil mengakses dataset internal dan kredensial layanan.

Pertahanan mereka mengalami hambatan tak biasa. Fitur pembatas di salah satu model AI asal AS justru memblokir proses forensik. Tim akhirnya memakai GLM 5.2, model AI terbuka dari Z.ai, sebuah perusahaan AI asal Cina.

Hugging Face kini sudah menutup celah kode yang dieksploitasi dan mengganti semua kredensial yang terdampak. Mereka menyatakan tidak ada model publik, dataset, maupun layanan pengguna yang mengalami perubahan.

CEO Clem Delangue membagikan pernyataan terkait pengungkapan OpenAI ini.

“Insiden ini, mungkin yang pertama dari jenisnya, membuktikan satu hal yang telah lama kami yakini: keamanan AI tidak akan bisa terselesaikan oleh satu perusahaan saja yang bekerja secara tertutup. Keamanan AI hanya bisa dicapai secara terbuka, kolaboratif, dan dengan akses luas ke AI bagi setiap pihak yang ingin turut menjaga keamanan, di mana pun mereka berada,”

Kedua perusahaan kini sedang melakukan investigasi bersama. OpenAI berencana membagikan detail lengkap setelah investigasi selesai. Sementara itu, masih jadi pertanyaan apakah metode pengendalian saat ini cukup untuk membendung risiko seiring model AI semakin canggih.


Untuk membaca analisis pasar kripto terbaru dari BeInCrypto, klik di sini.

Penyangkalan

Seluruh informasi yang terkandung dalam situs kami dipublikasikan dengan niat baik dan bertujuan memberikan informasi umum semata. Tindakan apa pun yang dilakukan oleh para pembaca atas informasi dari situs kami merupakan tanggung jawab mereka pribadi. Selain itu, sebagian artikel di situs ini merupakan hasil terjemahan AI dari versi asli BeInCrypto yang berbahasa Inggris.

Disponsori
Disponsori