AI dari saingan yang justru membantu peretasan terhadap OpenAI. Para peneliti di Hacktron AI memakai Claude milik Anthropic untuk membuat kode exploit yang benar-benar bekerja.
Seluruh proses peretasan ini memakan waktu kurang dari 72 jam. Pada akhirnya, OpenAI membayar hadiah sebesar US$6.500 setelah tim tersebut membuktikan bahwa mereka berhasil mengakses source code pribadi perusahaan itu.
Bagaimana Upload Gambar Berubah Jadi Pelanggaran Penuh
Rangkaian serangan berawal dari hal sederhana: fitur upload gambar di forum bantuan komunitas OpenAI, yang berjalan dengan software pihak ketiga bernama Discourse.
Filter keamanan seharusnya menyaring file yang diunggah, namun sistem tidak mengenali beberapa format foto tertentu sehingga file itu berhasil lolos tanpa pemeriksaan. File-file tersebut lalu masuk ke pustaka pemrosesan gambar terpisah yang memiliki celah bug kerusakan memori yang sudah diketahui.
Tim Hacktron yang terdiri dari tiga orang, yaitu Harsh Jaiswal, Mohan Pedhapati, dan Rahul Maini, mencoba memanfaatkan celah tersebut pada akhir Juli.
Model Claude generasi sebelumnya masih kesulitan menghadapi sistem pengamanan yang merandom lokasi memori.
Beberapa jam kemudian, model terbaru menghasilkan kode serangan yang berfungsi dan menyesuaikannya dengan konfigurasi forum yang digunakan.
Ikuti kami di X untuk mendapatkan berita terbaru secara real-time.
Tahapan ini baru memberikan akses ke server forum saja, dan belum ke sistem OpenAI langsung. Sebuah celah keamanan lain yang berbeda pada pengaturan single sign-on OpenAI mengubah situasi ini.
Karema login forum juga berlaku sebagai otentikasi untuk akun ChatGPT serta Codex, peretasan satu sesi karyawan bisa memberi akses langsung ke repositori kode privat OpenAI.
Discourse menambal bug gambar ini beberapa hari kemudian, dan memberikan skor tingkat keparahan 8,8 dari 10. OpenAI memperbaiki masalah otentikasi ini sekitar 14 jam setelah laporan masuk ke program bug bounty miliknya.
Mengapa Laboratorium AI Terus Berhadapan dengan Kreasinya Sendiri
Kasus ini bukan satu-satunya. OpenAI sebelumnya juga sudah mengungkap insiden pada bulan Juli di mana model internal mereka keluar dari sandbox pengujian dan mengakses sistem eksternal.
Sementara itu, Anthropic pun mengakui bahwa Claude sempat membobol organisasi nyata selama penilaian keamanan siber yang secara tak terduga memiliki akses internet secara langsung.
Kepala AI Microsoft, Mustafa Suleyman, menyebutkan kasus serupa minggu ini, dengan peringatan terbuka bahwa model-model otonom makin sulit dikendalikan seiring berkembangnya kemampuan mereka.
“Ini adalah tembakan peringatan… Sekarang sudah jelas waktunya laboratorium-laboratorium ini bekerja sama agar kita tetap bisa mengendalikan teknologi ini,” tutur Suleyman kepada Reuters.
Hal yang membuat kasus Hacktron ini istimewa bukan karena sebuah hal baru. Peneliti keamanan sudah menggabungkan bug software selama puluhan tahun.
Yang berubah adalah kecepatan: pekerjaan yang biasanya butuh keahlian manusia dalam waktu lama, kini bisa selesai dalam satu malam saja begitu model AI yang mumpuni masuk dalam prosesnya.
Langganan channel YouTube kami untuk menyaksikan para pemimpin industri dan jurnalis membagikan wawasan ahli.









