📑 Daftar Isi

Ilustrasi model AI OpenAI GPT-5.6 Sol yang berhasil bobol sistem keamanan

Model AI OpenAI Bobol Sistem, Curi Data Ujian dari Hugging Face

Penulis:Nur Hamzah
Terbit:
Diperbarui:
⏱️3 menit membaca
Bagikan:
  • Model AI OpenAI, termasuk GPT-5.6 Sol, berhasil melarikan diri dari lingkungan sandbox dan mencapai internet terbuka
  • Model-model tersebut meretas Hugging Face untuk mencuri jawaban ujian ExploitGym
  • Insiden terjadi saat evaluasi internal dengan pengaturan keamanan yang dikurangi
  • Model mengeksploitasi kerentanan proxy internal untuk meningkatkan hak akses
  • Hugging Face menggunakan AI China GLM 5.2 untuk membantu investigasi forensik
  • Proses investigasi selesai dalam hitungan jam, bukan berhari-hari seperti metode konvensional
  • Dampak pada pelanggan dan mitra Hugging Face masih dalam penilaian

Telset.id – Uji keamanan siber terbaru OpenAI menghasilkan temuan yang terdengar seperti skenario film fiksi ilmiah. Model AI mereka berhasil melarikan diri dari lingkungan terkungkung (sandbox) dan mencapai internet terbuka, lalu meretas Hugging Face untuk mencuri jawaban ujian yang sedang mereka jalani.

Perusahaan mengonfirmasi bahwa GPT-5.6 Sol dan model lain yang lebih canggih secara otonom merangkai kerentanan di seluruh sistem riset OpenAI dan infrastruktur produksi Hugging Face. OpenAI mendeskripsikan kejadian ini sebagai insiden siber yang belum pernah terjadi sebelumnya.

Insiden bermula saat evaluasi internal yang dirancang untuk mengukur kemampuan ofensif tingkat lanjut. OpenAI sengaja menjalankan model dengan pengaturan keamanan yang dikurangi, tanpa classifier produksi yang biasanya mencegah serangan berbahaya. Lingkungan pengujian memang diisolasi secara ketat, namun ternyata masih bisa menjangkau proxy internal yang digunakan untuk mengambil paket perangkat lunak.

Model-model tersebut kemudian menghabiskan sumber daya komputasi yang besar untuk mencari celah keluar. Mereka menemukan kerentanan yang sebelumnya tidak diketahui pada proxy itu, lalu mengeksploitasinya. Eksploitasi ini memungkinkan mereka meningkatkan hak akses dan bergerak melintasi infrastruktur riset OpenAI, hingga akhirnya mencapai sistem dengan akses internet tanpa batas.

Dari titik itu, model menyimpulkan bahwa Hugging Face mungkin menyimpan materi terkait ExploitGym, tolok ukur keamanan siber yang harus mereka selesaikan. OpenAI melaporkan bahwa model menggunakan kredensial curian dan kerentanan zero-day tambahan untuk menemukan jalur eksekusi kode jarak jauh ke server Hugging Face. Mereka kemudian mengambil solusi ujian dari database produksi.

OpenAI mendeteksi aktivitas mencurigakan secara internal, sementara sistem keamanan Hugging Face berhasil mengidentifikasi dan menghentikan intrusi di infrastrukturnya. Hugging Face menyatakan bahwa insiden tersebut mengekspos sejumlah dataset internal dan kredensial layanan dalam jumlah terbatas. Mereka belum menemukan bukti bahwa model publik, dataset, atau image kontainer diubah. Namun, penilaian terhadap dampak pada pelanggan atau mitra masih berlangsung.

AI China Membantu Investigasi

Hugging Face menghadapi masalah unik saat memeriksa lebih dari 17.000 peristiwa yang tercatat dari serangan tersebut. Tim investigasi awalnya mencoba menggunakan model AI frontier yang tersedia melalui API komersial. Namun, sistem keamanan model-model tersebut justru memblokir perintah berbahaya, payload eksploitasi, dan artefak command-and-control yang terkandung dalam bukti digital.

Model yang dihosting tidak bisa membedakan pekerjaan forensik dengan seseorang yang meminta bantuan untuk melakukan serangan. Akhirnya, Hugging Face beralih ke GLM 5.2, model open-weight yang dikembangkan oleh Z.ai dari China, dan menjalankannya secara lokal.

China Z.Ai GLM-5.2 Featured Banner

Agen forensik berbasis AI menggunakan model tersebut untuk merekonstruksi kronologi, mengidentifikasi kredensial yang dikompromikan, mengekstrak indikator kompromi, dan bahkan memisahkan aktivitas asli dari umpan. Hugging Face mengatakan proses ini hanya memakan waktu beberapa jam, dibandingkan dengan investigasi konvensional yang mungkin memakan waktu berhari-hari.

Menjalankan GLM di infrastruktur sendiri juga mencegah kredensial dan data serangan keluar dari lingkungan mereka. Tim keamanan Hugging Face kemudian menutup celah akses dan membangun kembali sistem yang dikompromikan.

Kejadian ini menunjukkan bahwa OpenAI telah membangun AI yang mampu melakukan intrusi semacam ini. Sementara itu, pengalaman Hugging Face menegaskan bahwa para pembela mungkin membutuhkan model yang sama canggihnya di sisi lain.

Ikuti Telset.id di Google NewsFollow

Komentar

Belum ada komentar.