VLOBS.COM – OpenAI menyatakan telah mengidentifikasi dan menghentikan kampanye distilasi adversarial yang berlangsung hampir sepanjang Juli. Perusahaan itu mengaitkan klaster utama aktivitas tersebut dengan Moonshot AI, pengembang Kimi.
Dalam unggahan blog pada Rabu, OpenAI mengatakan permintaan dimulai pada 1 Juli dan meningkat tajam pada 24 dan 25 Juli. Pada dua tanggal tersebut, perusahaan mencatat 16.000 permintaan dengan pola ekstraksi yang relevan, yang berasal dari lebih dari 4.000 pengguna. Penyelidikan lanjutan menemukan aktivitas pola prompt terkait di lebih dari 15.000 pengguna.
Baca juga: Apple Absen dari Jamuan AI Trump, Fokus Acara Jadi Sorotan
OpenAI menyebut kampanye itu berhasil dihentikan sepenuhnya pada 28 Juli. Perusahaan mengatakan para operator tidak membobol enkripsi atau basis data, maupun memperoleh akses langsung ke percakapan pengguna yang tersimpan. Menurut OpenAI, mereka memanipulasi interaksi dengan model agar penalaran yang dilindungi dapat direproduksi dan terlihat oleh peminta dalam skala terkoordinasi, sehingga melanggar ketentuan layanan.
Distilasi model dapat menggunakan keluaran satu model untuk melatih model lain. Dalam kasus adversarial yang dijelaskan OpenAI, permintaan dalam jumlah besar dirancang untuk mereproduksi penalaran dan kemampuan model yang lebih besar.
Baca juga: Google Batasi Akses Gemini 4 Argon untuk Pembela Siber Tepercaya
OpenAI mengatakan belum dapat memastikan apakah seluruh operator yang aktif selama periode tersebut terhubung dengan satu perusahaan AI pesaing. Namun, perusahaan menyebut “klaster inti” aktivitas itu berasal dari Moonshot AI. The Register melaporkan telah meminta komentar dari Moonshot AI, tetapi belum menerima tanggapan saat berita tersebut diterbitkan.
Baca juga: Google Rilis Gemini 4 Argon, Model AI untuk Coding dan Keamanan
OpenAI menyebut distilasi adversarial dapat menimbulkan risiko keselamatan dan keamanan nasional. Menurut perusahaan, penalaran yang diekstrak bisa digunakan untuk melatih model lain tanpa mempertahankan perlindungan yang diterapkan pada keluaran model asli. OpenAI juga menyatakan praktik itu dapat mempercepat perpindahan kemampuan tingkat lanjut tanpa investasi keselamatan yang sama, terutama pada model dengan kemampuan di ranah penggunaan ganda.
Sebagai respons, OpenAI mengatakan telah melarang akun yang digunakan untuk menyalin model, memperketat kontrol pendaftaran dan infrastruktur, serta memperluas pemantauan. Perusahaan juga menutup jalur yang memungkinkan seseorang memutar ulang penalaran terenkripsi milik pengguna lain untuk memulihkan isinya. OpenAI turut bekerja sama dengan penyedia layanan agar aktivitas serupa tidak sekadar berpindah ke layanan pihak ketiga, serta membagikan temuan penyelidikan kepada perusahaan AI lain melalui Frontier Model Forum dan program berbagi informasi pemerintah.
















