VLOBS.COM – OpenAI menawarkan opsi watermark teks untuk pelanggan API sebagai bagian dari upaya memenuhi ketentuan AI Act Uni Eropa. Dalam beberapa minggu ke depan, perusahaan juga berencana menerapkan watermark pada keluaran teks ChatGPT dan Codex yang memenuhi syarat di Uni Eropa.
Teknik bernama textGrain menambahkan sinyal statistik yang tidak terlihat pada pilihan kata model. Detektor OpenAI kemudian mencari sinyal tersebut untuk menilai apakah suatu teks memuat watermark. Detektor itu hanya akan tersedia bagi peneliti dan organisasi yang disetujui.
Baca juga: Analitik Prediktif Beralih ke Keputusan Otonom Berbasis AI
Menurut laporan The Register, OpenAI tidak menerapkan watermark tersebut pada konten yang dibuat di luar Eropa. Namun, pelanggan API dapat memilih agar watermark digunakan pada konten yang dibuat di mana pun.
Deteksi terbatas dan mudah dilemahkan
Kinerja detektor bergantung pada panjang dan jenis teks. Dalam teks pendek sepanjang 200 kata, detektor dapat mengenali 80 persen watermark, sedangkan pada teks sepanjang 400 kata angkanya mencapai 95 persen. Hasilnya lebih rendah untuk teks fungsional, seperti materi matematika atau kode, karena penggantian kata berpotensi menimbulkan kesalahan.
Baca juga: HackerRank Rilis Chakra, AI Pewawancara yang Telah Uji 500.000 Kandidat
Pengujian pada teks sepanjang 400 token juga menunjukkan bahwa watermark dapat dilemahkan dengan mengganti kata. Penggantian 10 persen kata dengan sinonim menurunkan tingkat deteksi dari 92 persen menjadi 66 persen. Jika 25 persen kata diganti, sinyal watermark hanya terdeteksi dalam 17 persen kasus.
Baca juga: TikTok Hadirkan Asisten Belanja AI dan Checkout Sekali Klik
Makalah textGrain tidak membahas kemungkinan perubahan pilihan kata mengubah makna teks, misalnya jika fakta atau angka penting ikut berubah. The Register juga mencatat bahwa pendekatan Anthropic, yang menggunakan algoritme berbeda untuk mengganti kata tertentu, memiliki risiko serupa.
AI Act Uni Eropa mengharuskan penyedia layanan AI generatif membuat keluaran model dapat dikenali mesin. Anthropic sebelumnya mengumumkan pendekatan berbasis algoritme SynthID-Text dari Google dan menerapkannya secara global. OpenAI telah menggunakan sinyal provenance lain untuk gambar, audio, dan video yang dihasilkan AI.














