OpenAI Tanam Watermark Tak Terlihat di ChatGPT untuk Uni Eropa, Detektor Internal Diakui Belum Matang
Baca dalam 60 detik
- OpenAI resmi mengaktifkan penandaan tersembunyi pada keluaran teks ChatGPT dan Codex di seluruh Uni Eropa guna memenuhi kewajiban transparansi AI Act.
- Uji internal memperlihatkan deteksi merosot tajam dari 92 persen menjadi 17 persen begitu seperempat kata diganti sinonim, menandakan teknologi ini masih rapuh.
- Akses detektor dibatasi hanya untuk peneliti terakreditasi, sementara pelanggan API di luar Eropa dapat memilih ikut serta secara sukarela.

OpenAI mulai menyematkan penanda tersembunyi pada setiap teks yang dihasilkan ChatGPT dan Codex di wilayah Uni Eropa. Langkah ini diambil untuk memenuhi kewajiban pelabelan mesin atas konten buatan AI yang diamanatkan AI Act, meskipun perusahaan mengakui teknologi tersebut belum sepenuhnya dapat diandalkan.
Alih-alih menyisipkan karakter gaib atau spasi tak terlihat, sistem bernama textGrain itu bekerja dengan menggeser pilihan kata model sehingga membentuk pola statistik tersembunyi. Detektor terpisah kemudian memindai paragraf untuk menemukan jejak pola tersebut. Pendekatan ini berbeda dari metode watermark konvensional yang mudah dihapus dengan pembersih karakter.
Namun, uji internal OpenAI sendiri mengungkap kelemahan mendasar. Pada teks sekitar 150 kata tanpa penyuntingan, detektor mampu menangkap sekitar 66 persen jawaban. Angka itu naik menjadi sekitar 92 persen ketika panjang teks mencapai 300 kata. Sayangnya, begitu teks disentuh editor, akurasi langsung ambruk: mengganti satu dari sepuluh kata dengan sinonim menurunkan deteksi ke 66 persen, sedangkan mengganti satu dari empat kata membuat deteksi merosot ke 17 persen.
Keterbatasan ini membuat OpenAI memilih jalur hati-hati. Perusahaan tidak membuka alat verifikasi ke publik, melainkan menerima lamaran dari peneliti dan organisasi ahli tertentu. Hasil positif disebut tidak mengungkap identitas pengguna, prompt, atau isi percakapan. Sebaliknya, hasil negatif juga tidak membuktikan apa pun โ teks pendek, hasil suntingan, terjemahan, atau keluaran dari model pesaing bisa lolos dari deteksi.
"Kami memperluas pendekatan provenance konten untuk mencakup teks sebagai respons terhadap persyaratan regulasi UE, sambil mengakui keterbatasan signifikan teknologi watermark teks saat ini," demikian pernyataan resmi OpenAI.
Di luar Eropa, watermark ChatGPT tetap nonaktif secara bawaan. Meski demikian, pelanggan API di seluruh dunia kini dapat mengaktifkannya secara sukarela untuk model tertentu melalui pengaturan proyek atau organisasi. Sementara itu, untuk gambar dan audio, siapa pun dapat mengunggah berkas ke alat verifikasi publik OpenAI dan memeriksa watermark SynthID.
Langkah ini menyusul dimulainya penegakan transparansi AI Act Uni Eropa pada Agustus lalu. Bagi sektor kripto dan keuangan digital, implikasinya terasa konkret: adopsi AI untuk kejahatan dilaporkan naik 40 persen secara tahunan menurut TRM Labs. Regulator semakin menuntut bukti asal-usul konten, tetapi alat yang ada belum mampu memberikan kepastian hukum.
Kesenjangan antara tuntutan regulasi dan kemampuan deteksi inilah yang diperkirakan akan membentuk cara setiap laboratorium AI besar menangani kepatuhan di masa depan. Pertanyaannya, apakah standar transparansi yang dipaksakan sebelum teknologinya matang justru menciptakan rasa aman semu โ atau menjadi pemicu inovasi deteksi yang lebih tangguh?



