ChatGPT Mulai Pasang Watermark Teks

OpenAI mulai menerapkan teknologi baru untuk menandai teks yang dihasilkan oleh ChatGPT. Tanda tersebut tidak terlihat oleh pembaca karena disisipkan melalui pola statistik dalam pemilihan kata yang dilakukan model.

Teknologi bernama textGrain tersebut mulai diterapkan untuk teks ChatGPT dan Codex di Uni Eropa sebagai bagian dari upaya OpenAI memenuhi aturan transparansi dalam EU AI Act.

Langkah ini menjadi perkembangan penting dalam upaya membedakan konten yang dibuat manusia dan konten yang dihasilkan kecerdasan buatan. Namun, watermark tersebut bukan tanda yang terlihat seperti logo atau tulisan khusus. Pengguna juga tidak akan menemukan karakter tersembunyi atau simbol tertentu di dalam teks.

Sebaliknya, sinyal dibuat melalui cara model memilih kata ketika menghasilkan sebuah tulisan.

Apa Itu Watermark TextGrain?

Watermark pada teks berbeda dengan watermark pada foto atau video.

Pada gambar, tanda air dapat berupa pola visual yang sengaja dibuat tidak terlihat oleh mata manusia. Sementara itu, textGrain bekerja dengan mengubah pola statistik pemilihan kata dan bagian kata atau token ketika model menghasilkan teks.

OpenAI menjelaskan bahwa pada setiap langkah penulisan, model memiliki sejumlah kemungkinan token berikutnya. Sistem textGrain menggunakan pola rahasia untuk mengatur pilihan tersebut sehingga terbentuk sinyal tertentu sepanjang teks. (openai.com)

Bagi pembaca, hasil akhirnya tetap terlihat seperti tulisan biasa.

Tidak ada karakter tambahan, spasi tersembunyi, atau tanda baca khusus yang sengaja dimasukkan ke dalam teks.

Namun, sistem pendeteksi yang memiliki kunci dan konfigurasi sesuai dapat menganalisis pola tersebut untuk mencari indikasi bahwa teks berasal dari model OpenAI.

Awalnya Berlaku di Uni Eropa

Penerapan watermark teks ini tidak langsung berlaku untuk seluruh pengguna ChatGPT di dunia.

OpenAI menyatakan bahwa ChatGPT di Uni Eropa akan mendapatkan watermark textGrain secara bertahap. Kebijakan tersebut berkaitan dengan persyaratan transparansi dalam EU AI Act yang mengharuskan konten tertentu yang dihasilkan AI dapat dikenali oleh sistem. (openai.com)

OpenAI mulai memperluas pendekatan provenans ke teks pada Oktober 2026.

Langkah tersebut melanjutkan strategi perusahaan dalam memberikan sinyal asal-usul untuk berbagai jenis konten yang dihasilkan AI.

Sebelumnya, OpenAI telah menggunakan teknologi seperti C2PA Content Credentials dan SynthID untuk jenis konten tertentu, termasuk gambar dan audio yang didukung.

Dengan textGrain, pendekatan tersebut kini diperluas ke tulisan.

Tidak Terlihat oleh Pengguna

Salah satu karakteristik utama textGrain adalah sifatnya yang tidak terlihat.

Pengguna yang menyalin tulisan dari ChatGPT tidak akan melihat adanya tanda khusus. Bahkan ketika teks ditempelkan ke aplikasi pengolah kata, sinyal tersebut tidak muncul sebagai karakter atau kode tertentu.

Hal ini berbeda dari metadata yang dapat menyimpan informasi mengenai asal sebuah file.

Watermark textGrain menjadi bagian dari pola pilihan kata dalam teks itu sendiri.

OpenAI mengatakan pendekatan tersebut dirancang agar sinyal dapat bertahan setelah beberapa perubahan ringan, termasuk proses menyalin dan menempelkan teks. Namun, perubahan besar seperti parafrase ekstensif atau penerjemahan dapat membuat sinyal semakin sulit dideteksi. (openai.com)

Karena itu, watermark bukan sistem yang menjamin sebuah teks akan selalu dapat diidentifikasi sebagai buatan AI.

Tidak Bisa Menentukan Siapa Penulisnya

Ada kesalahpahaman yang perlu diluruskan mengenai teknologi watermark AI.

Jika sebuah teks terdeteksi memiliki watermark OpenAI, hal itu tidak berarti sistem dapat mengetahui siapa orang yang menggunakan ChatGPT.

Watermark juga tidak dapat menunjukkan seberapa besar kontribusi manusia dalam proses penulisan.

Misalnya, seseorang menggunakan ChatGPT untuk membuat draf kemudian melakukan penyuntingan besar-besaran. Sistem watermark mungkin masih menemukan sinyal jika sebagian pola tetap bertahan, tetapi hasil deteksi tidak dapat digunakan untuk menentukan berapa persen tulisan dibuat AI dan berapa persen dikerjakan manusia.

OpenAI juga menegaskan bahwa watermark tidak membuktikan kepemilikan hukum, tanggung jawab hukum, maupun keakuratan informasi dalam sebuah teks. (openai.com)

Dengan kata lain, watermark lebih tepat dipahami sebagai sinyal asal-usul, bukan alat untuk menentukan identitas penulis.

Tidak Semua Teks Mudah Dideteksi

Teknologi watermark juga memiliki keterbatasan.

Teks yang sangat pendek biasanya tidak menyediakan cukup banyak informasi statistik untuk memungkinkan deteksi yang andal.

Masalah serupa dapat terjadi pada teks yang memiliki sedikit pilihan kata. Misalnya, jawaban yang sangat faktual atau teknis terkadang membuat model memiliki ruang yang lebih terbatas untuk memilih kata alternatif.

Kode komputer juga menjadi tantangan tersendiri karena struktur sintaks membuat pilihan token lebih terbatas dibandingkan bahasa alami.

OpenAI menyebut keterbatasan tersebut sebagai salah satu alasan mengapa watermark tidak dapat dianggap sebagai alat pendeteksi universal untuk semua keluaran AI. (openai.com)

Bahasa juga memengaruhi kemampuan deteksi. Tingkat keberhasilan textGrain dapat berbeda antara satu bahasa dan bahasa lainnya.

Bagaimana Jika Teks Diedit?

Pengeditan menjadi salah satu tantangan terbesar dalam sistem watermark.

Jika seseorang hanya melakukan perubahan kecil terhadap teks, sinyal watermark masih memiliki kemungkinan bertahan.

Namun, semakin besar perubahan yang dilakukan, semakin sulit sistem mendeteksi pola asli.

Parafrase secara menyeluruh, penerjemahan ke bahasa lain, atau penulisan ulang dengan struktur berbeda dapat mengurangi kekuatan sinyal.

Hal tersebut menunjukkan bahwa watermark lebih cocok sebagai salah satu lapisan pemeriksaan daripada menjadi satu-satunya cara menentukan apakah sebuah tulisan dibuat AI.

OpenAI sendiri menekankan bahwa tidak ditemukannya watermark juga tidak otomatis membuktikan bahwa sebuah teks ditulis manusia.

Seseorang dapat menggunakan model AI lain yang tidak memakai watermark, atau teks AI dapat mengalami perubahan yang membuat sinyal tidak lagi terdeteksi.

Tidak Mengganggu Kualitas ChatGPT

OpenAI mengatakan penerapan textGrain tidak memberikan dampak berarti terhadap kualitas maupun kecepatan model dalam pengujian perusahaan.

Pada evaluasi terhadap model Astra, perbedaan performa antara sistem dengan dan tanpa watermark berada dalam rentang variasi yang biasanya muncul antarproses evaluasi. OpenAI juga menyebut dampak terhadap kecepatan model sangat kecil. (openai.com)

Artinya, pengguna tidak seharusnya melihat perubahan besar dalam kualitas jawaban hanya karena watermark diterapkan.

Tujuan utama teknologi ini bukan membuat model menghasilkan tulisan berbeda secara signifikan, melainkan menciptakan sinyal statistik yang dapat diperiksa oleh sistem tertentu.

API Bisa Mengaktifkan Watermark

Penerapan textGrain juga tidak hanya berkaitan dengan pengguna ChatGPT di Uni Eropa.

OpenAI menyediakan opsi bagi pelanggan API di seluruh dunia untuk mengaktifkan watermark teks pada model yang didukung.

Fitur tersebut bersifat pilihan dan dapat diatur melalui pengaturan proyek atau organisasi. Pelanggan dapat menentukan model mana yang akan menggunakan watermark teks. (openai.com)

Pendekatan tersebut memberikan ruang bagi perusahaan atau pengembang yang ingin memasukkan sinyal provenans ke dalam alur kerja mereka sendiri.

Namun, penerapan secara global tidak berarti watermark menjadi default bagi semua pengguna API.

Era Baru Transparansi Konten AI

Langkah OpenAI memperlihatkan bahwa persoalan asal-usul konten semakin penting seiring meningkatnya penggunaan AI generatif.

Tulisan buatan AI kini digunakan dalam berbagai bidang, mulai dari pendidikan, pemasaran, media, layanan pelanggan, hingga pekerjaan profesional.

Semakin sulit membedakan konten manusia dan AI hanya berdasarkan gaya bahasa, semakin besar kebutuhan terhadap sistem provenans yang dapat memberikan bukti tambahan.

Watermark seperti textGrain menjadi salah satu pendekatan untuk menjawab persoalan tersebut.

Namun, teknologi ini bukan solusi tunggal.

OpenAI sendiri menggunakan pendekatan berlapis yang menggabungkan watermark, metadata, dan alat verifikasi. Setiap metode memiliki kelebihan dan keterbatasan masing-masing.

Ke depan, transparansi kemungkinan tidak hanya bergantung pada kemampuan mendeteksi apakah sebuah teks dibuat AI. Hal yang lebih penting adalah membangun sistem yang dapat menjelaskan asal konten, bagaimana konten dibuat, serta sejauh mana manusia terlibat di dalamnya.

Bagi pengguna ChatGPT di luar Uni Eropa, termasuk Indonesia, penerapan textGrain pada teks ChatGPT belum berarti seluruh percakapan otomatis mendapatkan watermark yang sama. Saat ini, dokumentasi resmi OpenAI menyebut watermark teks untuk ChatGPT berlaku di Uni Eropa, sementara pelanggan API global dapat memilih untuk mengaktifkannya pada model yang didukung.

Perkembangan tersebut menunjukkan satu hal: di tengah semakin canggihnya AI dalam menghasilkan tulisan, teknologi untuk melacak asal-usul konten juga mulai berkembang dengan kecepatan yang sama.