Maglalagay na ng invisible na ChatGPT watermark ang OpenAI sa mga chatbot text at Codex coding output sa buong European Union. Pero ayon sa sarili nilang test, kung papalitan ang isang-kapat ng mga salita gamit ang kasingkahulugan, buwaba ang detection rate sa 17% na lang.
Kaya ginagawa ito ng OpenAI dahil sa EU AI Act, kung saan inaatasan ang mga AI na may machine-readable labels sa mga gawa nilang text. Pero inamin din ng OpenAI na hindi pa ganun ka-develop ang tech nila, kaya for now, hindi pa nila binubuksan sa publiko ang detector.
Gaano Katibay ang ChatGPT Watermark Kapag May Nag-edit?
Ayon sa announcement, itong system na tinawag na textGrain nag-a-adjust ng word choices ng model para mag-iwan ng hidden statistical pattern sa text. May sarili ring detector na nagche-check ng ganitong pattern sa bawat piraso ng text.
Sabi ng OpenAI sa kanilang FAQ, sa mismong words lang nakatago ang watermark. Walang dagdag na invisible characters, extra spaces, o kakaibang punctuation. Kaya kahit i-scrub ng mga tao ang mga hidden character, wala silang matatanggal.
Importante rin ang haba ng text. Sa OpenAI, ginagamit nila ang “tokens” o mga pira-pirasong salita na kaya i-process ng AI model. Isang token ay mga three-fourths ng isang English word.
Sa test ng OpenAI, na-detect ng detector ang mga 66% ng mga unedited na sagot na nasa 150 words. Kapag 300 words na, tumataas ito sa 92% detection rate.
Kahit magaan lang ang pag-edit, bumababa na ang lakas ng watermark. Halimbawa, sa 300-word na text, kapag isa sa bawat 10 salita ay pinalitan ng kasingkahulugan, bumabagsak na ang detection mula 92% pababa sa 66%. Kapag pinalitan ang isang salita sa bawat apat, lalong bumababa na lang ito sa 17%.
Halos hindi nagbago ang benchmark scores para sa GPT‑6 Astra ng OpenAI, na pinaka-latest na model ng company.
Bakit Hindi Binubuksan ng OpenAI ang Detector Para sa Publiko?
Sa halip na public tool, tumatanggap lang ang OpenAI ng application mula sa aprubadong researchers at expert na organizations. Sabi ng company, hindi nito ire-reveal ang any user, prompt, o conversation kahit positive ang result.
Kahit negative ang result, hindi ibig sabihin ay gawa na agad ng tao ang text. Puwedeng makalusot ang maiikli, in-edit, o translated na text, pati na output ng ibang AI tools.
“Kapag walang detected na watermark, hindi ibig sabihin na tao mismo ang gumawa ng text.”
Source: OpenAI
Iba ang proseso sa images at audio. Kahit sino puwede mag-upload ng files sa public verify tool ng OpenAI para i-check kung may SynthID watermark.
Sa labas ng Europe, naka-off pa rin ang ChatGPT watermark bilang default. Pero puwede nang i-activate ng mga API customers globally para sa ilang models gamit ang kanilang settings sa project o organization.
Nangyari ang rollout na ito kasunod ng pag-implement ng EU ng AI Act transparency enforcement nitong August. Sa crypto, malaki ang impact nito dahil ayon sa TRM Labs, tumaas ng 40% taon-taon ang paggamit ng AI sa krimen.
Sa ngayon, malaki ang epekto ng gap sa pagitan ng hinihingi ng mga regulators at ng kaya lang patunayan ng mga detector sa kung paano susunod ang mga malalaking AI lab sa mga bagong rules.









