ChatGPT va avea watermark-uri invizibile în UE: Cum vor putea fi detectate textele generate de AI

OpenAI a anunțat că va începe să introducă, în următoarele săptămâni, watermark-uri invizibile în anumite texte generate de ChatGPT și Codex pentru utilizatorii din Uniunea Europeană. Compania spune că măsura vine în contextul obligațiilor impuse de AI Act și este menită să facă mai ușor de identificat conținutul produs sau procesat de inteligența artificială.

Sistemul dezvoltat de OpenAI se numește textGrain și nu presupune adăugarea unor etichete vizibile în text. Watermark-ul este, de fapt, un semnal statistic introdus în felul în care modelul își alege cuvintele. Un detector special poate căuta ulterior acest tipar pentru a stabili dacă un fragment conține sau nu un watermark OpenAI, transmite Antena3CNN.

Compania precizează însă că tehnologia nu este infailibilă. Detectarea poate eșua, mai ales în cazul textelor scurte, foarte constrânse sau modificate ulterior de oameni.

OpenAI spune caa textGrain introduce un semnal invizibil în alegerile de cuvinte făcute de model. Detectorul caută apoi acel semnal și estimează dacă textul conține watermark-ul companiei. OpenAI susține că, în testele sale, tehnologia a egalat sau a depășit performanța altor sisteme pe care le-a evaluat, inclusiv SynthID pentru text.

Rezultatele nu sunt însă perfecte. La o rată țintă de 1% pentru rezultate fals pozitive, detectorul a identificat watermark-ul în aproximativ 80% dintre fragmentele de 200 de tokeni și în aproximativ 95% dintre cele de 400 de tokeni, în cazul unor texte precum cele din domeniul psihologiei. Performanța a fost mult mai slabă în domenii precum matematica, unde modelul are mai puține variante de formulare.

Editarea textului poate reduce și mai mult șansele de detectare. Într-un test realizat pe fragmente de 400 de tokeni, înlocuirea a 10% dintre cuvinte cu sinonime a redus rata de detectare de la aproximativ 92% la 66%. Când au fost schimbate 25% dintre cuvinte, rata a coborât la 17%.

Compania insistă că găsirea unui watermark nu poate arăta cât dintr-un text a fost scris de un om și cât a fost produs sau modificat cu ajutorul inteligenței artificiale.

Un rezultat pozitiv poate indica faptul că un sistem OpenAI a generat sau procesat o parte din text, dar nu poate măsura contribuția umană, editările sau creativitatea persoanei care a lucrat ulterior pe acel material.

Watermark-ul nu poate identifica nici utilizatorul. Potrivit OpenAI, sistemul nu asociază textul cu o anumită persoană, organizație, un cont, un prompt sau o conversație. De asemenea, nu stabilește cine deține textul, cine este responsabil pentru el și nici dacă informațiile din el sunt adevărate sau false.

Nici situația inversă nu este concludentă: faptul că detectorul nu găsește un watermark nu înseamnă automat că textul a fost scris de un om. OpenAI spune că un text generat cu instrumentele sale poate fi prea scurt, poate fi modificat sau tradus suficient de mult încât semnalul să nu mai poată fi detectat cu încredere.

În următoarele săptămâni, OpenAI spune că va activa watermark-urile pentru textele eligibile generate de ChatGPT și Codex, pe toate planurile, în Uniunea Europeană. Compania nu intenționează însă să transforme deocamdată watermark-ul într-o regulă generală la nivel mondial.

Pentru clienții API, situația va fi diferită. Aceștia pot opta, începând de acum, pentru generarea de texte cu watermark pe anumite modele, însă funcția rămâne dezactivată implicit.

În paralel, OpenAI a deschis înscrierile pentru accesul la detectorul textGrain. În prima etapă, acesta va fi disponibil doar cercetătorilor și organizațiilor de specialitate aprobate, care vor putea ajuta compania să evalueze cât de fiabil este sistemul și în ce condiții poate fi folosit responsabil.

Compania intenționează și să ofere tehnologia în regim open-source, astfel încât alți cercetători și dezvoltatori să o poată folosi și îmbunătăți. OpenAI spune că va continua să studieze inclusiv cât de bine rezistă watermark-urile atunci când textele sunt editate sau traduse și cum poate fi făcută mai clară diferența dintre simpla asistență oferită de AI și un text scris efectiv de AI.

Pentru cele mai importante știri, abonează-te la canalul nostru de TELEGRAM!

Articolul ChatGPT va avea watermark-uri invizibile în UE: Cum vor putea fi detectate textele generate de AI apare prima dată în Realitatea.md.