chatgpt.
Sursa foto: © Depositphotos

OpenAI introduce marcaje invizibile în textele generate de ChatGPT în UE

OpenAI va introduce în următoarele săptămâni marcaje invizibile în textele generate de ChatGPT și Codex pentru utilizatorii din Uniunea Europeană. Măsura este legată de obligațiile de transparență prevăzute de Regulamentul european privind inteligența artificială.

Tehnologia se numește textGrain și nu presupune adăugarea unor caractere ascunse, spații invizibile sau semne speciale în text. Sistemul modifică foarte subtil modul în care modelul alege cuvintele sau formulările, astfel încât în text să rămână un tipar statistic care poate fi recunoscut ulterior de un detector.

Marcajul nu va putea fi observat de cititor și va rămâne prezent atunci când textul este copiat. Un instrument separat va analiza pasajul și va încerca să stabilească dacă acesta conține semnalul introdus de sistemele OpenAI.

Compania avertizează însă că metoda nu poate identifica fără greșeală toate textele produse de inteligența artificială. Pot apărea atât situații în care un text marcat nu este recunoscut, cât și cazuri în care detectorul indică în mod eronat existența unui watermark.

Lungimea textului contează. În testele OpenAI, detectorul a identificat marcajul în aproximativ 80% dintre pasajele de 200 de tokeni, la o rată țintă de 1% pentru rezultate fals pozitive. În cazul pasajelor de 400 de tokeni, rata de identificare a ajuns la aproximativ 95% pentru anumite tipuri de conținut. Rezultatele au fost mai slabe în texte precum cele de matematică, unde există mai puțină libertate în alegerea cuvintelor.

Modificarea ulterioară a textului poate reduce considerabil șansele de identificare. Într-un test realizat pe pasaje de 400 de tokeni, înlocuirea a 10% dintre cuvinte cu sinonime a redus rata de detectare de la aproximativ 92% la 66%. Când un sfert dintre cuvinte au fost înlocuite, rata a scăzut la 17%.

Marcajele vor fi activate pentru utilizatorii eligibili ai ChatGPT și Codex din Uniunea Europeană. Clienții API din alte regiuni vor putea activa opțional watermark-ul pentru anumite modele, însă funcția nu va fi pornită implicit la nivel global.

OpenAI intenționează să publice textGrain ca tehnologie open-source. Detectorul asociat nu va fi însă disponibil public de la început, ci va putea fi folosit într-o primă etapă doar de cercetători și organizații aprobate.