OpenAI se pregătește să integreze un watermark invizibil în anumite texte generate prin ChatGPT și Codex pentru utilizatorii din Uniunea Europeană. Măsura are rolul de a răspunde noilor cerințe instituite la nivel comunitar. Compania a anunțat că inițiativa urmărește respectarea regulilor din EU AI Act, act normativ care obligă furnizorii de modele generative să asigure identificarea conținutului într-un format ce poate fi citit automat, transmite Mediafax.
Tehnologia utilizată poartă denumirea de „textGrain” și funcționează fără să afișeze simboluri, etichete sau mesaje explicite în cadrul pasajelor. În schimb, soluția introduce un semnal statistic ascuns direct în modul în care algoritmul selectează cuvintele. Un instrument specializat de detecție analizează ulterior aceste tipare pentru a determina dacă textul conține amprenta OpenAI. Pentru clienții care folosesc interfața API la nivel global, opțiunea a devenit disponibilă din 5 octombrie și este dezactivată în mod implicit, în timp ce pentru utilizatorii eligibili din Uniunea Europeană lansarea va avea loc treptat în următoarele săptămâni.
Reprezentanții companiei avertizează însă că sistemul nu este lipsit de vulnerabilități tehnice și nu poate fi considerat o metodă certă pentru identificarea originii unui text. Precizia depinde masiv de lungimea fragmentului și de intervențiile ulterioare asupra acestuia. Conform testelor interne, la o rată-țintă de rezultate fals pozitive de 1%, detectorul a depistat marcajul în aproximativ 80% dintre textele de 200 de tokeni din anumite categorii și a urcat la circa 95% în cazul textelor de 400 de tokeni. Totuși, alterarea frazelor slăbește considerabil mecanismul. Înlocuirea a 10% dintre cuvinte cu sinonime pe pasaje de 400 de tokeni a redus rata de identificare de la aproximativ 92% la 66%, iar când un sfert din vocabular a fost schimbat, performanța a coborât până la 17%. Din această cauză, instrumentul de verificare nu va fi accesibil publicului larg, ci doar cercetătorilor și organizațiilor verificate.
OpenAI atrage atenția că prezența semnalului nu arată ponderea exactă dintre intervenția umană și generarea automată și nici nu oferă detalii despre drepturile de autor, contul sursă sau promptul utilizat. De asemenea, lipsa marcajului nu garantează că textul a fost redactat de un om, deoarece materialele pot fi traduse, scurtate sau editate. Tehnologia va continua să fie adaptată conform standardelor europene.