OpenAI pune watermark invizibil pe textele ChatGPT: AI-ul va putea fi „demascat”
OpenAI pregătește o schimbare majoră pentru ChatGPT: textele generate de inteligența artificială vor primi watermark-uri invizibile, care vor permite identificarea lor de către sisteme specializate. Măsura va fi aplicată în Uniunea Europeană, în contextul noilor reguli de transparență prevăzute de legislația europeană privind inteligența artificială.
Compania a anunțat că tehnologia va fi introdusă în următoarele săptămâni pentru utilizatorii eligibili ai ChatGPT și Codex, indiferent de tipul abonamentului, dar numai în UE. Pentru dezvoltatorii care folosesc API-ul OpenAI, funcția va putea fi activată începând din 6 octombrie pentru anumite modele, însă va fi dezactivată implicit.
Watermark-ul nu va apărea sub forma unui simbol sau a unei etichete vizibile. Acesta va fi integrat direct în text prin modificarea subtilă a alegerii cuvintelor. Marcajul ar trebui astfel să rămână prezent atunci când textul este copiat și lipit, iar un detector care deține cheia corespunzătoare îl poate identifica.
OpenAI susține că watermark-ul nu permite identificarea utilizatorului și că activarea sa nu a produs modificări semnificative în performanța modelelor.
Metoda, denumită „textGrain”, a fost prezentată într-un raport tehnic elaborat împreună cu cercetători de la Universitatea din Pennsylvania și Yale. Sistemul utilizează o cheie secretă pentru a ordona într-un anumit mod predicțiile privind următorul cuvânt. Acumularea a sute de asemenea ajustări subtile creează un model statistic care poate fi detectat ulterior.
Totuși, watermark-ul nu este imposibil de eliminat. Testele OpenAI arată că înlocuirea a aproximativ 10% dintre cuvinte cu sinonime poate reduce rata de detectare de la circa 92% la 66%. Compania avertizează că textele foarte scurte, răspunsurile la probleme de matematică și materialele traduse sunt, de asemenea, mai dificil de identificat.
OpenAI precizează că absența unui watermark nu reprezintă o dovadă că un text a fost scris de un om. Acesta poate lipsi din cauza lungimii reduse a textului, a modificărilor ample efectuate ulterior sau pentru că materialul a fost generat de un alt sistem de inteligență artificială.
Potrivit companiei, watermark-ul poate indica faptul că un sistem OpenAI a generat sau a procesat o parte dintr-un text, însă nu poate determina câtă contribuție umană a existat în redactarea, editarea sau dezvoltarea ideilor.
Decizia OpenAI vine după ce Anthropic a anunțat, în urmă cu două luni, introducerea unor watermark-uri pentru textele generate de Claude, la nivel mondial.
OpenAI a mai dezvoltat anterior o tehnologie similară, însă lansarea acesteia a fost amânată din cauza temerilor că utilizatorii ar putea migra către servicii concurente care nu folosesc astfel de marcaje.
Watermark-urile pentru conținutul generat de AI devin tot mai importante pe măsură ce Uniunea Europeană introduce noi cerințe de transparență pentru sistemele de inteligență artificială.
Comentarii ()