Ce s-a întâmplat
OpenAI a publicat recent o documentație detaliată despre abordarea sa privind regulile de proveniență a textului impuse de Uniunea Europeană (EU AI Act). Compania a explicat modul în care integrează tehnologii de „watermarking” (marcare digitală invizibilă) în textele generate de modelele sale, precum ChatGPT și API-urile aferente. De asemenea, OpenAI a anunțat lansarea unui instrument de detecție a acestor marcaje, accesibil inițial pentru cercetători, pentru a evalua eficacitatea sistemului în scenarii reale de utilizare, cum ar fi combaterea dezinformării sau integritatea academică.
Context tehnologic
Marcarea digitală a textului (text watermarking) este o metodă subtilă de a insera semnale statistice în modul în care un model AI alege cuvintele. Spre deosebire de o imagine unde poți pune un logo, în text, „watermark-ul” constă în ajustarea probabilităților cuvintelor următoare într-o secvență, astfel încât un algoritm de detecție să poată recunoaște un model specific, invizibil ochiului uman.
Acest proces se bazează pe criptografie și statistică. Atunci când AI-ul generează un răspuns, el selectează cuvinte dintr-o listă de posibilități. Tehnologia OpenAI „marchează” anumite selecții fără a altera sensul sau calitatea textului, permițând ulterior unui software specializat să confirme dacă textul provine de la infrastructura lor.
De ce contează
Într-o eră a supra-saturării cu informații, capacitatea de a distinge între conținutul creat de om și cel generat de mașină devine critică. Această mișcare a OpenAI este un pas major spre conformarea cu EU AI Act, primul cadru legislativ cuprinzător din lume pentru inteligența artificială.
Impactul este major pentru:
1. Editori și jurnaliști: Pot verifica sursa materialelor primite.
2. Instituții de învățământ: Pot identifica mai ușor eseurile generate artificial.
3. Platforme sociale: Pot eticheta automat conținutul AI pentru a preveni campaniile de manipulare.
Impact
Pe termen scurt, ne așteptăm la o colaborare strânsă între OpenAI și comunitatea academică pentru a rafina aceste instrumente. Totuși, watermarking-ul nu este infailibil; textele pot fi modificate prin parafrazare manuală sau prin utilizarea altor modele AI pentru a „șterge” amprenta digitală. Pe termen mediu, aceste standarde de proveniență vor deveni obligatorii pentru toți marii furnizori de AI care operează în Europa, ducând la un internet mai transparent, dar și la o cursă a înarmării între tehnologiile de marcare și cele de eludare.
Ce urmează
OpenAI va extinde probabil accesul la instrumentul de detecție și către alte categorii de utilizatori, dincolo de cercetători. De asemenea, este de așteptat integrarea acestor standarde la nivel de browser sau de sistem de operare, unde conținutul AI ar putea fi marcat automat cu o etichetă de proveniență (precum standardele C2PA). Tendința este clară: responsabilitatea creatorilor de modele AI va crește, iar „anonimatul” textului generat artificial va dispărea treptat.
*