Pe Reddit, de exemplu, un utilizator a caracterizat această măsură drept o conspirație împotriva utilizatorilor nevinovați de Claude, în timp ce altul a susținut: „Singurul motiv pentru care nu ai vrea asta este să minți oamenii.” Iar Business Insider relatează că „zeci” de utilizatori de pe X au declarat că își anulează abonamentele Claude ca urmare a acestei decizii.
Postarea nouă a Anthropic începe cu o prezentare generală a conceptului de filigranare, explicând că atunci când face „alegeri cu mize mici” – cum ar fi alegerea între cuvintele „înnorat” și „gri” pentru a descrie vremea – Claude poate crea un model în răspunsurile sale care este „indetectabil pentru cititor, dar detectabil pentru oricine are o cheie care îl codifică”.
„Filigranarea nu afectează calitatea rezultatelor Claude”, a spus compania. „Pentru un cititor, un răspuns filigranat este imposibil de distins de unul nefiligranat.”
Mai exact, Anthropic a spus că va folosi abordarea SynthID-Text pe care echipa Google DeepMind a prezentat-o în 2024 și că intenționează să lanseze o API de detectare a filigranelor. De asemenea, a menționat că filigranarea este distinctă de abordările de detectare AI oferite de companii precum Pangram, care caută „indicii” în scris (cum ar fi construcția „acesta nu este [X], este [Y]”) pentru a dezvălui utilizarea AI: „Observarea acestor modele este fundamental diferită de verificarea unui filigran.”
Ar putea cineva să rescrie pur și simplu textul pentru a ascunde filigranul? Anthropic a spus că este posibil, dar „editarea ușoară probabil nu va elimina complet filigranul”, în timp ce „o rescriere completă în care fiecare cuvânt este înlocuit va face acest lucru”. „În acest din urmă caz, desigur, este discutabil dacă textul mai poate fi descris ca fiind generat de AI”, a spus compania.
În ceea ce privește dacă filigranul va fi detectabil în textul care a fost doar corectat sau editat de Claude, Anthropic a spus că depinde de „lungimea textului și cât de mult l-a editat Claude”. Dacă a fost doar ușor editat, „aproape toate cuvintele” vor fi fost scrise de autorul uman și „nu există foarte puțin (dacă există ceva) de care să se prindă filigranul”.
Codul, între timp, ar trebui să aibă mai puțin filigran decât alt text, deoarece modelul va trebui să creeze cod funcțional și nu va avea libertatea de a alege între o varietate de opțiuni la fel de valide. „Cu toate acestea, în zonele în care există o alegere arbitrară între anumite cuvinte sau termeni din cod, filigranul poate fi folosit, cum ar fi comentariile din cod”, a spus Anthropic. „Dar prin definiție, va avea un efect neglijabil asupra codului efectiv produs.”
Anthropic a mai spus că Claude nu va fi singurul chatbot AI care va genera text filigranat, deoarece „alți dezvoltatori majori de modele au semnat același Cod de practică și își vor implementa propriile filigrane”.
Reacțiile utilizatorilor sunt amestecate. Unii văd filigranarea ca pe o încălcare a confidențialității și a libertății, în timp ce alții o consideră un pas necesar pentru transparență și responsabilitate. Există, de asemenea, îngrijorări practice: cum va afecta filigranarea utilizarea Claude în medii profesionale, cum ar fi scrierea de cod sau redactarea de documente? Și ce se întâmplă cu utilizatorii care se bazează pe Claude pentru a-și corecta propriile texte – vor fi aceștia acuzați pe nedrept că au generat conținut cu AI?
Specialiștii în etica AI subliniază că filigranarea este doar o parte dintr-un ecosistem mai larg de reglementare. Actul AI al UE, care a intrat în vigoare recent, impune cerințe stricte pentru transparența conținutului generat de AI. Filigranarea este văzută ca o modalitate de a ajuta la identificarea și urmărirea conținutului sintetic, ceea ce ar putea fi crucial în lupta împotriva dezinformării și a manipulării online.
Cu toate acestea, criticii avertizează că filigranarea nu este infailibilă. O rescriere completă poate elimina filigranul, iar instrumentele de parafrazare avansate ar putea face acest lucru automat. În plus, există întrebări legate de cine are acces la cheia de detectare și cum va fi folosită aceasta. Va fi disponibilă publicului larg sau doar autorităților? Și ce se întâmplă dacă un utilizator legiuit este acuzat pe nedrept că a folosit AI pentru a genera conținut?
Anthropic a încercat să abordeze aceste îngrijorări în postarea sa, subliniind că filigranarea este „imperceptibilă” pentru cititor și că nu afectează calitatea rezultatelor. Compania a promis, de asemenea, să lanseze o API de detectare, ceea ce ar putea permite terților să verifice autenticitatea textului. Dar rămâne de văzut cum va funcționa acest lucru în practică.
În timp ce dezbaterea continuă, un lucru este clar: filigranarea conținutului AI devine o realitate. Pe măsură ce tot mai multe companii adoptă această tehnologie, utilizatorii vor trebui să se obișnuiască cu ideea că textele generate de AI pot fi identificate. Pentru unii, aceasta este o pierdere a anonimatului; pentru alții, este un pas necesar către o mai mare responsabilitate în era inteligenței artificiale.
De ce este important:
Această decizie a Anthropic marchează un moment crucial în reglementarea inteligenței artificiale. Filigranarea textului generat de AI nu este doar o tehnică tehnică, ci un instrument de responsabilitate și transparență care ar putea modela modul în care interacționăm cu conținutul digital. Într-o eră în care dezinformarea și conținutul sintetic devin din ce în ce mai sofisticate, capacitatea de a identifica originea unui text devine esențială pentru încrederea publică. În același timp, această măsură ridică întrebări importante despre confidențialitate, libertate de exprimare și echitate. Cum vor fi folosite aceste filigrane? Cine va avea acces la ele? Și cum vor fi protejați utilizatorii nevinovați? Răspunsurile la aceste întrebări vor defini viitorul reglementării AI și al relației noastre cu tehnologia.