Filtrează articolele

AI

O treime din paginile web publicate după lansarea ChatGPT prezintă semne de autorat AI, arată un studiu

O treime din paginile web publicate după lansarea ChatGPT prezintă semne de autorat AI, arată un studiu
Internetul a devenit un loc în care tot mai multe pagini sunt scrise de roboți, iar un nou studiu arată amploarea fenomenului. Potrivit unei cercetări realizate de Pew Research Center și publicate joi, peste o treime dintre paginile web publicate după lansarea ChatGPT prezintă semne clare că au fost scrise sau editate substanțial de inteligența artificială. Este o confirmare a ceea ce mulți bănuiau deja: web-ul modern este tot mai mult un produs al algoritmilor, nu al oamenilor.

Studiul vine la scurt timp după ce Cloudflare, unul dintre cei mai mari furnizori de infrastructură pentru internet, a raportat că traficul de la boți a depășit traficul uman pe web – un prag care a fost atins mai devreme decât estimase compania. Dar datele Pew nu se concentrează pe cine sau ce navighează pe web, ci pe ceea ce este navigat. Și, aparent, o mare parte din conținut este citit de boți, dar scris tot de alți boți.

Pentru a realiza raportul, Pew a folosit arhiva web Common Crawl pentru a colecta aproape jumătate de milion de pagini web în limba engleză din ultimii cinci ani, începând cu câțiva ani înainte de lansarea ChatGPT din noiembrie 2022. Apoi, cercetătorii au folosit tehnologia Open Pangram pentru a detecta câte dintre aceste pagini au fost probabil scrise sau editate intens de AI. Într-un eșantion aleatoriu de 10.000 de pagini colectate în iulie 2026, aproximativ 10% au prezentat „semne semnificative de autorat AI”, potrivit Pew.

Cu toate acestea, Pew a subliniat că un astfel de eșantion aleatoriu ar include inevitabil pagini mai vechi – cele publicate înainte ca instrumentele de scriere AI să existe, și care, prin urmare, nu puteau fi scrise de AI. Pentru a obține o imagine mai clară asupra cât de mult din web este acum scris de AI, Pew a filtrat paginile mai vechi și s-a concentrat doar pe cele publicate după lansarea ChatGPT. În acest eșantion, semnele de autorat AI au fost găsite în peste o treime (35%) dintre pagini.

Analizând mai atent domeniile, Pew a descoperit că URL-urile cu domeniu .com prezintă semne de autorat AI într-un ritm de aproximativ 10 ori mai mare decât domeniile .edu sau .gov (ambele având în jur de 1% conținut scris de AI). În plus, domeniile .org au avut doar o rată de 4,6% de autorat AI. Aceste diferențe nu sunt surprinzătoare, având în vedere că site-urile comerciale sunt mai predispuse să folosească instrumente de generare de conținut pentru a produce articole, descrieri de produse sau bloguri, în timp ce site-urile educaționale și guvernamentale au standarde editoriale mai stricte și un control mai riguros.

Desigur, această analiză nu este perfectă. Pangram, la fel ca și alte instrumente de detectare a AI, poate clasifica greșit pagini ca fiind scrise de AI, atunci când de fapt nu sunt. Dar la scară largă, datele sunt probabil cel puțin corecte din punct de vedere direcțional. În plus, Pew a constatat că alte presupuse indicii ale autoratului AI au crescut de-a lungul anilor, cum ar fi utilizarea liniuțelor em, virgulele Oxford și fraze de tipul „nu este X, este Y”, printre altele. Aceste tipare stilistice au devenit aproape o marcă înregistrată a textelor generate de modelele de limbaj.

Ce înseamnă toate acestea pentru utilizatorii obișnuiți? În primul rând, este din ce în ce mai dificil să distingem conținutul scris de oameni de cel generat de mașini. Acest lucru ridică întrebări serioase despre încrederea pe care o putem acorda informațiilor găsite online. Dacă o treime din paginile noi sunt scrise de AI, atunci o parte semnificativă a informațiilor pe care le citim zilnic – fie că este vorba de știri, recenzii, ghiduri sau articole de blog – ar putea fi fabricată de algoritmi care nu au experiență directă, nu au verificat faptele și nu au nicio responsabilitate etică.

Pe de altă parte, există și o latură pozitivă: AI poate ajuta la generarea de conținut util, mai ales în domenii precum descrieri de produse, rezumate sau materiale de referință. Problema apare atunci când conținutul generat de AI este folosit pentru a manipula opinia publică, pentru a răspândi dezinformare sau pentru a umple web-ul cu pagini de calitate scăzută, create doar pentru a atrage trafic și bani din publicitate.

Studiul Pew vine într-un moment în care dezbaterea despre reglementarea inteligenței artificiale este tot mai aprinsă. Dacă web-ul devine un loc dominat de conținut generat de AI, atunci platformele și guvernele vor trebui să găsească modalități de a asigura transparență și autenticitate. Unele companii au început deja să implementeze filigrane sau etichete pentru conținutul generat de AI, dar aceste măsuri sunt încă departe de a fi universale.

În plus, această tendință are implicații majore pentru SEO și pentru modul în care motoarele de căutare indexează și clasifică paginile. Dacă Google și alte motoare de căutare nu reușesc să distingă între conținutul uman și cel generat de AI, riscă să ofere utilizatorilor rezultate din ce în ce mai puțin relevante și mai puțin de încredere. Deja, Google a anunțat că va penaliza conținutul generat în masă, dar este o cursă continuă între algoritmii de generare și cei de detectare.

Pe termen lung, s-ar putea să asistăm la o bifurcare a web-ului: pe de o parte, un web „curat”, format din site-uri verificate, scrise de oameni, iar pe de altă parte, un web „sălbatic”, plin de conținut generat de AI, care va fi din ce în ce mai greu de găsit și de încredere. Pentru utilizatorii obișnuiți, sfatul este să fie mai atenți la surse, să verifice informațiile și să nu se bazeze orbește pe tot ceea ce citesc online.

De ce este important:



Această cercetare este importantă pentru că ne arată amploarea reală a fenomenului de generare a conținutului cu ajutorul inteligenței artificiale. Nu mai este vorba de câteva articole izolate sau de experimente tehnologice; vorbim despre o treime din tot conținutul nou publicat pe web. Acest lucru are consecințe profunde asupra modului în care percepem informația, asupra încrederii în mass-media și asupra viitorului internetului ca spațiu de comunicare autentică.

În plus, studiul subliniază necesitatea unor instrumente mai bune de detectare a conținutului generat de AI și a unor reglementări care să oblige platformele să eticheteze clar materialele create de algoritmi. Fără aceste măsuri, riscăm să trăim într-o lume digitală în care nu mai știm cine sau ce se află în spatele cuvintelor pe care le citim. Iar asta nu este doar o problemă tehnică, ci una fundamentală pentru democrație, educație și cultură.

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.