În septembrie, Synthesia m-a invitat la inaugurarea noului lor spațiu de birouri din New York. Inițial bazată în Marea Britanie, compania este astăzi unul dintre cei mai căutați jucători din arena avatarilor digitali, alături de D-ID, HeyGen sau Colossyan. Anul acesta a atins o evaluare de 4 miliarde de dolari și a anunțat că a depășit 100 de milioane de dolari în venituri recurente anuale (ARR). Oferta lor principală? O platformă care permite întreprinderilor să creeze videoclipuri de instruire interactivă cu avataruri AI, iar recent au lansat „Roleplay Sessions” — un produs care permite angajaților să exerceze, de exemplu, pitch-uri de vânzări cu un avatar AI care răspunde și evaluează performanța în timp real.
Când, la eveniment, mi-au întrebat dacă aș vrea propriul avatar AI, nu am ezitat nici o secundă. Desigur că vroiam un dublu digital. Îmi plăcea tenuea acea zi, părul era perfect aranjat. Până atunci fusem indiferent față de avataruri, considerându-le o inevitabilitate a vieții online, ceva pe care l-aud pe Instagram folosit de creatori de conținut pentru a automatiza prezența lor. Dar să fii tu subiectul experimentului schimbă perspectiva radical.
Aceasta este prima dată când Synthesia creează un avatar digital pentru un jurnalist (sau pentru oricine, de altfel, în afara lui Voica). Avatarul meu interactiv a fost antrenat exclusiv pe un articol pe care l-am scris: de ce startup-urile finanțate de venture capital comită mai multe fraude decât cele nefinanțate. Nu știe nimic altceva. Nu are opinii politice, nu îți spune vremea, nu îți scrie email-uri. Este un specialist ultra-nicșat, o extensie a memoriei mele journalistice.
Procesul de creare a fost surprinzător de fizic. Am intrat într-un mini-studio de filmare ascuns în adâncul birourilor Synthesia. Au făcut zeci de fotografii, au capturat o înregistrare vocală de două minute. Am semnat formulare de consimțământ detaliate — și aşa a născut „Domnul Digital". Echipa a creat patru variante: două avataruri „personale” (citește orice script îi dau, una cu ochelari, una fără) și două avataruri „interactive” (capabile să asculte și să răspundă, tot cu și fără ochelari).
Am ales articolul pentru antrenament, iar echipa tehnică a construit avatarul interactiv pe o stivă tehnologică complexă: modelul voice-to-text transformă vorbirea utilizatorului în text, un model lingvistic agentic (LLM) înțelege contextul și decide acțiunile, modelul text-to-voice transformă răspunsul în audio, iar în final modelul video proprietar Synthesia animează avatarul sincronizând buzele, expresiile faciale și gesturile. Interesant este că Synthesia permite clienților să aleagă modele alternative de la Cartesia, ElevenLabs, Google sau OpenAI pentru voce, iar gazduirea poate fi pe cloud-ul clientului sau gestionată de ei.
Arhitectura produselor Synthesia se împarte în trei piloni: platforma clasică de creare video (script → avatar), platforma agentică „Sessions” (interacțiune bidirecțională pentru sondaje, roleplay, onboarding) și API-ul pentru dezvoltatori care vor să integreze modelele lor în alte produse.
Mi-a luat echipei câteva zile să finalizeze avatarurile. Mai întâi am testat cele personale. Am scris un script generic: „Toamna a sosit în New York, sezonul meu preferat.” Vocea era îngrijorător de precisă. Mă bucurai că nu a preluat rauceala pe care o aveam în ziua înregistrării. Apoi am încercat pe cel interactiv. Acesta este determinist — o distincție crucială. Nu halucină, nu improvisează, nu „se pricepe” la filozofie. Răspunde strict pe baza textului pe care l-a înțeles (articolul meu). Îl poți interoga: „Care a fost metodologia studiului?” sau „Ce concluzii ai tras?” și îți va răspunde citând din articol, cu vocea mea, cu mimica mea, privindu-te în ochi.
Experiența este simultan fascinantă și dezorientantă. Există o vală de „uncanny valley” (vale neobisnuită) nu în aspect — tehnologia Synthesia este printre cele mai bune la fotorealism — ci în agency. Când avatarul tău îți răspunde cu vocea ta, cu cadenta ta, folosind cuvintele pe care tu le-ai scris, simți o derealizare a autorității. Cine este autorul acelui răspuns? Eu, care am scris articolul acum câțiva ani? Modelul LLM care a selectat paragraful relevant? Synthesia care a animat buzele? Sau „Domnul Digital" care a livrat performanța?
Implicațiile pentru jurnalism și PR sunt profunde. Astăzi, un portal de știri poate oferi un avatar al reporterului care explică investigația la cititori care nu au timp să citească 3000 de cuvinte. O companie poate pune la dispoziție avatarul CEO-ului pentru întrebări frecvente ale acționarilor, 24/7, în 50 de limbi. Dar riscurile sunt egale de mari: deepfake-urile non-consensuale, eroziunea încrederii în media vizuală, posibilitatea de a „pune în gură” cuvinte pe care nu le-ai zis niciodată, chiar dacă sistemul actual este determinist. Frontiera dintre „asistent util” și „impersonare autorizată” este subțire.
Synthesia știe asta. De aceea cer consimțământ explicit, watermark-uri invizibile, audit trails. Dar tehnologia alergă mai repede decât reglementarea. EU AI Act-ul clasifică aceste sisteme ca „risc limitat” (obligație de transparență), nu „risc inacceptabil”. În SUA, reglementarea este fragmentară, la nivel de stat.
Pentru mine, ca jurnalist tehnologic, acest experiment a fost un test de realitate. Am văzut viitorul nu ca pe o abstractie, ci ca pe un fișier video care mă privește din ecran. Avatarul meu nu mă va înlocui — nu are curiozitate, nu are instinct jurnalistic, nu poate face un interviu de investigație. Dar poate amplifica munca mea. Poate face jurnalismul mai accesibil, mai conversațional, mai uman paradoxal, printr-o mașină.
Următorul pas? Synthesia lucrează la avataruri care pot naviga pe ecran, să facă click-uri, să demonstreze software — esențial, agenți AI cu fața ta. Și aici începe capitolul următor: identitatea digitală nu mai este statică (o poză de profil, un bio), ci devine agentică. Acționează în numele tău. Negociază, explică, vinde, învață.
De ce este important:
Crearea unui avatar digital interactiv al propriului jurnalist marchează un punct de cotitură în evoluția mediaului și a identității digitale. Nu este doar un truc de PR sau o demonstrare tehnică — este o previzualizare a unui viitor în care expertiza, vocea și prezența pot fi dezaggregate, ambalate și deployate la scară. Pentru jurnalism, înseamnă noi formate de storytelling și angajare a audienței, dar și riscuri etice majore: cine controlează narativa când „tu” vorbești fără să fii prezent? Pentru întreprinderi, reprezintă scalarea cunoașterii instituționale fără scalarea headcount-ului. Pentru societate, ridică întrebări fundamentale despre autenticitate, consimțământ și natura încrederii într-o epocă în care „te văd și te aud” nu mai garantează „ești tu". Reglementarea (EU AI Act, acte legislative SUA) începe să atragă limite, dar viteza inovației — Synthesia, HeyGen, Runway, modelele open-source — depășește capacitatea legii de a reacționa. Acest articol nu este doar despre un avatar; este despre momentul în care identitatea devine software, și software-ul devine identitate.