Fondată în 2020 de inginerii acustici Finnur Pind și Jesper Pedersen, Treble și-a propus să rezolve una dintre cele mai mari probleme ale industriei AI audio: lipsa datelor reale și variate pentru antrenarea modelelor. În loc să se bazeze exclusiv pe înregistrări din lumea reală sau pe date „răzuite” de pe internet, compania folosește simulări fizice precise pentru a genera sunet. Această abordare, spun fondatorii, permite crearea unor seturi de date infinite, controlabile și realiste, care pot acoperi scenarii pe care înregistrările clasice nu le pot surprinde.
„AI-ul audio este, de fapt, o provocare legată de date. Până acum, aproape tot ce înseamnă inteligență artificială legată de sunet a fost construit pe baza unor înregistrări și a unor date adunate de pe internet. Noi credem că simularea fizică precisă poate fi o alternativă viabilă pentru a crea date pentru sunet”, a declarat Finnur Pind pentru TechCrunch.
Platforma Treble are mai multe verticale. Pentru companiile care dezvoltă modele de voce AI, oferă o platformă de generare de date sintetice, folosită pentru îmbunătățirea vorbirii, suprimarea zgomotului și antrenarea modelelor. De asemenea, compania evaluează modelele de voce AI în diferite condiții, oferind feedback laboratoarelor care dezvoltă aceste modele. La începutul acestui an, Treble a colaborat cu Hugging Face pentru a lansa un benchmark pentru modelele de recunoaștere a vorbirii, testate în diverse condiții realiste.
Dar Treble nu se oprește doar la software. Compania are și o componentă importantă de hardware. Lucrează cu producători de căști și difuzoare pentru prototipare virtuală, ajutându-i să înțeleagă cum va suna produsul lor înainte de a fi fabricat. De asemenea, poate testa cât de bine înțelege un difuzor inteligent comenzile, în funcție de poziționarea acestuia în încăpere. Recent, Treble a intrat și în zona de testare a simulărilor pentru ochelari inteligenți și dispozitive AI.
Pind este deosebit de entuziasmat de potențialul dispozitivelor purtabile care pot îmbunătăți auzul uman. „Sunt foarte încântat de următoarea generație de dispozitive, cum ar fi căștile și ochelarii inteligenți, care pot oferi un fel de auz supraomenesc. Este o zonă în care poți auzi cu adevărat mai bine în medii acustice dificile. Poate ești într-un restaurant și vrei să auzi doar persoanele aflate la mai puțin de doi metri de tine, sau ești la un seminar și vrei să-i muți pe cei din jurul tău”, a explicat el.
Compania își propune să își extindă focusul și în zona de AI fizic, incluzând robotica, industria auto și dronele, pentru a le permite acestor dispozitive să funcționeze corect din punct de vedere sonor, prin testare și simulare. Această direcție este văzută ca una strategică, având în vedere că tot mai multe produse fizice devin „inteligente” și depind de sunet pentru a interacționa cu utilizatorii.
Francois Ruether, vicepreședinte la Paladin Capital Group, a explicat de ce compania sa a decis să investească în Treble: „Teza noastră este că, pe măsură ce tot mai multe produse depind de înțelegerea sunetului, această infrastructură devine din ce în ce mai valoroasă în domenii precum vocea AI, dispozitivele purtabile, robotica și AI-ul fizic. Clienții își păstrează proprietatea asupra modelelor, produselor și fluxurilor lor de dezvoltare, beneficiind în același timp de o fundație comună, o infrastructură acustică bazată pe simulare.”
Treble are deja clienți importanți, printre care Amazon și Logitech. Aceste parteneriate validează abordarea companiei și îi oferă un avantaj competitiv într-o piață în care investitorii au turnat miliarde de dolari în AI-ul vocal. De la automatizarea serviciilor de asistență pentru clienți și a apelurilor de vânzări, până la notițe automate de întâlniri și ochelari inteligenți care folosesc vocea ca interfață principală, industria are nevoie de instrumente de testare și de feedback pentru a îmbunătăți continuu modelele și hardware-ul.
Într-o piață dominată de giganți tech și de laboratoare de cercetare cu bugete uriașe, Treble își croiește un drum prin specializare și prin înțelegerea profundă a fizicii sunetului. Cei doi fondatori, ambii ingineri acustici, au adus o perspectivă rară într-o industrie în care mulți se concentrează doar pe algoritmi și pe puterea de calcul. Ei știu că sunetul nu este doar o undă digitală, ci un fenomen fizic complex, care interacționează cu mediul înconjurător. Această înțelegere le permite să construiască simulări care surprind nuanțe pe care modelele antrenate pe date reale le ratează.
Pe măsură ce AI-ul devine tot mai prezent în viața noastră de zi cu zi, de la asistenți vocali la mașini autonome, nevoia de a testa și de a valida aceste sisteme în condiții realiste devine critică. Treble se poziționează ca un jucător esențial în acest ecosistem, oferind infrastructura necesară pentru ca modelele și dispozitivele să funcționeze corect în lumea reală. Cu noua finanțare, compania islandeză are resursele necesare pentru a-și extinde operațiunile și pentru a-și consolida poziția de lider într-un domeniu aflat în plină expansiune.
De ce este important:
Această investiție subliniază o tendință majoră în industria AI: trecerea de la modele care funcționează doar în laborator la sisteme care trebuie să performeze în medii reale, imprevizibile. Treble nu doar că oferă date sintetice pentru antrenarea modelelor, dar creează și o punte între software și hardware, între algoritmi și fizică. Într-o piață în care diferențierea se face prin calitatea experienței utilizatorului, capacitatea de a simula și testa sunetul în mod realist devine un avantaj competitiv crucial. Pe măsură ce AI-ul vocal devine omniprezent, de la căști inteligente la roboți și mașini autonome, infrastructura de simulare acustică va fi la fel de importantă ca și modelele în sine. Treble, cu această finanțare, se asigură că va fi acolo, în centrul acestei revoluții.