Filtrează articolele

Subiect: #voce AI

AI Cartesia lansează Sonic-3.6: modelul TTS streaming care domină ambele arene de vorbire de la Artificial Analysis

Cartesia lansează Sonic-3.6: modelul TTS streaming care domină ambele arene de vorbire de la Artificial Analysis

Cartesia a lansat Sonic-3.6, un model TTS streaming care a urcat pe primul loc în ambele arene de vorbire de la Artificial Analysis, combinând calitate vocală excepțională cu latență redusă. Descoperă ce înseamnă această performanță pentru industria AI și pentru utilizatori.

🕒 1 luni în urmă
AI Smallest.ai atrage 13 milioane de dolari pentru a construi o voce AI ultra-rapidă care sună cu adevărat uman

Smallest.ai atrage 13 milioane de dolari pentru a construi o voce AI ultra-rapidă care sună cu adevărat uman

Smallest.ai a strâns 13 milioane de dolari pentru a dezvolta un model vocal AI ultra-rapid, care imită conversația umană reală, vizând să spargă testul Turing în interacțiunile vocale.

🕒 1 luni în urmă
AI OpenAI lansează GPT-Live și GPT-Live-1 mini: modele vocale full-duplex care delegă raționamentul profund către GPT-5.5

OpenAI lansează GPT-Live și GPT-Live-1 mini: modele vocale full-duplex care delegă raționamentul profund către GPT-5.5

OpenAI a lansat GPT-Live și GPT-Live-1 mini, primele modele vocale full-duplex care delegă raționamentul profund către GPT-5.5. Acestea permit conversații naturale, fără întârzieri, și reprezintă o arhitectură inovatoare ce separă interfața vocală de gândirea profundă.

🕒 2 luni în urmă
AI OmniVoice Studio: Alternativa locală și open-source la ElevenLabs

OmniVoice Studio: Alternativa locală și open-source la ElevenLabs

OmniVoice Studio este o alternativă open-source și locală la ElevenLabs, care permite generarea și clonarea vocală de înaltă calitate, fără a depinde de servere externe. Articolul explorează caracteristicile, avantajele, limitările și impactul acestui proiect asupra comunității tech, inclusiv suportul pentru limba română.

🕒 3 luni în urmă
AI StepFun lansează StepAudio 2.5 Realtime: Un model vocal complet, cu RLHF specializat pe rolplay și înțelegere paralingvistică

StepFun lansează StepAudio 2.5 Realtime: Un model vocal complet, cu RLHF specializat pe rolplay și înțelegere paralingvistică

StepFun lansează StepAudio 2.5 Realtime, un model vocal end-to-end care înțelege și reproduce emoții și tonuri, special optimizat pentru rolplay prin RLHF. Descoperă cum această tehnologie poate transforma jocurile, asistenții virtuali și educația.

🕒 3 luni în urmă
AI ElevenLabs atrage investitori de top: BlackRock, Jamie Foxx și Eva Longoria se alătură rundei de finanțare de 500 de milioane de dolari

ElevenLabs atrage investitori de top: BlackRock, Jamie Foxx și Eva Longoria se alătură rundei de finanțare de 500 de milioane de dolari

ElevenLabs a anunțat o listă impresionantă de noi investitori pentru runda Seria D de 500 de milioane de dolari, incluzând BlackRock, Jamie Foxx și Eva Longoria. Compania a depășit 500 de milioane de dolari în venituri anuale recurente și a semnat contracte enterprise cu Deutsche Telekom, Revolut și Klarna.

🕒 4 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.