Cartesia a lansat Sonic-3.6, un model TTS streaming care a urcat pe primul loc în ambele arene de vorbire de la Artificial Analysis, combinând calitate vocală excepțională cu latență redusă. Descoperă ce înseamnă această performanță pentru industria AI și pentru utilizatori.
Smallest.ai a strâns 13 milioane de dolari pentru a dezvolta un model vocal AI ultra-rapid, care imită conversația umană reală, vizând să spargă testul Turing în interacțiunile vocale.
OpenAI a lansat GPT-Live și GPT-Live-1 mini, primele modele vocale full-duplex care delegă raționamentul profund către GPT-5.5. Acestea permit conversații naturale, fără întârzieri, și reprezintă o arhitectură inovatoare ce separă interfața vocală de gândirea profundă.
OmniVoice Studio este o alternativă open-source și locală la ElevenLabs, care permite generarea și clonarea vocală de înaltă calitate, fără a depinde de servere externe. Articolul explorează caracteristicile, avantajele, limitările și impactul acestui proiect asupra comunității tech, inclusiv suportul pentru limba română.
StepFun lansează StepAudio 2.5 Realtime, un model vocal end-to-end care înțelege și reproduce emoții și tonuri, special optimizat pentru rolplay prin RLHF. Descoperă cum această tehnologie poate transforma jocurile, asistenții virtuali și educația.
ElevenLabs a anunțat o listă impresionantă de noi investitori pentru runda Seria D de 500 de milioane de dolari, incluzând BlackRock, Jamie Foxx și Eva Longoria. Compania a depășit 500 de milioane de dolari în venituri anuale recurente și a semnat contracte enterprise cu Deutsche Telekom, Revolut și Klarna.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.