Filtrează articolele

Subiect: #Voice AI

AI Treble, startup-ul islandez care simulează vocea, atrage 18 milioane de dolari pentru a deveni infrastructura industriei AI audio

Treble, startup-ul islandez care simulează vocea, atrage 18 milioane de dolari pentru a deveni infrastructura industriei AI audio

Treble, un startup islandez fondat de ingineri acustici, a strâns 18 milioane de dolari pentru a-și extinde platforma de simulare a sunetului și a vocii. Compania ajută dezvoltatorii de AI audio, producătorii de hardware și companiile de robotică să testeze și să îmbunătățească produsele prin simulări fizice precise, având deja clienți precum Amazon și Logitech.

🕒 2 zile în urmă

Google lansează Gemini 3.8 Live și Extended Thinking pentru agenți vocali de producție

Google a lansat Gemini 3.8 Live și Extended Thinking, cele mai avansate modele de dialog live pentru agenți vocali, cu execuție de instrumente în fundal, procesare vizuală și suport pentru 97 de limbi. Disponibile la preț competitiv, acestea promit să redefinească standardele industriei.

🕒 3 zile în urmă

Cursa împotriva timpului: De ce latenta de inferență ucide agenții vocali mult înainte de lipsa de inteligență

Un benchmark rigoros din 30 august 2026 dezvăluie că majoritatea echipelor optimizează greșit latenta agenților vocali, concentrându-se pe Time to First Token (TTFT) în detrimentul latentei end-to-end reale. Articolul analizează ierarhia API-urilor (integrate vs. DIY), impactul co-locării STT-LLM-TTS și de ce viteza este singurul feature care contează în voce.

🕒 2 săptămâni în urmă
AI Gradium AI revoluționează sinteza vocală: noul model TTS atinge 81% succes pe cazuri dificile în doar 216 milisecunde

Gradium AI revoluționează sinteza vocală: noul model TTS atinge 81% succes pe cazuri dificile în doar 216 milisecunde

Gradium AI lansează un nou model TTS cu o rată de succes de 81% pe cazuri dificile și o latență de doar 216 ms până la primul audio. Descoperă cum această inovație redefinește standardele sintezei vocale și ce înseamnă pentru dezvoltatori și utilizatori.

🕒 2 săptămâni în urmă
AI Ringg, startup-ul indian de voice AI, primește sprijin de la Peak XV și își extinde ambițiile dincolo de apelurile telefonice

Ringg, startup-ul indian de voice AI, primește sprijin de la Peak XV și își extinde ambițiile dincolo de apelurile telefonice

Ringg, un startup indian de voice AI, a obținut o extindere de 10 milioane de dolari de la Peak XV, totalul rundei Series A ajungând la 15,5 milioane. Compania procesează 20 de milioane de apeluri pe lună și se extinde de la apeluri simple la fluxuri complexe, precum programări medicale și onboarding KYC. Strategia sa se concentrează pe parteneriate cu GCC-uri și pe construirea unei platforme de agenți care livrează rezultate, nu doar voce.

🕒 3 săptămâni în urmă
AI S1-mini: Modelul open-source de 462 MB care transformă transcrierile brute în text curat

S1-mini: Modelul open-source de 462 MB care transformă transcrierile brute în text curat

S1-mini este un model open-source de normalizare a textului, dezvoltat de Superwhisper, care transformă transcrierile brute ASR în text curat și lizibil. Cu doar 462 MB, este eficient, rapid și poate fi rulat local, oferind o alternativă accesibilă la modelele mari de limbaj.

🕒 4 săptămâni în urmă
AI Rime atrage 24 de milioane de dolari pentru a revoluționa apelurile vocale în întreprinderi

Rime atrage 24 de milioane de dolari pentru a revoluționa apelurile vocale în întreprinderi

Startup-ul Rime, specializat în inteligență artificială vocală pentru întreprinderi, a obținut o finanțare Seria A de 24 de milioane de dolari. Compania își construiește propriile date conversaționale și modele speech-to-speech pentru a îmbunătăți apelurile clienților, având deja clienți precum Mayo Clinic și Dialpad.

🕒 2 luni în urmă
AI OpenAI lansează GPT-Realtime-2.1 și GPT-Realtime-2.1-mini pentru agenți vocali cu latență redusă în API

OpenAI lansează GPT-Realtime-2.1 și GPT-Realtime-2.1-mini pentru agenți vocali cu latență redusă în API

OpenAI a lansat GPT-Realtime-2.1 și GPT-Realtime-2.1-mini, modele optimizate pentru agenți vocali cu latență sub 200 ms, disponibile în API. Articolul analizează caracteristicile, beneficiile și impactul asupra industriei, oferind perspective pentru dezvoltatori și utilizatori.

🕒 2 luni în urmă
AI Șeful plăților din India: Inteligența artificială va fi esențială în următoarea eră a creșterii plăților digitale

Șeful plăților din India: Inteligența artificială va fi esențială în următoarea eră a creșterii plăților digitale

Dilip Asbe, CEO-ul NPCI, explică modul în care inteligența artificială va fi folosită pentru a atrage următoarele jumătate de miliard de utilizatori UPI, pentru prevenirea fraudelor, acordarea de credit și dezvoltarea interfețelor vocale, într-un interviu acordat TechCrunch la Mumbai Tech Week 2026.

🕒 2 luni în urmă
AI NVIDIA lansează Nemotron 3.5 ASR: Un model de streaming de 600M parametri, conștient de cache, care transcrie 40 de limbi și variante locale în timp real

NVIDIA lansează Nemotron 3.5 ASR: Un model de streaming de 600M parametri, conștient de cache, care transcrie 40 de limbi și variante locale în timp real

NVIDIA a lansat Nemotron 3.5 ASR, un model de recunoaștere a vorbirii cu 600 de milioane de parametri, proiectat pentru streaming în timp real și optimizat pentru cache. Suportă 40 de limbi și variante locale, inclusiv româna, și este disponibil open-source. Acest articol analizează arhitectura, performanța, comparația cu concurenții și impactul asupra industriei voice AI.

🕒 3 luni în urmă
AI Voice AI în India: o provocare uriașă pe care Wispr Flow o acceptă cu îndrăzneală

Voice AI în India: o provocare uriașă pe care Wispr Flow o acceptă cu îndrăzneală

Wispr Flow, un startup american de AI vocal, pariază pe piața dificilă din India, unde complexitatea lingvistică și obiceiurile mixte de utilizare reprezintă provocări majore. Cu suport pentru Hinglish și prețuri reduse, compania speră să transforme notițele vocale într-un strat de calcul universal, vizând atât profesioniști, cât și gospodării.

🕒 4 luni în urmă
AI Salesforce AI Research lansează VoiceAgentRAG: Un Router Dual-Agent de Memorie care Reduce Latența Recuperării RAG Vocal cu 316x

Salesforce AI Research lansează VoiceAgentRAG: Un Router Dual-Agent de Memorie care Reduce Latența Recuperării RAG Vocal cu 316x

Salesforce AI Research a dezvoltat VoiceAgentRAG, un sistem revoluționar cu router dual-agent de memorie care reduce latența recuperării informațiilor în sistemele RAG vocale de 316 ori. Tehnologia utilizează agenți inteligenți de rutare și optimizare pentru a anticipa necesitățile informaționale și a accelera accesul la date, eliminând pauzele inconfortabile din conversațiile vocale cu AI și deschizând noi posibilități pentru asistenți virtuali enterprise în timp real.

🕒 5 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.