Filtrează articolele

Subiect: #speech-to-text

Google lansează Gemini 3.5 Transcribe: model de recunoaștere vocală cu 2,6% WER mediu în peste 85 de limbi

Google a lansat Gemini 3.5 Transcribe, un model de recunoaștere vocală cu două endpoint-uri: unul pentru streaming cu latență sub secundă și unul pentru procesare în lot, cu diarizare și timestamp-uri, la jumătate de cost. Cu 2,6% WER mediu în peste 85 de limbi și o viteză cu 70% mai mare decât Chirp 3, modelul oferă dezvoltatorilor flexibilitate și performanță fără precedent.

🕒 3 săptămâni în urmă
AI Cele mai bune aplicații de dictare AI: testate și clasate

Cele mai bune aplicații de dictare AI: testate și clasate

Am testat și clasat cele mai bune aplicații de dictare AI disponibile în 2025, de la soluții gratuite și open-source până la abonamente premium. Descoperiți care vi se potrivește cel mai bine, în funcție de nevoile de confidențialitate, viteză și buget.

🕒 4 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.