ByteDance a dezvăluit SeedRealtime, un model LLM nativ audio-vizual full-duplex care poate vedea, asculta și vorbi simultan, deschizând calea către conversații naturale cu AI. Descoperiți cum funcționează și ce înseamnă pentru viitor.
NVIDIA a lansat NemotronLabs VoiceChat 11B, un model open-source speech-to-speech complet duplex, cu latență de ~450 ms și apeluri live de instrumente. Acesta promite conversații naturale și acțiuni în timp real prin voce, deschizând noi posibilități în AI-ul vocal.
OpenAI a lansat GPT-Live și GPT-Live-1 mini, primele modele vocale full-duplex care delegă raționamentul profund către GPT-5.5. Acestea permit conversații naturale, fără întârzieri, și reprezintă o arhitectură inovatoare ce separă interfața vocală de gândirea profundă.
Thinking Machines Lab, startup-ul fondat de fosta CTO a OpenAI, Mira Murati, a anunțat un model AI capabil de comunicare full duplex, permițând un dialog simultan, similar unei conversații telefonice. Cu un timp de răspuns de 0,40 secunde, tehnologia promite să revoluționeze interacțiunea om-mașină, deși este încă în stadiu de cercetare.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.