Perplexity AI dezvăluie pentru prima dată arhitectura completă a stivei sale de embedding GPU: Ivy (kerneli CUDA optimizați), Tulip (scheduler distribuit cu elastic batching) și ROSE (compresie vectorială ierarhică). Analizăm cum aceste trei componente reduc latenta, costurile și complexitatea la scară, și de ce această abordare "full-stack" devine noul standard pentru sistemele RAG de producție.
NVIDIA a lansat Nemotron 3 Embed, o colecție open source de modele de embedding, al cărei checkpoint de 8B parametri a ocupat primul loc în clasamentul RTEB. Articolul detaliază performanța, impactul asupra agenților AI și roboticii, și semnificația pentru comunitatea open source.
Liquid AI a lansat două modele open source pentru căutare multilingvă: LFM2.5-Embedding-350M (bi-encoder) și LFM2.5-ColBERT-350M (interacțiune târzie). Ambele suportă 11 limbi și oferă performanțe ridicate pentru regăsirea informațiilor, fiind accesibile dezvoltatorilor.
Microsoft AI a lansat familia de modele multilingve Harrier-OSS-v1, care stabilește un nou record pe benchmark-ul Multilingual MTEB v2, oferind capabilități de embedding fără precedent pentru aplicații AI globale.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.