Perplexity dezvăluie arhitectura GPU a stivei de embedding: Cum Ivy, Tulip și ROSE alimentază pplx-embed
Perplexity AI dezvăluie pentru prima dată arhitectura completă a stivei sale de embedding GPU: Ivy (kerneli CUDA optimizați), Tulip (scheduler distribuit cu elastic batching) și ROSE (compresie vectorială ierarhică). Analizăm cum aceste trei componente reduc latenta, costurile și complexitatea la scară, și de ce această abordare "full-stack" devine noul standard pentru sistemele RAG de producție.
🕒 1 săptămâni în urmă