ZeroDrift, o startup specializată în conformitatea modelelor de inteligență artificială, a obținut o finanțare seed de 10 milioane de dolari de la investitori importanți precum a16z Speedrun. Compania folosește o abordare hibridă, combinând programe deterministe cu modele de limbaj, pentru a corecta mesajele problematice generate de AI, promițând latență scăzută și fiabilitate ridicată.
Alibaba a lansat Qwen3.7-Plus pe platforma Bailian, un model multimodal care combină viziune computațională, raționament profund, invocare de unelte externe și capacitate de iterație autonomă. Lansarea accelerează competiția globală în AI și oferă dezvoltatorilor europeni o alternativă serioasă la modelele occidentale, cu implicații directe pentru companiile care construiesc aplicații agentice complexe.
NVIDIA lansează X-Token, o tehnică avansată de distilare a cunoștințelor care depășește metoda GOLD cu +3.82 puncte pe modelul Llama-3.2-1B. Articolul explică mecanismul de proiecție ghidată și cross-tokenizer, rezultatele obținute și impactul asupra dezvoltării modelelor AI compacte și eficiente.
OpenRouter, un startup care oferă un gateway unificat pentru modele AI, a strâns 113 milioane de dolari într-o rundă Seria B, ajungând la o evaluare de 1,3 miliarde de dolari. Creșterea reflectă adoptarea tot mai mare a unei abordări multi-model în industrie.
Thinking Machines Lab, startup-ul fondat de fosta CTO a OpenAI, Mira Murati, a anunțat un model AI capabil de comunicare full duplex, permițând un dialog simultan, similar unei conversații telefonice. Cu un timp de răspuns de 0,40 secunde, tehnologia promite să revoluționeze interacțiunea om-mașină, deși este încă în stadiu de cercetare.
Distilarea modelelor de limbaj (LLM distillation) este tehnica prin care un model mare „profesor” transferă cunoștințele unui model mic „elev”, reducând costurile și resursele necesare, păstrând în același timp o mare parte din performanță. Articolul explică principalele tehnici (logit-based, feature-based, generare de date sintetice, multi-profesor), beneficiile, provocările și exemple notabile din industrie.
Goodfire lansează Silico, un instrument de interpretabilitate mecanică care permite cercetătorilor să privească în interiorul modelelor AI și să le ajusteze parametrii, transformând construirea acestora dintr-un proces alchimic într-o inginerie de precizie.
LoRA este o tehnică populară de fine-tuning, dar în producție, presupunerea că funcționează la fel ca fine-tuning-ul complet se sparge adesea. Află care sunt capcanele și cum să le eviți.
Anthropic a lansat Claude Opus 4.7 cu capabilități avansate de programare agentică, procesare vizuală de înaltă rezoluție și executare autonomă a task-urilor pe termen lung.
OpenAI lansează familia de modele GPT OSS sub licență Apache 2.0, marcând un angajament major față de comunitatea open-source. Cu arhitecturi MoE eficiente de 21B și 117B parametri, optimizări precum cuantizarea mxfp4 și Flash Attention 3, modelele pot rula local pe GPU-uri consumer, democratizând accesul la AI de ultimă generație.
FilBench este o suită de evaluare lansată în 2025 pentru a testa capacitatea modelelor AI de a înțelege și genera limbaj în filipineză, tagalog și cebuano. Studiul relevă că deși modelele regionale rămân în urma GPT-4, ele oferă o alternativă cost-eficientă și promițătoare pentru comunitățile locale.
Familia Palmyra-mini redefinesc standardele modelelor de limbaj ușoare, combinând eficiența computațională cu capacități avansate de raționament. Descoperă noile modele „thinking”, antrenate cu Chain of Thought, care obțin scoruri remarcabile pe benchmark-uri precum GSM8K și AMC23.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.