DeepSeek lansează V4.1-Flash, un model AI open-source cu context de 1 milion de tokeni, cache FP4 și reutilizare a atenției între straturi. O analiză a modului în care eficiența arhitecturală redefinește standardele industriei.
Nous Research a lansat o actualizare majoră pentru Hermes Desktop, care permite configurarea locală a modelelor AI cu un singur clic. Această funcție democratizează accesul la inteligența artificială, eliminând barierele tehnice și oferind utilizatorilor control deplin asupra datelor lor.
Ramp, platforma de gestionare a chelturilor corporative, a lansat Router, un serviciu de rutare a modelelor AI care permite companiilor să comute între diferite modele de limbaj printr-un API. Serviciul este gratuit pentru restul anului 2026 și vine cu un credit de 26 de dolari. Ramp a folosit acest router intern timp de trei ani și acum îl oferă clienților săi, integrându-se cu produsele existente de monitorizare a costurilor AI.
Needle 2 este un model open-source de AI cu doar 45 de milioane de parametri, livrat ca un fișier binar de 14 MB, care rulează sesiuni complete de tool calling în doar 28 MB de RAM. Descoperiți cum acest model compact schimbă regulile jocului în inteligența artificială edge și de ce dimensiunea nu mai este singura metrică care contează.
webAI a lansat TwIL-LM, o familie de modele de limbaj de 1,7B și 3B parametri, specializate în autoformalizare, care rulează eficient pe hardware local. Aceste modele open-source transformă limbajul natural în logică formală, deschizând noi posibilități în verificarea teoremelor, educație și dezvoltare software.
Cercetătorii universitari în AI se confruntă cu provocări majore: costuri prohibitive pentru GPU-uri, acces limitat la modelele de frontieră și o schimbare a centrului de greutate către companii. Programul AI2050 oferă sprijin, dar întrebările rămân: cum pot academicienii să rămână relevanți și să contribuie la inovație?
Un articol care explică diferențele dintre prompt engineering, loop engineering și graph engineering, analizând ce se schimbă la fiecare nivel și cum se aplică în practică. De la arta de a pune întrebări corecte până la construirea de rețele complexe de cunoștințe, descoperiți cum evoluează ingineria AI.
Anthropic a descoperit un spațiu intern ascuns în modelele sale AI, numit spațiul J, plin de cuvinte care nu apar în rezultate, dar care influențează raționamentul. Redactorul senior Will Douglas Heaven explică implicațiile și limitele acestei descoperiri.
NVIDIA a lansat Nemotron-Labs-TwoTower, un model de limbaj cu difuzie și greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B. Articolul explică arhitectura, avantajele combinării difuziei cu autoregresia, implicațiile pentru cercetare și industrie, precum și provocările rămase.
In the Weights este un nou site care măsoară cât de bine te „cunosc” modelele AI, oferind un scor de vanitate bazat pe interogarea mai multor chatboți. Creat de foști angajați OpenAI, instrumentul dezvăluie cum suntem percepuți de inteligența artificială și stârnește discuții despre relevanța căutării web tradiționale.
Liquid AI a lansat două modele open source pentru căutare multilingvă: LFM2.5-Embedding-350M (bi-encoder) și LFM2.5-ColBERT-350M (interacțiune târzie). Ambele suportă 11 limbi și oferă performanțe ridicate pentru regăsirea informațiilor, fiind accesibile dezvoltatorilor.
Xiaomi și TileRT au dezvoltat o soluție care permite unui model AI cu 1 trilion de parametri să ruleze la peste 1000 de tokeni pe secundă pe GPU-uri comerciale, democratizând accesul la inteligența artificială avansată.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.