Filtrează articolele

Subiect: #Modele de Limbaj

AI Prompt Engineering vs Loop Engineering vs Graph Engineering: Ce se schimbă la fiecare nivel

Prompt Engineering vs Loop Engineering vs Graph Engineering: Ce se schimbă la fiecare nivel

Un articol care explică diferențele dintre prompt engineering, loop engineering și graph engineering, analizând ce se schimbă la fiecare nivel și cum se aplică în practică. De la arta de a pune întrebări corecte până la construirea de rețele complexe de cunoștințe, descoperiți cum evoluează ingineria AI.

🕒 5 zile în urmă
AI Ce dezvăluie și ce nu dezvăluie cea mai recentă descoperire AI a Anthropic

Ce dezvăluie și ce nu dezvăluie cea mai recentă descoperire AI a Anthropic

Anthropic a descoperit un spațiu intern ascuns în modelele sale AI, numit spațiul J, plin de cuvinte care nu apar în rezultate, dar care influențează raționamentul. Redactorul senior Will Douglas Heaven explică implicațiile și limitele acestei descoperiri.

🕒 1 săptămâni în urmă
AI NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA a lansat Nemotron-Labs-TwoTower, un model de limbaj cu difuzie și greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B. Articolul explică arhitectura, avantajele combinării difuziei cu autoregresia, implicațiile pentru cercetare și industrie, precum și provocările rămase.

🕒 1 luni în urmă
AI In the Weights: Noul motor de căutare a vanității bazat pe inteligență artificială

In the Weights: Noul motor de căutare a vanității bazat pe inteligență artificială

In the Weights este un nou site care măsoară cât de bine te „cunosc” modelele AI, oferind un scor de vanitate bazat pe interogarea mai multor chatboți. Creat de foști angajați OpenAI, instrumentul dezvăluie cum suntem percepuți de inteligența artificială și stârnește discuții despre relevanța căutării web tradiționale.

🕒 1 luni în urmă
AI Liquid AI lansează LFM2.5-Embedding-350M și LFM2.5-ColBERT-350M: Modele bilingve rapide pentru căutare multilingvă în 11 limbi

Liquid AI lansează LFM2.5-Embedding-350M și LFM2.5-ColBERT-350M: Modele bilingve rapide pentru căutare multilingvă în 11 limbi

Liquid AI a lansat două modele open source pentru căutare multilingvă: LFM2.5-Embedding-350M (bi-encoder) și LFM2.5-ColBERT-350M (interacțiune târzie). Ambele suportă 11 limbi și oferă performanțe ridicate pentru regăsirea informațiilor, fiind accesibile dezvoltatorilor.

🕒 1 luni în urmă
AI Xiaomi MiMo și TileRT: Un model cu 1 trilion de parametri depășește 1000 de tokeni pe secundă pe GPU-uri comerciale

Xiaomi MiMo și TileRT: Un model cu 1 trilion de parametri depășește 1000 de tokeni pe secundă pe GPU-uri comerciale

Xiaomi și TileRT au dezvoltat o soluție care permite unui model AI cu 1 trilion de parametri să ruleze la peste 1000 de tokeni pe secundă pe GPU-uri comerciale, democratizând accesul la inteligența artificială avansată.

🕒 1 luni în urmă
AI ZeroDrift strânge 10 milioane de dolari pentru a proteja modelele de inteligență artificială de propriile greșeli

ZeroDrift strânge 10 milioane de dolari pentru a proteja modelele de inteligență artificială de propriile greșeli

ZeroDrift, o startup specializată în conformitatea modelelor de inteligență artificială, a obținut o finanțare seed de 10 milioane de dolari de la investitori importanți precum a16z Speedrun. Compania folosește o abordare hibridă, combinând programe deterministe cu modele de limbaj, pentru a corecta mesajele problematice generate de AI, promițând latență scăzută și fiabilitate ridicată.

🕒 2 luni în urmă
AI Qwen3.7-Plus: Alibaba lansează un nou model revoluționar cu viziune, raționament profund și autonomie pe platforma Bailian

Qwen3.7-Plus: Alibaba lansează un nou model revoluționar cu viziune, raționament profund și autonomie pe platforma Bailian

Alibaba a lansat Qwen3.7-Plus pe platforma Bailian, un model multimodal care combină viziune computațională, raționament profund, invocare de unelte externe și capacitate de iterație autonomă. Lansarea accelerează competiția globală în AI și oferă dezvoltatorilor europeni o alternativă serioasă la modelele occidentale, cu implicații directe pentru companiile care construiesc aplicații agentice complexe.

🕒 2 luni în urmă
AI NVIDIA revoluționează distilarea cunoștințelor: X-Token, noul standard care depășește GOLD cu +3.82 puncte pe Llama-3.2-1B

NVIDIA revoluționează distilarea cunoștințelor: X-Token, noul standard care depășește GOLD cu +3.82 puncte pe Llama-3.2-1B

NVIDIA lansează X-Token, o tehnică avansată de distilare a cunoștințelor care depășește metoda GOLD cu +3.82 puncte pe modelul Llama-3.2-1B. Articolul explică mecanismul de proiecție ghidată și cross-tokenizer, rezultatele obținute și impactul asupra dezvoltării modelelor AI compacte și eficiente.

🕒 2 luni în urmă
AI OpenRouter își dublează evaluarea la 1,3 miliarde de dolari într-un singur an

OpenRouter își dublează evaluarea la 1,3 miliarde de dolari într-un singur an

OpenRouter, un startup care oferă un gateway unificat pentru modele AI, a strâns 113 milioane de dolari într-o rundă Seria B, ajungând la o evaluare de 1,3 miliarde de dolari. Creșterea reflectă adoptarea tot mai mare a unei abordări multi-model în industrie.

🕒 2 luni în urmă
AI Thinking Machines vrea să construiască un AI care ascultă în timp ce vorbește

Thinking Machines vrea să construiască un AI care ascultă în timp ce vorbește

Thinking Machines Lab, startup-ul fondat de fosta CTO a OpenAI, Mira Murati, a anunțat un model AI capabil de comunicare full duplex, permițând un dialog simultan, similar unei conversații telefonice. Cu un timp de răspuns de 0,40 secunde, tehnologia promite să revoluționeze interacțiunea om-mașină, deși este încă în stadiu de cercetare.

🕒 2 luni în urmă
AI Tehnici de Distilare a Modelelor de Limbaj: Cum să Obții Performanță cu Resurse Reduse

Tehnici de Distilare a Modelelor de Limbaj: Cum să Obții Performanță cu Resurse Reduse

Distilarea modelelor de limbaj (LLM distillation) este tehnica prin care un model mare „profesor” transferă cunoștințele unui model mic „elev”, reducând costurile și resursele necesare, păstrând în același timp o mare parte din performanță. Articolul explică principalele tehnici (logit-based, feature-based, generare de date sintetice, multi-profesor), beneficiile, provocările și exemple notabile din industrie.

🕒 2 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.