Filtrează articolele

Subiect: #Modele de Limbaj

AI DeepSeek-V4.1-Flash: Revoluția tăcută care rescrie regulile inteligenței artificiale

DeepSeek-V4.1-Flash: Revoluția tăcută care rescrie regulile inteligenței artificiale

DeepSeek lansează V4.1-Flash, un model AI open-source cu context de 1 milion de tokeni, cache FP4 și reutilizare a atenției între straturi. O analiză a modului în care eficiența arhitecturală redefinește standardele industriei.

🕒 1 săptămâni în urmă
AI Nous Research aduce configurarea locală a modelelor AI cu un singur clic în Hermes Desktop

Nous Research aduce configurarea locală a modelelor AI cu un singur clic în Hermes Desktop

Nous Research a lansat o actualizare majoră pentru Hermes Desktop, care permite configurarea locală a modelelor AI cu un singur clic. Această funcție democratizează accesul la inteligența artificială, eliminând barierele tehnice și oferind utilizatorilor control deplin asupra datelor lor.

🕒 1 săptămâni în urmă
AI Ramp intră în cursa pentru inteligența artificială: lansează Router, propriul sistem de rutare a modelelor AI

Ramp intră în cursa pentru inteligența artificială: lansează Router, propriul sistem de rutare a modelelor AI

Ramp, platforma de gestionare a chelturilor corporative, a lansat Router, un serviciu de rutare a modelelor AI care permite companiilor să comute între diferite modele de limbaj printr-un API. Serviciul este gratuit pentru restul anului 2026 și vine cu un credit de 26 de dolari. Ramp a folosit acest router intern timp de trei ani și acum îl oferă clienților săi, integrându-se cu produsele existente de monitorizare a costurilor AI.

🕒 4 săptămâni în urmă
AI Needle 2: Modelul AI cu 45 de milioane de parametri care încape într-un fișier de 14 MB și rulează în doar 28 MB de RAM

Needle 2: Modelul AI cu 45 de milioane de parametri care încape într-un fișier de 14 MB și rulează în doar 28 MB de RAM

Needle 2 este un model open-source de AI cu doar 45 de milioane de parametri, livrat ca un fișier binar de 14 MB, care rulează sesiuni complete de tool calling în doar 28 MB de RAM. Descoperiți cum acest model compact schimbă regulile jocului în inteligența artificială edge și de ce dimensiunea nu mai este singura metrică care contează.

🕒 1 luni în urmă
Societate & Lifestyle webAI lansează TwIL-LM: Modele de logică formală de 1,7B și 3B pentru autoformalizare pe hardware local

webAI lansează TwIL-LM: Modele de logică formală de 1,7B și 3B pentru autoformalizare pe hardware local

webAI a lansat TwIL-LM, o familie de modele de limbaj de 1,7B și 3B parametri, specializate în autoformalizare, care rulează eficient pe hardware local. Aceste modele open-source transformă limbajul natural în logică formală, deschizând noi posibilități în verificarea teoremelor, educație și dezvoltare software.

🕒 1 luni în urmă
AI Profesorii de AI negociază noile realități ale cercetării academice

Profesorii de AI negociază noile realități ale cercetării academice

Cercetătorii universitari în AI se confruntă cu provocări majore: costuri prohibitive pentru GPU-uri, acces limitat la modelele de frontieră și o schimbare a centrului de greutate către companii. Programul AI2050 oferă sprijin, dar întrebările rămân: cum pot academicienii să rămână relevanți și să contribuie la inovație?

🕒 1 luni în urmă
AI Prompt Engineering vs Loop Engineering vs Graph Engineering: Ce se schimbă la fiecare nivel

Prompt Engineering vs Loop Engineering vs Graph Engineering: Ce se schimbă la fiecare nivel

Un articol care explică diferențele dintre prompt engineering, loop engineering și graph engineering, analizând ce se schimbă la fiecare nivel și cum se aplică în practică. De la arta de a pune întrebări corecte până la construirea de rețele complexe de cunoștințe, descoperiți cum evoluează ingineria AI.

🕒 1 luni în urmă
AI Ce dezvăluie și ce nu dezvăluie cea mai recentă descoperire AI a Anthropic

Ce dezvăluie și ce nu dezvăluie cea mai recentă descoperire AI a Anthropic

Anthropic a descoperit un spațiu intern ascuns în modelele sale AI, numit spațiul J, plin de cuvinte care nu apar în rezultate, dar care influențează raționamentul. Redactorul senior Will Douglas Heaven explică implicațiile și limitele acestei descoperiri.

🕒 1 luni în urmă
AI NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA a lansat Nemotron-Labs-TwoTower, un model de limbaj cu difuzie și greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B. Articolul explică arhitectura, avantajele combinării difuziei cu autoregresia, implicațiile pentru cercetare și industrie, precum și provocările rămase.

🕒 2 luni în urmă
AI In the Weights: Noul motor de căutare a vanității bazat pe inteligență artificială

In the Weights: Noul motor de căutare a vanității bazat pe inteligență artificială

In the Weights este un nou site care măsoară cât de bine te „cunosc” modelele AI, oferind un scor de vanitate bazat pe interogarea mai multor chatboți. Creat de foști angajați OpenAI, instrumentul dezvăluie cum suntem percepuți de inteligența artificială și stârnește discuții despre relevanța căutării web tradiționale.

🕒 3 luni în urmă
AI Liquid AI lansează LFM2.5-Embedding-350M și LFM2.5-ColBERT-350M: Modele bilingve rapide pentru căutare multilingvă în 11 limbi

Liquid AI lansează LFM2.5-Embedding-350M și LFM2.5-ColBERT-350M: Modele bilingve rapide pentru căutare multilingvă în 11 limbi

Liquid AI a lansat două modele open source pentru căutare multilingvă: LFM2.5-Embedding-350M (bi-encoder) și LFM2.5-ColBERT-350M (interacțiune târzie). Ambele suportă 11 limbi și oferă performanțe ridicate pentru regăsirea informațiilor, fiind accesibile dezvoltatorilor.

🕒 3 luni în urmă
AI Xiaomi MiMo și TileRT: Un model cu 1 trilion de parametri depășește 1000 de tokeni pe secundă pe GPU-uri comerciale

Xiaomi MiMo și TileRT: Un model cu 1 trilion de parametri depășește 1000 de tokeni pe secundă pe GPU-uri comerciale

Xiaomi și TileRT au dezvoltat o soluție care permite unui model AI cu 1 trilion de parametri să ruleze la peste 1000 de tokeni pe secundă pe GPU-uri comerciale, democratizând accesul la inteligența artificială avansată.

🕒 3 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.