Filtrează articolele

Subiect: #Modele de Limbaj

AI ZeroDrift strânge 10 milioane de dolari pentru a proteja modelele de inteligență artificială de propriile greșeli

ZeroDrift strânge 10 milioane de dolari pentru a proteja modelele de inteligență artificială de propriile greșeli

ZeroDrift, o startup specializată în conformitatea modelelor de inteligență artificială, a obținut o finanțare seed de 10 milioane de dolari de la investitori importanți precum a16z Speedrun. Compania folosește o abordare hibridă, combinând programe deterministe cu modele de limbaj, pentru a corecta mesajele problematice generate de AI, promițând latență scăzută și fiabilitate ridicată.

🕒 3 luni în urmă
AI Qwen3.7-Plus: Alibaba lansează un nou model revoluționar cu viziune, raționament profund și autonomie pe platforma Bailian

Qwen3.7-Plus: Alibaba lansează un nou model revoluționar cu viziune, raționament profund și autonomie pe platforma Bailian

Alibaba a lansat Qwen3.7-Plus pe platforma Bailian, un model multimodal care combină viziune computațională, raționament profund, invocare de unelte externe și capacitate de iterație autonomă. Lansarea accelerează competiția globală în AI și oferă dezvoltatorilor europeni o alternativă serioasă la modelele occidentale, cu implicații directe pentru companiile care construiesc aplicații agentice complexe.

🕒 3 luni în urmă
AI NVIDIA revoluționează distilarea cunoștințelor: X-Token, noul standard care depășește GOLD cu +3.82 puncte pe Llama-3.2-1B

NVIDIA revoluționează distilarea cunoștințelor: X-Token, noul standard care depășește GOLD cu +3.82 puncte pe Llama-3.2-1B

NVIDIA lansează X-Token, o tehnică avansată de distilare a cunoștințelor care depășește metoda GOLD cu +3.82 puncte pe modelul Llama-3.2-1B. Articolul explică mecanismul de proiecție ghidată și cross-tokenizer, rezultatele obținute și impactul asupra dezvoltării modelelor AI compacte și eficiente.

🕒 3 luni în urmă
AI OpenRouter își dublează evaluarea la 1,3 miliarde de dolari într-un singur an

OpenRouter își dublează evaluarea la 1,3 miliarde de dolari într-un singur an

OpenRouter, un startup care oferă un gateway unificat pentru modele AI, a strâns 113 milioane de dolari într-o rundă Seria B, ajungând la o evaluare de 1,3 miliarde de dolari. Creșterea reflectă adoptarea tot mai mare a unei abordări multi-model în industrie.

🕒 3 luni în urmă
AI Thinking Machines vrea să construiască un AI care ascultă în timp ce vorbește

Thinking Machines vrea să construiască un AI care ascultă în timp ce vorbește

Thinking Machines Lab, startup-ul fondat de fosta CTO a OpenAI, Mira Murati, a anunțat un model AI capabil de comunicare full duplex, permițând un dialog simultan, similar unei conversații telefonice. Cu un timp de răspuns de 0,40 secunde, tehnologia promite să revoluționeze interacțiunea om-mașină, deși este încă în stadiu de cercetare.

🕒 4 luni în urmă
AI Tehnici de Distilare a Modelelor de Limbaj: Cum să Obții Performanță cu Resurse Reduse

Tehnici de Distilare a Modelelor de Limbaj: Cum să Obții Performanță cu Resurse Reduse

Distilarea modelelor de limbaj (LLM distillation) este tehnica prin care un model mare „profesor” transferă cunoștințele unui model mic „elev”, reducând costurile și resursele necesare, păstrând în același timp o mare parte din performanță. Articolul explică principalele tehnici (logit-based, feature-based, generare de date sintetice, multi-profesor), beneficiile, provocările și exemple notabile din industrie.

🕒 4 luni în urmă
AI Startup-ul Goodfire lansează Silico: un instrument de interpretabilitate mecanică pentru depanarea modelelor de limbaj

Startup-ul Goodfire lansează Silico: un instrument de interpretabilitate mecanică pentru depanarea modelelor de limbaj

Goodfire lansează Silico, un instrument de interpretabilitate mecanică care permite cercetătorilor să privească în interiorul modelelor AI și să le ajusteze parametrii, transformând construirea acestora dintr-un proces alchimic într-o inginerie de precizie.

🕒 4 luni în urmă

Presupunerea LoRA care eșuează în producție

LoRA este o tehnică populară de fine-tuning, dar în producție, presupunerea că funcționează la fel ca fine-tuning-ul complet se sparge adesea. Află care sunt capcanele și cum să le eviți.

🕒 4 luni în urmă

Anthropic Lansază Claude Opus 4.7: O Actualizare Majoră pentru Programare Agentică, Viziune de Înaltă Rezoluție și Task-uri Autonome pe Termen Lung

Anthropic a lansat Claude Opus 4.7 cu capabilități avansate de programare agentică, procesare vizuală de înaltă rezoluție și executare autonomă a task-urilor pe termen lung.

🕒 5 luni în urmă
AI Bun venit GPT OSS, noua familie de modele open-source de la OpenAI!

Bun venit GPT OSS, noua familie de modele open-source de la OpenAI!

OpenAI lansează familia de modele GPT OSS sub licență Apache 2.0, marcând un angajament major față de comunitatea open-source. Cu arhitecturi MoE eficiente de 21B și 117B parametri, optimizări precum cuantizarea mxfp4 și Flash Attention 3, modelele pot rula local pe GPU-uri consumer, democratizând accesul la AI de ultimă generație.

🕒 5 luni în urmă
AI 🇵🇭 FilBench: Pot modelele de limbaj să înțeleagă și să genereze filipineză?

🇵🇭 FilBench: Pot modelele de limbaj să înțeleagă și să genereze filipineză?

FilBench este o suită de evaluare lansată în 2025 pentru a testa capacitatea modelelor AI de a înțelege și genera limbaj în filipineză, tagalog și cebuano. Studiul relevă că deși modelele regionale rămân în urma GPT-4, ele oferă o alternativă cost-eficientă și promițătoare pentru comunitățile locale.

🕒 5 luni în urmă
AI Familia Palmyra-mini: Modele puternice, ușoare și pregătite pentru raționament complex

Familia Palmyra-mini: Modele puternice, ușoare și pregătite pentru raționament complex

Familia Palmyra-mini redefinesc standardele modelelor de limbaj ușoare, combinând eficiența computațională cu capacități avansate de raționament. Descoperă noile modele „thinking”, antrenate cu Chain of Thought, care obțin scoruri remarcabile pe benchmark-uri precum GSM8K și AMC23.

🕒 5 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.