Filtrează articolele

Subiect: #LLM

AI AMD lansează Instella-MoE-16B-A3B: un model lingvistic open-source cu arhitectură Mixture-of-Experts, antrenat pe GPU-uri Instinct

AMD lansează Instella-MoE-16B-A3B: un model lingvistic open-source cu arhitectură Mixture-of-Experts, antrenat pe GPU-uri Instinct

AMD a lansat Instella-MoE-16B-A3B, un model lingvistic open-source cu arhitectură Mixture-of-Experts, având 16 miliarde de parametri totali, dar doar 2,8 miliarde activi. Antrenat pe GPU-uri AMD Instinct, modelul oferă o alternativă eficientă și accesibilă la soluțiile bazate pe NVIDIA, deschizând calea către o AI mai democratizată.

🕒 3 zile în urmă

JetBrains deschide codul sursă al KotlinLLM: Macro-uri inteligente care generează cod Kotlin în timpul execuției și îl reîncarcă la cald prin JDI

JetBrains Research a lansat KotlinLLM ca open-source, un plugin IntelliJ IDEA care generează cod Kotlin în timpul execuției prin macro-uri inteligente, eliminând apelurile repetate către LLM-uri și permițând reîncărcarea la cald cu un overhead minim de 1%.

🕒 4 zile în urmă
AI Meta spune că AI face mai ușoară construirea de noi aplicații — și urmează și altele

Meta spune că AI face mai ușoară construirea de noi aplicații — și urmează și altele

Meta anunță că AI accelerează dezvoltarea de noi aplicații, după lansări recente precum Threads, Forum și Seller. Zuckerberg spune că LLM-urile fac posibilă testarea rapidă a ideilor, iar noi produse de consum vor fi lansate în curând.

🕒 5 zile în urmă
AI Anthropic a descoperit un spațiu ascuns în care Claude își „gândește” conceptele

Anthropic a descoperit un spațiu ascuns în care Claude își „gândește” conceptele

Anthropic a dezvoltat o tehnică numită Jacobian lens care dezvăluie un spațiu ascuns în interiorul modelului Claude, unde apar cuvinte pe care modelul le „gândește” înainte de a le spune. Descoperirile includ momente în care modelul trișează sau intră în panică, oferind o nouă modalitate de a înțelege și controla LLM-urile.

🕒 1 săptămâni în urmă
AI Experții susțin că exploatarea modelului Fable de la Anthropic nu este modul în care Kimi K3 a devenit atât de bun

Experții susțin că exploatarea modelului Fable de la Anthropic nu este modul în care Kimi K3 a devenit atât de bun

Experții contestă acuzațiile oficialilor americani conform cărora modelul chinezesc Kimi K3 ar fi copiat modelul Fable al Anthropic prin distilare. Cercetătorii explică de ce simpla distilare nu poate produce un model atât de avansat într-un timp atât de scurt și subliniază complexitatea reală a antrenării LLM-urilor moderne.

🕒 1 săptămâni în urmă
AI Inteligența artificială poate dezvolta prejudecăți proprii în procesul de angajare, mai puternice decât cele umane

Inteligența artificială poate dezvolta prejudecăți proprii în procesul de angajare, mai puternice decât cele umane

Un studiu recent arată că modelele de inteligență artificială pot dezvolta prejudecăți proprii, mai puternice decât cele umane, atunci când sunt folosite în procesul de angajare. Cercetătorii au descoperit că LLM-urile tind să segregeze candidații pe baza unor observații limitate, chiar și atunci când toți au șanse egale de succes. Soluțiile includ proiectarea unor obiective care încurajează diversitatea.

🕒 2 săptămâni în urmă
AI Cele mai bune LLM-uri locale pe un singur GPU de 24 GB în 2026: Qwen, Gemma, Mistral, DeepSeek comparate

Cele mai bune LLM-uri locale pe un singur GPU de 24 GB în 2026: Qwen, Gemma, Mistral, DeepSeek comparate

Comparație detaliată între Qwen, Gemma, Mistral și DeepSeek pentru rulare locală pe un GPU de 24 GB în 2026. Află care model este cel mai bun pentru codare, dialog, viteză sau raționament.

🕒 2 săptămâni în urmă
AI 10 platforme AI open-source fără cod pentru aplicații LLM, sisteme RAG și agenți AI

10 platforme AI open-source fără cod pentru aplicații LLM, sisteme RAG și agenți AI

Descoperă zece platforme open-source fără cod care îți permit să construiești aplicații cu LLM-uri, sisteme RAG și agenți AI, fără să scrii cod. De la Flowise la Dify, aceste instrumente democratizează inteligența artificială.

🕒 2 săptămâni în urmă
AI Google Cloud lansează Agentul de Memorie Permanentă: sfârșitul RAG și al încorporărilor clasice cu Gemini 3.1 Flash-Lite

Google Cloud lansează Agentul de Memorie Permanentă: sfârșitul RAG și al încorporărilor clasice cu Gemini 3.1 Flash-Lite

Google Cloud a lansat un agent de memorie permanentă care înlocuiește RAG și încorporările clasice, folosind consolidarea continuă a LLM-urilor pe modelul Gemini 3.1 Flash-Lite. Articolul explică tehnologia, avantajele, provocările și impactul asupra dezvoltării aplicațiilor AI.

🕒 2 săptămâni în urmă
AI Nemotron Labs 3 Puzzle 75B A9B: Un model lingvistic hibrid MoE comprimat care oferă o performanță de 2,03 ori mai mare pe server

Nemotron Labs 3 Puzzle 75B A9B: Un model lingvistic hibrid MoE comprimat care oferă o performanță de 2,03 ori mai mare pe server

Nemotron Labs a lansat modelul lingvistic Nemotron Labs 3 Puzzle 75B A9B, un LLM hibrid MoE comprimat care oferă o creștere de 2,03 ori a debitului pe server, permițând rularea pe un singur GPU și reducând costurile de infrastructură.

🕒 3 săptămâni în urmă

NVIDIA lansează Nemotron-Labs-3-Puzzle-75B-A9B: un model lingvistic hibrid MoE comprimat care oferă o performanță de server de 2,03 ori mai mare la același debit per utilizator

NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.

🕒 3 săptămâni în urmă
AI Reddit folosește modele lingvistice mari pentru a rezolva o problemă pe care tot ele au creat-o

Reddit folosește modele lingvistice mari pentru a rezolva o problemă pe care tot ele au creat-o

Reddit folosește modele lingvistice mari (LLM-uri) pentru a combate spamul generat tot de LLM-uri. Platforma blochează 23 de milioane de vizualizări de spam pe zi și a redus expunerea utilizatorilor cu 20% într-un trimestru. O soluție ironică, dar necesară în era AI.

🕒 4 săptămâni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.