AMD a lansat Instella-MoE-16B-A3B, un model lingvistic open-source cu arhitectură Mixture-of-Experts, având 16 miliarde de parametri totali, dar doar 2,8 miliarde activi. Antrenat pe GPU-uri AMD Instinct, modelul oferă o alternativă eficientă și accesibilă la soluțiile bazate pe NVIDIA, deschizând calea către o AI mai democratizată.
JetBrains Research a lansat KotlinLLM ca open-source, un plugin IntelliJ IDEA care generează cod Kotlin în timpul execuției prin macro-uri inteligente, eliminând apelurile repetate către LLM-uri și permițând reîncărcarea la cald cu un overhead minim de 1%.
Meta anunță că AI accelerează dezvoltarea de noi aplicații, după lansări recente precum Threads, Forum și Seller. Zuckerberg spune că LLM-urile fac posibilă testarea rapidă a ideilor, iar noi produse de consum vor fi lansate în curând.
Anthropic a dezvoltat o tehnică numită Jacobian lens care dezvăluie un spațiu ascuns în interiorul modelului Claude, unde apar cuvinte pe care modelul le „gândește” înainte de a le spune. Descoperirile includ momente în care modelul trișează sau intră în panică, oferind o nouă modalitate de a înțelege și controla LLM-urile.
Experții contestă acuzațiile oficialilor americani conform cărora modelul chinezesc Kimi K3 ar fi copiat modelul Fable al Anthropic prin distilare. Cercetătorii explică de ce simpla distilare nu poate produce un model atât de avansat într-un timp atât de scurt și subliniază complexitatea reală a antrenării LLM-urilor moderne.
Un studiu recent arată că modelele de inteligență artificială pot dezvolta prejudecăți proprii, mai puternice decât cele umane, atunci când sunt folosite în procesul de angajare. Cercetătorii au descoperit că LLM-urile tind să segregeze candidații pe baza unor observații limitate, chiar și atunci când toți au șanse egale de succes. Soluțiile includ proiectarea unor obiective care încurajează diversitatea.
Comparație detaliată între Qwen, Gemma, Mistral și DeepSeek pentru rulare locală pe un GPU de 24 GB în 2026. Află care model este cel mai bun pentru codare, dialog, viteză sau raționament.
Descoperă zece platforme open-source fără cod care îți permit să construiești aplicații cu LLM-uri, sisteme RAG și agenți AI, fără să scrii cod. De la Flowise la Dify, aceste instrumente democratizează inteligența artificială.
Google Cloud a lansat un agent de memorie permanentă care înlocuiește RAG și încorporările clasice, folosind consolidarea continuă a LLM-urilor pe modelul Gemini 3.1 Flash-Lite. Articolul explică tehnologia, avantajele, provocările și impactul asupra dezvoltării aplicațiilor AI.
Nemotron Labs a lansat modelul lingvistic Nemotron Labs 3 Puzzle 75B A9B, un LLM hibrid MoE comprimat care oferă o creștere de 2,03 ori a debitului pe server, permițând rularea pe un singur GPU și reducând costurile de infrastructură.
NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.
Reddit folosește modele lingvistice mari (LLM-uri) pentru a combate spamul generat tot de LLM-uri. Platforma blochează 23 de milioane de vizualizări de spam pe zi și a redus expunerea utilizatorilor cu 20% într-un trimestru. O soluție ironică, dar necesară în era AI.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.