Filtrează articolele

Subiect: #Nemotron

AI NVIDIA lansează Nemotron 3.5 Lightning: un model MoE open source cu 30B parametri și doar 3B activi, plus routerul NeMo Switchyard

NVIDIA lansează Nemotron 3.5 Lightning: un model MoE open source cu 30B parametri și doar 3B activi, plus routerul NeMo Switchyard

NVIDIA a lansat Nemotron 3.5 Lightning, un model open source cu arhitectură MoE de 30B parametri, dar doar 3B activi, alături de routerul NeMo Switchyard. Această combinație promite eficiență și accesibilitate, democratizând accesul la AI de ultimă generație.

🕒 1 luni în urmă
AI NVIDIA lansează Nemotron 3 Embed: o colecție de embedding-uri open source care cucerește primul loc în clasamentul RTEB

NVIDIA lansează Nemotron 3 Embed: o colecție de embedding-uri open source care cucerește primul loc în clasamentul RTEB

NVIDIA a lansat Nemotron 3 Embed, o colecție open source de modele de embedding, al cărei checkpoint de 8B parametri a ocupat primul loc în clasamentul RTEB. Articolul detaliază performanța, impactul asupra agenților AI și roboticii, și semnificația pentru comunitatea open source.

🕒 2 luni în urmă

NVIDIA lansează Nemotron-Labs-3-Puzzle-75B-A9B: un model lingvistic hibrid MoE comprimat care oferă o performanță de server de 2,03 ori mai mare la același debit per utilizator

NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.

🕒 2 luni în urmă
AI NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA a lansat Nemotron-Labs-TwoTower, un model de limbaj cu difuzie și greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B. Articolul explică arhitectura, avantajele combinării difuziei cu autoregresia, implicațiile pentru cercetare și industrie, precum și provocările rămase.

🕒 2 luni în urmă
AI NVIDIA lansează Nemotron 3.5 ASR: Un model de streaming de 600M parametri, conștient de cache, care transcrie 40 de limbi și variante locale în timp real

NVIDIA lansează Nemotron 3.5 ASR: Un model de streaming de 600M parametri, conștient de cache, care transcrie 40 de limbi și variante locale în timp real

NVIDIA a lansat Nemotron 3.5 ASR, un model de recunoaștere a vorbirii cu 600 de milioane de parametri, proiectat pentru streaming în timp real și optimizat pentru cache. Suportă 40 de limbi și variante locale, inclusiv româna, și este disponibil open-source. Acest articol analizează arhitectura, performanța, comparația cu concurenții și impactul asupra industriei voice AI.

🕒 3 luni în urmă
AI NVIDIA AI-Q și modelele Llama Nemotron: O nouă eră pentru agenții de cercetare open-source

NVIDIA AI-Q și modelele Llama Nemotron: O nouă eră pentru agenții de cercetare open-source

NVIDIA AI-Q Blueprint, un agent de cercetare profund open-source, a atins performanțe de top pe DeepResearch Bench, demonstrând că modelele deschise pot depăși alternativele proprietare. Arhitectura combină modelele Llama 3.3 și Nemotron pentru a oferi raționament complex, transparență totală și implementare flexibilă.

🕒 5 luni în urmă
AI NVIDIA lansează un set de date masiv de raționament multilingv: 6 milioane de intrări pentru a democratiza inteligența artificială deschisă

NVIDIA lansează un set de date masiv de raționament multilingv: 6 milioane de intrări pentru a democratiza inteligența artificială deschisă

NVIDIA lansează un set de date masiv de raționament multilingv, extinzând suportul pentru AI-ul deschis. Noul model Nemotron Nano 2 9B introduce o arhitectură hibridă și un „buget de gândire” configurabil, promițând costuri de raționament cu 60% mai mici.

🕒 5 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.