Filtrează articolele

Subiect: #Nemotron

AI NVIDIA lansează Nemotron 3 Embed: o colecție de embedding-uri open source care cucerește primul loc în clasamentul RTEB

NVIDIA lansează Nemotron 3 Embed: o colecție de embedding-uri open source care cucerește primul loc în clasamentul RTEB

NVIDIA a lansat Nemotron 3 Embed, o colecție open source de modele de embedding, al cărei checkpoint de 8B parametri a ocupat primul loc în clasamentul RTEB. Articolul detaliază performanța, impactul asupra agenților AI și roboticii, și semnificația pentru comunitatea open source.

🕒 2 săptămâni în urmă

NVIDIA lansează Nemotron-Labs-3-Puzzle-75B-A9B: un model lingvistic hibrid MoE comprimat care oferă o performanță de server de 2,03 ori mai mare la același debit per utilizator

NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.

🕒 3 săptămâni în urmă
AI NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA lansează Nemotron-Labs-TwoTower: un model de limbaj cu difuzie, cu greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B

NVIDIA a lansat Nemotron-Labs-TwoTower, un model de limbaj cu difuzie și greutăți deschise, construit pe baza autoregresivă înghețată Nemotron-3-Nano-30B-A3B. Articolul explică arhitectura, avantajele combinării difuziei cu autoregresia, implicațiile pentru cercetare și industrie, precum și provocările rămase.

🕒 1 luni în urmă
AI NVIDIA lansează Nemotron 3.5 ASR: Un model de streaming de 600M parametri, conștient de cache, care transcrie 40 de limbi și variante locale în timp real

NVIDIA lansează Nemotron 3.5 ASR: Un model de streaming de 600M parametri, conștient de cache, care transcrie 40 de limbi și variante locale în timp real

NVIDIA a lansat Nemotron 3.5 ASR, un model de recunoaștere a vorbirii cu 600 de milioane de parametri, proiectat pentru streaming în timp real și optimizat pentru cache. Suportă 40 de limbi și variante locale, inclusiv româna, și este disponibil open-source. Acest articol analizează arhitectura, performanța, comparația cu concurenții și impactul asupra industriei voice AI.

🕒 1 luni în urmă
AI NVIDIA AI-Q și modelele Llama Nemotron: O nouă eră pentru agenții de cercetare open-source

NVIDIA AI-Q și modelele Llama Nemotron: O nouă eră pentru agenții de cercetare open-source

NVIDIA AI-Q Blueprint, un agent de cercetare profund open-source, a atins performanțe de top pe DeepResearch Bench, demonstrând că modelele deschise pot depăși alternativele proprietare. Arhitectura combină modelele Llama 3.3 și Nemotron pentru a oferi raționament complex, transparență totală și implementare flexibilă.

🕒 4 luni în urmă
AI NVIDIA lansează un set de date masiv de raționament multilingv: 6 milioane de intrări pentru a democratiza inteligența artificială deschisă

NVIDIA lansează un set de date masiv de raționament multilingv: 6 milioane de intrări pentru a democratiza inteligența artificială deschisă

NVIDIA lansează un set de date masiv de raționament multilingv, extinzând suportul pentru AI-ul deschis. Noul model Nemotron Nano 2 9B introduce o arhitectură hibridă și un „buget de gândire” configurabil, promițând costuri de raționament cu 60% mai mici.

🕒 4 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.