NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.
Nvidia a raportat venituri record de 81,6 miliarde de dolari în trimestrul încheiat în aprilie, cu 75,2 miliarde din centrele de date. Compania a dezvăluit dețineri de 43 de miliarde de dolari în startup-uri, aproape dublate față de începutul anului, și a anunțat răscumpărări de acțiuni de 80 de miliarde. Creșterea încetinește la 12% în următorul trimestru, iar exporturile către China rămân incerte.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.