NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.
Aplicația de călătorii Hopper a acceptat să plătească 35 de milioane de dolari pentru a soluționa un proces al FTC care o acuza de taxe ascunse și practici înșelătoare. Suma va fi folosită pentru despăgubirea consumatorilor, iar compania este obligată să dezvăluie toate costurile în mod transparent.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.