Startup-ul american Reflection AI a semnat un acord de 1 miliard de dolari cu Nebius pentru acces la cipuri Nvidia, într-o mișcare care subliniază cursa pentru puterea de calcul în AI și creșterea interesului pentru modelele open-source.
Un ghid practic pentru programarea GPU pe bază de tile-uri folosind cuTile, Triton și Flash Attention, cu exemple de kernel-uri și verificare în PyTorch. Învață cum să optimizezi operații precum adunarea vectorială, GELU, softmax, înmulțirea matricelor și atenția eficientă.
SK Hynix a strâns 26,5 miliarde de dolari în cea mai mare ofertă publică inițială străină din istoria SUA, depășind recordul Alibaba. Compania sud-coreeană, furnizor cheie pentru Nvidia, este presată de administrația americană să construiască fabrici în Statele Unite, în timp ce investește masiv în Coreea de Sud.
Companiile cheltuie tot mai mult pe tokeni AI și concediază oameni, dar soluția reală este optimizarea bugetului de tokeni prin caching, rutare și modele mai mici, nu tăierea personalului. Articolul analizează cum Nvidia, Uber, Meta și Klarna abordează această provocare.
David Cahn, partener Sequoia, estimează că industria AI trebuie să genereze venituri de 3 trilioane de dolari pentru a justifica investițiile de 1,5 trilioane în infrastructură până în 2026. Economiștii avertizează că eșecul recuperării investițiilor ar putea declanșa o recesiune.
Startup-ul francez Gradium, specializat în modele de voce AI cu latență ultra-scăzută, a strâns 100 de milioane de dolari într-o rundă seed condusă de Nvidia. Fondată de fostul cercetător Google Brain Neil Zeghidour, compania plănuiește să deschidă un birou în Bay Area și a atras deja clienți precum Renault.
Meta va începe producția propriilor cipuri AI în septembrie, în colaborare cu Broadcom și TSMC, pentru a reduce dependența de Nvidia și a-și optimiza costurile. Cipurile MTIA vor fi folosite pentru antrenarea modelelor și inferență, marcând o schimbare majoră în strategia hardware a companiei.
Nvidia se confruntă cu o scădere a acțiunilor pe fondul atenuării penuriei de GPU-uri, în timp ce producătorii de memorie precum Micron beneficiază de cererea explozivă de DRAM. Analiza arată cum succesul Nvidia a creat o piață de calcul care acum îi scapă de sub control.
NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.
Un tutorial practic care explică cum să construiești o versiune miniaturală a modelului mondial Cosmos 3 de la NVIDIA, folosind un Mixture-of-Transformers omnimodal, direct în Google Colab, cu accent pe înțelegerea arhitecturii și a principiilor fundamentale.
NVIDIA a dezvăluit HORIZON, un agent AI hands-free care automatizează Git worktrees și a obținut 100% la benchmark-ul RTL. Descoperiți cum funcționează și ce înseamnă pentru viitorul dezvoltării software.
NVIDIA a lansat ASPIRE, un cadru robotic auto-îmbunătățit care atinge 31% performanță zero-shot în sarcinile lungi LIBERO-Pro. Sistemul combină învățarea prin întărire cu modele de limbaj și auto-reflecție, permițând roboților să se adapteze la sarcini noi fără antrenament suplimentar. Articolul explică funcționarea, importanța și provocările acestei inovații.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.