Filtrează articolele

Subiect: #NVIDIA

AI Reflection AI semnează un acord de calcul de 1 miliard de dolari cu Nebius: O nouă eră în infrastructura AI

Reflection AI semnează un acord de calcul de 1 miliard de dolari cu Nebius: O nouă eră în infrastructura AI

Startup-ul american Reflection AI a semnat un acord de 1 miliard de dolari cu Nebius pentru acces la cipuri Nvidia, într-o mișcare care subliniază cursa pentru puterea de calcul în AI și creșterea interesului pentru modelele open-source.

🕒 3 săptămâni în urmă

Ghid practic pentru programarea GPU pe bază de tile-uri: de la cuTile și Triton la Flash Attention

Un ghid practic pentru programarea GPU pe bază de tile-uri folosind cuTile, Triton și Flash Attention, cu exemple de kernel-uri și verificare în PyTorch. Învață cum să optimizezi operații precum adunarea vectorială, GELU, softmax, înmulțirea matricelor și atenția eficientă.

🕒 3 săptămâni în urmă
AI SK Hynix face istorie: cea mai mare ofertă publică inițială străină din SUA, 26,5 miliarde de dolari, și presiuni pentru fabrici americane

SK Hynix face istorie: cea mai mare ofertă publică inițială străină din SUA, 26,5 miliarde de dolari, și presiuni pentru fabrici americane

SK Hynix a strâns 26,5 miliarde de dolari în cea mai mare ofertă publică inițială străină din istoria SUA, depășind recordul Alibaba. Compania sud-coreeană, furnizor cheie pentru Nvidia, este presată de administrația americană să construiască fabrici în Statele Unite, în timp ce investește masiv în Coreea de Sud.

🕒 3 săptămâni în urmă
AI Cum să reduci bugetul de tokeni fără să micșorezi echipa

Cum să reduci bugetul de tokeni fără să micșorezi echipa

Companiile cheltuie tot mai mult pe tokeni AI și concediază oameni, dar soluția reală este optimizarea bugetului de tokeni prin caching, rutare și modele mai mici, nu tăierea personalului. Articolul analizează cum Nvidia, Uber, Meta și Klarna abordează această provocare.

🕒 3 săptămâni în urmă
AI Poate inteligența artificială să răspundă la întrebarea de 3 trilioane de dolari?

Poate inteligența artificială să răspundă la întrebarea de 3 trilioane de dolari?

David Cahn, partener Sequoia, estimează că industria AI trebuie să genereze venituri de 3 trilioane de dolari pentru a justifica investițiile de 1,5 trilioane în infrastructură până în 2026. Economiștii avertizează că eșecul recuperării investițiilor ar putea declanșa o recesiune.

🕒 3 săptămâni în urmă
AI Startup-ul parizian de voce AI Gradium atrage 100 de milioane de dolari într-o rundă seed, cu sprijinul Nvidia

Startup-ul parizian de voce AI Gradium atrage 100 de milioane de dolari într-o rundă seed, cu sprijinul Nvidia

Startup-ul francez Gradium, specializat în modele de voce AI cu latență ultra-scăzută, a strâns 100 de milioane de dolari într-o rundă seed condusă de Nvidia. Fondată de fostul cercetător Google Brain Neil Zeghidour, compania plănuiește să deschidă un birou în Bay Area și a atras deja clienți precum Renault.

🕒 3 săptămâni în urmă
AI Meta își lansează propriile cipuri AI în septembrie: o mișcare strategică pentru a reduce dependența de Nvidia

Meta își lansează propriile cipuri AI în septembrie: o mișcare strategică pentru a reduce dependența de Nvidia

Meta va începe producția propriilor cipuri AI în septembrie, în colaborare cu Broadcom și TSMC, pentru a reduce dependența de Nvidia și a-și optimiza costurile. Cipurile MTIA vor fi folosite pentru antrenarea modelelor și inferență, marcând o schimbare majoră în strategia hardware a companiei.

🕒 3 săptămâni în urmă
AI Nvidia, victima propriei sale creații: piața de calcul pe care a construit-o o întoarce spatele

Nvidia, victima propriei sale creații: piața de calcul pe care a construit-o o întoarce spatele

Nvidia se confruntă cu o scădere a acțiunilor pe fondul atenuării penuriei de GPU-uri, în timp ce producătorii de memorie precum Micron beneficiază de cererea explozivă de DRAM. Analiza arată cum succesul Nvidia a creat o piață de calcul care acum îi scapă de sub control.

🕒 3 săptămâni în urmă

NVIDIA lansează Nemotron-Labs-3-Puzzle-75B-A9B: un model lingvistic hibrid MoE comprimat care oferă o performanță de server de 2,03 ori mai mare la același debit per utilizator

NVIDIA a lansat Nemotron-Labs-3-Puzzle-75B-A9B, un model lingvistic hibrid MoE comprimat, care oferă o performanță de server de 2,03 ori mai mare decât predecesorul său, la același debit per utilizator. Modelul folosește o tehnică inovatoare de compresie structurală iterativă, reducând parametrii de la 120,7B la 75,3B, și permite o concurență de 8 ori mai mare pe un singur GPU H100.

🕒 3 săptămâni în urmă

Tutorial NVIDIA Cosmos: Cum să construiești un mini-model mondial cu Mixture-of-Transformers, direct în Colab

Un tutorial practic care explică cum să construiești o versiune miniaturală a modelului mondial Cosmos 3 de la NVIDIA, folosind un Mixture-of-Transformers omnimodal, direct în Google Colab, cu accent pe înțelegerea arhitecturii și a principiilor fundamentale.

🕒 3 săptămâni în urmă
AI NVIDIA HORIZON: Agentul autonom care revoluționează Git Worktrees și atinge 100% la benchmark-ul RTL

NVIDIA HORIZON: Agentul autonom care revoluționează Git Worktrees și atinge 100% la benchmark-ul RTL

NVIDIA a dezvăluit HORIZON, un agent AI hands-free care automatizează Git worktrees și a obținut 100% la benchmark-ul RTL. Descoperiți cum funcționează și ce înseamnă pentru viitorul dezvoltării software.

🕒 1 luni în urmă
AI NVIDIA AI lansează ASPIRE: un cadru robotic auto-îmbunătățit care atinge 31% performanță zero-shot în sarcinile lungi LIBERO-Pro

NVIDIA AI lansează ASPIRE: un cadru robotic auto-îmbunătățit care atinge 31% performanță zero-shot în sarcinile lungi LIBERO-Pro

NVIDIA a lansat ASPIRE, un cadru robotic auto-îmbunătățit care atinge 31% performanță zero-shot în sarcinile lungi LIBERO-Pro. Sistemul combină învățarea prin întărire cu modele de limbaj și auto-reflecție, permițând roboților să se adapteze la sarcini noi fără antrenament suplimentar. Articolul explică funcționarea, importanța și provocările acestei inovații.

🕒 1 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.