Filtrează articolele

Subiect: #GPU

AI ByteDance și Tsinghua AIR lansează CUDA Agent: un sistem RL agentic la scară largă pentru generarea kernel-urilor CUDA

ByteDance și Tsinghua AIR lansează CUDA Agent: un sistem RL agentic la scară largă pentru generarea kernel-urilor CUDA

ByteDance Seed și Tsinghua AIR au lansat CUDA Agent, un sistem de învățare prin consolidare agentic la scară largă care generează automat kernel-uri CUDA optimizate. Acesta promite să revoluționeze programarea GPU, reducând timpul de dezvoltare și îmbunătățind performanța aplicațiilor de înaltă performanță.

🕒 1 luni în urmă
AI SpaceX finalizează oficial achiziția Cursor: Ce înseamnă pentru viitorul inteligenței artificiale

SpaceX finalizează oficial achiziția Cursor: Ce înseamnă pentru viitorul inteligenței artificiale

SpaceX a finalizat oficial achiziția Cursor, startup-ul de coding AI, pentru 60 de miliarde de dolari. Compania lui Elon Musk își consolidează astfel poziția în cursa pentru supremația în inteligența artificială, având acces la cea mai mare flotă de GPU-uri din lume. Descoperă ce înseamnă această tranzacție pentru viitorul AI și al dezvoltării software.

🕒 1 luni în urmă
AI Meta Muse Glimmer: Agenți AI locali pe GPU-uri de consum, cu licență Apache 2.0

Meta Muse Glimmer: Agenți AI locali pe GPU-uri de consum, cu licență Apache 2.0

Meta lansează Muse Glimmer, un model AI de 30 de miliarde de parametri, sub licență Apache 2.0, care rulează agenți locali pe GPU-uri de consum. Cu performanțe competitive în benchmark-uri, modelul oferă o alternativă viabilă la soluțiile cloud, punând accent pe confidențialitate și latență redusă.

🕒 1 luni în urmă
AI Planul de 500 de miliarde de dolari al Nvidia: riscant, dar genial, mai ales pentru GPU-urile îmbătrânite

Planul de 500 de miliarde de dolari al Nvidia: riscant, dar genial, mai ales pentru GPU-urile îmbătrânite

Nvidia a anunțat un plan de 500 de miliarde de dolari pentru finanțarea centrelor de date AI, garantând parțial valoarea GPU-urilor folosite ca garanție. Aceasta ar putea crea o piață secundară pentru cipuri, dar implică riscuri semnificative, comparabile cu cele din era dotcom.

🕒 1 luni în urmă
AI Kog: Cum să obții inferență AI de 30 de ori mai rapidă pe GPU-urile pe care le ai deja

Kog: Cum să obții inferență AI de 30 de ori mai rapidă pe GPU-urile pe care le ai deja

Startup-ul francez Kog promite o inferență AI de 30 de ori mai rapidă pe GPU-urile standard, printr-o optimizare software profundă. Cu o demonstrație de 3.000 de tokeni pe secundă și un fondator cu background în fizică și hacking, Kog atrage deja interesul pieței, vizând în special ingineria software.

🕒 1 luni în urmă
Societate & Lifestyle Accelerarea antrenării transformatoarelor cu NVIDIA Transformer Engine, kernel-uri fuzionate, BF16, FP8 și benchmark-uri GPU

Accelerarea antrenării transformatoarelor cu NVIDIA Transformer Engine, kernel-uri fuzionate, BF16, FP8 și benchmark-uri GPU

NVIDIA Transformer Engine, kernel-urile fuzionate și preciziile BF16/FP8 revoluționează antrenarea modelelor transformer, oferind accelerări de până la 4x și reducând costurile. Află cum funcționează și cum le poți folosi în propriile proiecte AI.

🕒 1 luni în urmă
AI LingBot-Map Tutorial: Inferență conștientă de GPU și Export de Nor de Puncte

LingBot-Map Tutorial: Inferență conștientă de GPU și Export de Nor de Puncte

Învață cum să folosești LingBot-Map pentru inferență conștientă de GPU și export de nori de puncte, cu exemple practice de cod și sfaturi de optimizare.

🕒 1 luni în urmă
AI Proiectarea kernel-urilor GPU de înaltă performanță cu TileLang: GEMM pe Tensor-Core, Softmax fuzionat, FlashAttention și autotuning

Proiectarea kernel-urilor GPU de înaltă performanță cu TileLang: GEMM pe Tensor-Core, Softmax fuzionat, FlashAttention și autotuning

TileLang este un limbaj și compilator specializat pentru kernel-uri GPU de înaltă performanță, care simplifică utilizarea Tensor Cores, fuzionarea operațiilor precum Softmax, implementarea FlashAttention și autotuning-ul. Acest articol explorează cum TileLang revoluționează dezvoltarea de kernel-uri pentru inteligența artificială.

🕒 1 luni în urmă
AI Nvidia trimite procesoare GPU pe Lună: Roverul Lunar Outpost va folosi cipuri Jetson pentru navigare autonomă

Nvidia trimite procesoare GPU pe Lună: Roverul Lunar Outpost va folosi cipuri Jetson pentru navigare autonomă

Nvidia colaborează cu Lunar Outpost pentru a trimite procesoare GPU Jetson pe Lună, unde vor controla navigarea unui rover. Este prima dată când un GPU ajunge pe suprafața selenară, deschizând calea către roboți mai autonomi în explorarea spațială.

🕒 2 luni în urmă
AI NVIDIA lansează DeepStream 9.1: Inteligența artificială agentică ajunge în domeniul viziunii computerizate cu 13 abilități și urmărire 3D multi-vedere

NVIDIA lansează DeepStream 9.1: Inteligența artificială agentică ajunge în domeniul viziunii computerizate cu 13 abilități și urmărire 3D multi-vedere

NVIDIA a lansat DeepStream 9.1, aducând inteligența artificială agentică în viziunea computerizată. Platforma include 13 abilități predefinite și urmărire 3D multi-vedere, permițând sistemelor să perceapă, să raționeze și să acționeze autonom în timp real.

🕒 2 luni în urmă
AI De ce primii finanțatori de GPU-uri se orientează acum către cipuri de inferență, într-o tranzacție de 400 de milioane de dolari

De ce primii finanțatori de GPU-uri se orientează acum către cipuri de inferență, într-o tranzacție de 400 de milioane de dolari

General Compute, un startup de cloud AI, a obținut un împrumut de 400 de milioane de dolari de la Upper90, folosind cipuri de inferență ca garanție. Este prima tranzacție de acest gen și semnalează o schimbare majoră de la GPU-urile scumpe la soluții mai eficiente pentru rularea modelelor AI open-source.

🕒 2 luni în urmă
AI Nvidia, victima propriei sale creații: piața de calcul pe care a construit-o o întoarce spatele

Nvidia, victima propriei sale creații: piața de calcul pe care a construit-o o întoarce spatele

Nvidia se confruntă cu o scădere a acțiunilor pe fondul atenuării penuriei de GPU-uri, în timp ce producătorii de memorie precum Micron beneficiază de cererea explozivă de DRAM. Analiza arată cum succesul Nvidia a creat o piață de calcul care acum îi scapă de sub control.

🕒 2 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.