ByteDance Seed și Tsinghua AIR au lansat CUDA Agent, un sistem de învățare prin consolidare agentic la scară largă care generează automat kernel-uri CUDA optimizate. Acesta promite să revoluționeze programarea GPU, reducând timpul de dezvoltare și îmbunătățind performanța aplicațiilor de înaltă performanță.
SpaceX a finalizat oficial achiziția Cursor, startup-ul de coding AI, pentru 60 de miliarde de dolari. Compania lui Elon Musk își consolidează astfel poziția în cursa pentru supremația în inteligența artificială, având acces la cea mai mare flotă de GPU-uri din lume. Descoperă ce înseamnă această tranzacție pentru viitorul AI și al dezvoltării software.
Meta lansează Muse Glimmer, un model AI de 30 de miliarde de parametri, sub licență Apache 2.0, care rulează agenți locali pe GPU-uri de consum. Cu performanțe competitive în benchmark-uri, modelul oferă o alternativă viabilă la soluțiile cloud, punând accent pe confidențialitate și latență redusă.
Nvidia a anunțat un plan de 500 de miliarde de dolari pentru finanțarea centrelor de date AI, garantând parțial valoarea GPU-urilor folosite ca garanție. Aceasta ar putea crea o piață secundară pentru cipuri, dar implică riscuri semnificative, comparabile cu cele din era dotcom.
Startup-ul francez Kog promite o inferență AI de 30 de ori mai rapidă pe GPU-urile standard, printr-o optimizare software profundă. Cu o demonstrație de 3.000 de tokeni pe secundă și un fondator cu background în fizică și hacking, Kog atrage deja interesul pieței, vizând în special ingineria software.
NVIDIA Transformer Engine, kernel-urile fuzionate și preciziile BF16/FP8 revoluționează antrenarea modelelor transformer, oferind accelerări de până la 4x și reducând costurile. Află cum funcționează și cum le poți folosi în propriile proiecte AI.
Învață cum să folosești LingBot-Map pentru inferență conștientă de GPU și export de nori de puncte, cu exemple practice de cod și sfaturi de optimizare.
TileLang este un limbaj și compilator specializat pentru kernel-uri GPU de înaltă performanță, care simplifică utilizarea Tensor Cores, fuzionarea operațiilor precum Softmax, implementarea FlashAttention și autotuning-ul. Acest articol explorează cum TileLang revoluționează dezvoltarea de kernel-uri pentru inteligența artificială.
Nvidia colaborează cu Lunar Outpost pentru a trimite procesoare GPU Jetson pe Lună, unde vor controla navigarea unui rover. Este prima dată când un GPU ajunge pe suprafața selenară, deschizând calea către roboți mai autonomi în explorarea spațială.
NVIDIA a lansat DeepStream 9.1, aducând inteligența artificială agentică în viziunea computerizată. Platforma include 13 abilități predefinite și urmărire 3D multi-vedere, permițând sistemelor să perceapă, să raționeze și să acționeze autonom în timp real.
General Compute, un startup de cloud AI, a obținut un împrumut de 400 de milioane de dolari de la Upper90, folosind cipuri de inferență ca garanție. Este prima tranzacție de acest gen și semnalează o schimbare majoră de la GPU-urile scumpe la soluții mai eficiente pentru rularea modelelor AI open-source.
Nvidia se confruntă cu o scădere a acțiunilor pe fondul atenuării penuriei de GPU-uri, în timp ce producătorii de memorie precum Micron beneficiază de cererea explozivă de DRAM. Analiza arată cum succesul Nvidia a creat o piață de calcul care acum îi scapă de sub control.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.