AMD a lansat Instella-MoE-16B-A3B, un model lingvistic open-source cu arhitectură Mixture-of-Experts, având 16 miliarde de parametri totali, dar doar 2,8 miliarde activi. Antrenat pe GPU-uri AMD Instinct, modelul oferă o alternativă eficientă și accesibilă la soluțiile bazate pe NVIDIA, deschizând calea către o AI mai democratizată.
Acest ghid detaliat explorează modul în care dezvoltatorii pot construi și partaja kernel-uri ROCm de înaltă performanță folosind ecosistemul Hugging Face. Focalizându-se pe exemplul kernel-ului GEMM RadeonFlow, câștigătorul premiului AMD Developer Challenge 2025, articolul explică structura proiectului, configurarea fișierelor de build și integrarea nativă în PyTorch, simplificând procesul complex de optimizare pe GPU-urile AMD.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.