Filtrează articolele

Subiect: #LoRA

Instruirea Gemma-3 pentru raționament matematic structurat cu Tunix GRPO, adaptoare LoRA și recompense GSM8K

Un flux de lucru inovator folosește GRPO, LoRA și recompense GSM8K pentru a antrena modelul Gemma-3 să rezolve probleme de matematică cu raționament structurat, eficientizând procesul și făcându-l accesibil pe hardware modest.

🕒 4 săptămâni în urmă
AI Trajectory lansează un stack de antrenament Multi-LoRA concurent pentru învățare continuă, raportând un câștig de 2,81× în debitul experimentelor

Trajectory lansează un stack de antrenament Multi-LoRA concurent pentru învățare continuă, raportând un câștig de 2,81× în debitul experimentelor

Trajectory a lansat un stack de antrenament Multi-LoRA concurent care permite rularea simultană a mai multor experimente, raportând un câștig de 2,81× în debit. Aceasta optimizează utilizarea memoriei și a GPU-urilor, facilitând învățarea continuă fără pierderea performanței pe sarcinile anterioare.

🕒 2 luni în urmă

Presupunerea LoRA care eșuează în producție

LoRA este o tehnică populară de fine-tuning, dar în producție, presupunerea că funcționează la fel ca fine-tuning-ul complet se sparge adesea. Află care sunt capcanele și cum să le eviți.

🕒 3 luni în urmă
AI Inferență rapidă cu LoRA pentru Flux utilizând Diffusers și PEFT: Ghid complet de optimizare

Inferență rapidă cu LoRA pentru Flux utilizând Diffusers și PEFT: Ghid complet de optimizare

Un ghid tehnic detaliat despre optimizarea inferenței modelului Flux.1-Dev folosind LoRA, Diffusers și PEFT, acoperind strategii de la hotswapping fără recompilare până la rularea eficientă pe GPU-uri de consum precum RTX 4090.

🕒 4 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.