Filtrează articolele

Subiect: #LoRA

Cum să construiești un model de limbaj axat pe raționament: ghid practic pentru streaming, curatare și fine-tuning cu SupraLabs

Un ghid practic pentru construirea unui model de limbaj mic, dar specializat în raționament, folosind streaming-ul datelor SupraLabs, filtrarea calității și fine-tuning cu LoRA pe SmolLM2-135M-Instruct. Articolul analizează fiecare etapă și subliniază importanța accesibilității în AI.

🕒 1 luni în urmă
Societate & Lifestyle Analiza sentimentelor pe IMDb cu DistilBERT LoRA, TF-IDF, calibrare, interpretabilitate, testare robusteței și învățare semi-supervizată

Analiza sentimentelor pe IMDb cu DistilBERT LoRA, TF-IDF, calibrare, interpretabilitate, testare robusteței și învățare semi-supervizată

Un articol detaliat despre analiza sentimentelor pe IMDb folosind DistilBERT cu LoRA, comparat cu TF-IDF, plus calibrare, interpretabilitate, testare robusteței și învățare semi-supervizată. Explică fiecare tehnică și importanța lor într-un sistem complet.

🕒 1 luni în urmă

Instruirea Gemma-3 pentru raționament matematic structurat cu Tunix GRPO, adaptoare LoRA și recompense GSM8K

Un flux de lucru inovator folosește GRPO, LoRA și recompense GSM8K pentru a antrena modelul Gemma-3 să rezolve probleme de matematică cu raționament structurat, eficientizând procesul și făcându-l accesibil pe hardware modest.

🕒 2 luni în urmă
AI Trajectory lansează un stack de antrenament Multi-LoRA concurent pentru învățare continuă, raportând un câștig de 2,81× în debitul experimentelor

Trajectory lansează un stack de antrenament Multi-LoRA concurent pentru învățare continuă, raportând un câștig de 2,81× în debitul experimentelor

Trajectory a lansat un stack de antrenament Multi-LoRA concurent care permite rularea simultană a mai multor experimente, raportând un câștig de 2,81× în debit. Aceasta optimizează utilizarea memoriei și a GPU-urilor, facilitând învățarea continuă fără pierderea performanței pe sarcinile anterioare.

🕒 3 luni în urmă

Presupunerea LoRA care eșuează în producție

LoRA este o tehnică populară de fine-tuning, dar în producție, presupunerea că funcționează la fel ca fine-tuning-ul complet se sparge adesea. Află care sunt capcanele și cum să le eviți.

🕒 4 luni în urmă
AI Inferență rapidă cu LoRA pentru Flux utilizând Diffusers și PEFT: Ghid complet de optimizare

Inferență rapidă cu LoRA pentru Flux utilizând Diffusers și PEFT: Ghid complet de optimizare

Un ghid tehnic detaliat despre optimizarea inferenței modelului Flux.1-Dev folosind LoRA, Diffusers și PEFT, acoperind strategii de la hotswapping fără recompilare până la rularea eficientă pe GPU-uri de consum precum RTX 4090.

🕒 5 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.