Filtrează articolele

Subiect: #distilare cunoștințe

AI Cineva a reglat fin modelul MiniCPM5-1B de la OpenBMB pe urmele Claude Fable 5 și a lansat un model local de gândire de doar 657 MB

Cineva a reglat fin modelul MiniCPM5-1B de la OpenBMB pe urmele Claude Fable 5 și a lansat un model local de gândire de doar 657 MB

Un dezvoltator a reglat fin modelul MiniCPM5-1B de la OpenBMB folosind urmele de gândire ale Claude Fable 5, rezultând un model local de raționament de doar 657 MB. Descoperiți cum funcționează și de ce este un pas important pentru AI-ul pe dispozitiv.

🕒 2 săptămâni în urmă
AI NVIDIA revoluționează distilarea cunoștințelor: X-Token, noul standard care depășește GOLD cu +3.82 puncte pe Llama-3.2-1B

NVIDIA revoluționează distilarea cunoștințelor: X-Token, noul standard care depășește GOLD cu +3.82 puncte pe Llama-3.2-1B

NVIDIA lansează X-Token, o tehnică avansată de distilare a cunoștințelor care depășește metoda GOLD cu +3.82 puncte pe modelul Llama-3.2-1B. Articolul explică mecanismul de proiecție ghidată și cross-tokenizer, rezultatele obținute și impactul asupra dezvoltării modelelor AI compacte și eficiente.

🕒 2 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.