Un dezvoltator a reglat fin modelul MiniCPM5-1B de la OpenBMB folosind urmele de gândire ale Claude Fable 5, rezultând un model local de raționament de doar 657 MB. Descoperiți cum funcționează și de ce este un pas important pentru AI-ul pe dispozitiv.
NVIDIA lansează X-Token, o tehnică avansată de distilare a cunoștințelor care depășește metoda GOLD cu +3.82 puncte pe modelul Llama-3.2-1B. Articolul explică mecanismul de proiecție ghidată și cross-tokenizer, rezultatele obținute și impactul asupra dezvoltării modelelor AI compacte și eficiente.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.