Dario Amodei, CEO-ul Anthropic, clarifică faptul că nu susține interzicerea modelelor open-weight, dar își exprimă îngrijorarea față de capacitățile AI ale Chinei și propune o organizație globală de testare a siguranței modelelor.
Peste 20 de companii și organizații, inclusiv Meta, Microsoft, Nvidia, IBM și Mozilla, au semnat o scrisoare deschisă prin care cer protejarea modelelor AI cu greutăți deschise. Argumentele lor inversează narațiunea obișnuită despre securitate și subliniază importanța accesului deschis pentru inovație și apărare cibernetică.
Mai multe companii importante din domeniul AI, printre care Hugging Face, Meta, Microsoft, Mistral și Nvidia, au semnat o scrisoare deschisă prin care îndeamnă autoritățile americane să nu impună restricții largi asupra modelelor open-weight, pe fondul dezbaterilor privind răspunsul la inteligența artificială chineză.
Experții contestă acuzațiile oficialilor americani conform cărora modelul chinezesc Kimi K3 ar fi copiat modelul Fable al Anthropic prin distilare. Cercetătorii explică de ce simpla distilare nu poate produce un model atât de avansat într-un timp atât de scurt și subliniază complexitatea reală a antrenării LLM-urilor moderne.
Distilarea modelelor de limbaj (LLM distillation) este tehnica prin care un model mare „profesor” transferă cunoștințele unui model mic „elev”, reducând costurile și resursele necesare, păstrând în același timp o mare parte din performanță. Articolul explică principalele tehnici (logit-based, feature-based, generare de date sintetice, multi-profesor), beneficiile, provocările și exemple notabile din industrie.
China a schimbat jocul în AI prin a face modelele sale de top open-source și gratuite, câştigând încrederea dezvoltatorilor global și depăşind SUA în descărcări — o strategie care transformă accesul, costul și suveranitatea tehnologică, chiar și în fața restricțiilor de chip-uri și acuzațiilor de distilare ilegală.
Descoperă cum Apriel-H1 redefinește eficiența modelelor de raționament prin distilare hibridă, înlocuind straturile de atenție cu Mamba și obținând o creștere a vitezei de 2.1x fără a compromite calitatea gândirii logice.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.