NVIDIA a lansat Nemotron 3.5 Lightning, un model open source cu arhitectură MoE de 30B parametri, dar doar 3B activi, alături de routerul NeMo Switchyard. Această combinație promite eficiență și accesibilitate, democratizând accesul la AI de ultimă generație.
Meta lansează Muse Glimmer, un model AI de 30 de miliarde de parametri, sub licență Apache 2.0, care rulează agenți locali pe GPU-uri de consum. Cu performanțe competitive în benchmark-uri, modelul oferă o alternativă viabilă la soluțiile cloud, punând accent pe confidențialitate și latență redusă.
La conferința Ai4 de la Las Vegas, Geoffrey Hinton, Fei-Fei Li și Andrew Ng au dezbătut deschiderea în AI, evidențiind atât riscurile, cât și beneficiile. Deși au opinii diferite, toți trei pledează pentru menținerea accesului deschis la tehnologie, pentru a evita concentrarea puterii în mâinile câtorva companii și pentru a stimula inovația globală.
AllenAI a lansat Open Instruct Tulu 3, un model open-source care integrează tehnici avansate de post-antrenament: SFT, DPO, RLVR, GRPO și evaluare pe bază de verificator. Acest articol explică fiecare metodă și impactul lor asupra performanței modelului.
Liquid AI a lansat LFM2.5-VL-3B, un model open-source de 3 miliarde de parametri care combină viziunea computerizată cu procesarea limbajului natural. Acesta poate citi ecrane, identifica obiecte și apela instrumente direct pe dispozitiv, fără a necesita cloud. Articolul explică capacitățile, aplicațiile practice și impactul acestei tehnologii asupra viitorului AI.
Meta a lansat Glimmer, un model AI open-weight, iar Mark Zuckerberg a publicat un manifest despre democratizarea AI-ului. Dar, așa cum arată analiza TechCrunch, există contradicții serioase între discurs și practică, de la costurile energetice uriașe până la păstrarea celor mai bune modele în spatele API-urilor.
Needle 2 este un model open-source de AI cu doar 45 de milioane de parametri, livrat ca un fișier binar de 14 MB, care rulează sesiuni complete de tool calling în doar 28 MB de RAM. Descoperiți cum acest model compact schimbă regulile jocului în inteligența artificială edge și de ce dimensiunea nu mai este singura metrică care contează.
Writer lansează Palmyra X6, un model AI bazat pe GLM-5.2, și un harness îmbunătățit care promite reducerea costurilor cu tokenii cu până la 50%. CEO-ul May Habib explică de ce întreprinderile sunt sătule de costurile mari și cum optimizarea infrastructurii poate fi mai eficientă decât alegerea modelului.
X (fostul Twitter) a deschis codul sursă al algoritmului „For You” și al motorului de clasificare, permițând utilizatorilor să verifice dacă au fost „shadowbanned”. Un nou instrument de transparență oferă date despre etichetele aplicate conturilor, iar dezvoltatorii pot contribui la îmbunătățirea algoritmului.
SpaceXAI lansează Grok 4.6, un model de tip frontieră cu context de 500K tokeni, optimizat pentru agenți autonomi de lungă durată, programare și muncă intelectuală. Descoperă cum această lansare redefinește standardele în inteligența artificială și ce înseamnă pentru dezvoltatori și companii.
webAI a lansat TwIL-LM, o familie de modele de limbaj de 1,7B și 3B parametri, specializate în autoformalizare, care rulează eficient pe hardware local. Aceste modele open-source transformă limbajul natural în logică formală, deschizând noi posibilități în verificarea teoremelor, educație și dezvoltare software.
NVIDIA a lansat NemotronLabs VoiceChat 11B, un model open-source speech-to-speech complet duplex, cu latență de ~450 ms și apeluri live de instrumente. Acesta promite conversații naturale și acțiuni în timp real prin voce, deschizând noi posibilități în AI-ul vocal.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.