FreeToken este un motor de servire open-source care rulează modelul GLM-5.2 de 753 de miliarde de parametri pe un singur GPU de workstation, folosind tehnici avansate de offloading și cuantizare. Acest lucru democratizează accesul la AI de ultimă generație și face posibilă rularea locală a modelelor complexe.
Liquid AI a lansat LFM2.5-VL-3B, un model open-source de 3 miliarde de parametri care combină viziunea computerizată cu procesarea limbajului natural. Acesta poate citi ecrane, identifica obiecte și apela instrumente direct pe dispozitiv, fără a necesita cloud. Articolul explică capacitățile, aplicațiile practice și impactul acestei tehnologii asupra viitorului AI.
Needle 2 este un model open-source de AI cu doar 45 de milioane de parametri, livrat ca un fișier binar de 14 MB, care rulează sesiuni complete de tool calling în doar 28 MB de RAM. Descoperiți cum acest model compact schimbă regulile jocului în inteligența artificială edge și de ce dimensiunea nu mai este singura metrică care contează.
NVIDIA a lansat Cosmos 3 Edge, un model open-world cu 4 miliarde de parametri, capabil să raționeze și să genereze acțiuni robotice direct pe dispozitiv, fără cloud. Modelul open-source promite să revoluționeze robotica autonomă în fabrici, depozite și nu numai.
Implementarea inteligenței artificiale în retail permite personalizarea în timp real a experienței clienților, de la interfețe generative până la analiza multimodală a sentimentului și simulări sintetice de utilizatori. Articolul explorează infrastructura necesară, beneficiile financiare și standardizarea prin protocolul MCP.
TechEx America de Nord a scos la iveală că inteligența artificială nu poate fi separată de infrastructura fizică, securitatea cibernetică și gestionarea energiei. Evenimentul a subliniat importanța edge computing, a centrelor de date și a guvernanței datelor pentru implementarea cu succes a AI în industrie.
Discuțiile exploratorii dintre LG și NVIDIA dezvăluie dependențele critice pentru implementarea AI-ului fizic: de la răcirea centrelor de date și roboți casnici cu inferență zero-latență, până la integrarea auto. Parteneriatul ar putea standardiza infrastructura pentru autonomia din lumea reală.
Liquid AI a lansat LFM2.5-VL-450M, un model vision-language compact de 450M parametri cu predicție bounding box, suport multilingv și inferență sub 250ms pe hardware edge precum NVIDIA Jetson Orin.
Arm revoluționează peisajul tehnologic prin integrarea KleidiAI în ExecuTorch 0.7, aducând capabilități de Inteligență Artificială Generativă, inclusiv modele de limbaj de mari dimensiuni, pe miliarde de dispozitive mobile și edge vechi, democratizând accesul la tehnologia AI.
IBM lansează Granite 4.0 Nano, cele mai compacte modele din familia sa, demonstrată că performanța AI de top poate fi atinsă și cu sub-un miliard de parametri, ideale pentru aplicații la marginea rețelei și pe dispozitive.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.