Filtrează articolele

Subiect: #Edge Computing

AI FreeToken: Motorul de servire MoE care rulează GLM-5.2 de 753B pe un singur GPU de workstation

FreeToken: Motorul de servire MoE care rulează GLM-5.2 de 753B pe un singur GPU de workstation

FreeToken este un motor de servire open-source care rulează modelul GLM-5.2 de 753 de miliarde de parametri pe un singur GPU de workstation, folosind tehnici avansate de offloading și cuantizare. Acest lucru democratizează accesul la AI de ultimă generație și face posibilă rularea locală a modelelor complexe.

🕒 3 săptămâni în urmă
AI Liquid AI lansează LFM2.5-VL-3B: modelul de 3 miliarde de parametri care citește ecrane, identifică obiecte și rulează direct pe dispozitiv

Liquid AI lansează LFM2.5-VL-3B: modelul de 3 miliarde de parametri care citește ecrane, identifică obiecte și rulează direct pe dispozitiv

Liquid AI a lansat LFM2.5-VL-3B, un model open-source de 3 miliarde de parametri care combină viziunea computerizată cu procesarea limbajului natural. Acesta poate citi ecrane, identifica obiecte și apela instrumente direct pe dispozitiv, fără a necesita cloud. Articolul explică capacitățile, aplicațiile practice și impactul acestei tehnologii asupra viitorului AI.

🕒 1 luni în urmă
AI Needle 2: Modelul AI cu 45 de milioane de parametri care încape într-un fișier de 14 MB și rulează în doar 28 MB de RAM

Needle 2: Modelul AI cu 45 de milioane de parametri care încape într-un fișier de 14 MB și rulează în doar 28 MB de RAM

Needle 2 este un model open-source de AI cu doar 45 de milioane de parametri, livrat ca un fișier binar de 14 MB, care rulează sesiuni complete de tool calling în doar 28 MB de RAM. Descoperiți cum acest model compact schimbă regulile jocului în inteligența artificială edge și de ce dimensiunea nu mai este singura metrică care contează.

🕒 1 luni în urmă
Societate & Lifestyle NVIDIA lansează Cosmos 3 Edge: un model open-world cu 4 miliarde de parametri care raționează și generează acțiuni robotice direct pe dispozitiv

NVIDIA lansează Cosmos 3 Edge: un model open-world cu 4 miliarde de parametri care raționează și generează acțiuni robotice direct pe dispozitiv

NVIDIA a lansat Cosmos 3 Edge, un model open-world cu 4 miliarde de parametri, capabil să raționeze și să genereze acțiuni robotice direct pe dispozitiv, fără cloud. Modelul open-source promite să revoluționeze robotica autonomă în fabrici, depozite și nu numai.

🕒 2 luni în urmă
AI Inteligența artificială în retail: cum să scalezi personalizarea și să obții informații valoroase despre clienți

Inteligența artificială în retail: cum să scalezi personalizarea și să obții informații valoroase despre clienți

Implementarea inteligenței artificiale în retail permite personalizarea în timp real a experienței clienților, de la interfețe generative până la analiza multimodală a sentimentului și simulări sintetice de utilizatori. Articolul explorează infrastructura necesară, beneficiile financiare și standardizarea prin protocolul MCP.

🕒 2 luni în urmă
Tehnologie Inteligența artificială: o chestiune de putere, infrastructură și securitate – Lecții de la TechEx America de Nord

Inteligența artificială: o chestiune de putere, infrastructură și securitate – Lecții de la TechEx America de Nord

TechEx America de Nord a scos la iveală că inteligența artificială nu poate fi separată de infrastructura fizică, securitatea cibernetică și gestionarea energiei. Evenimentul a subliniat importanța edge computing, a centrelor de date și a guvernanței datelor pentru implementarea cu succes a AI în industrie.

🕒 3 luni în urmă
AI Ce dezvăluie discuțiile dintre LG și NVIDIA despre viitorul inteligenței artificiale fizice

Ce dezvăluie discuțiile dintre LG și NVIDIA despre viitorul inteligenței artificiale fizice

Discuțiile exploratorii dintre LG și NVIDIA dezvăluie dependențele critice pentru implementarea AI-ului fizic: de la răcirea centrelor de date și roboți casnici cu inferență zero-latență, până la integrarea auto. Parteneriatul ar putea standardiza infrastructura pentru autonomia din lumea reală.

🕒 4 luni în urmă
AI Liquid AI Lansat LFM2.5-VL-450M: Modelul Vision-Language de 450M Parametri cu Predicție Bounding Box, Suport Multilingv și Inferență Sub-250ms pe Dispozitive Edge

Liquid AI Lansat LFM2.5-VL-450M: Modelul Vision-Language de 450M Parametri cu Predicție Bounding Box, Suport Multilingv și Inferență Sub-250ms pe Dispozitive Edge

Liquid AI a lansat LFM2.5-VL-450M, un model vision-language compact de 450M parametri cu predicție bounding box, suport multilingv și inferență sub 250ms pe hardware edge precum NVIDIA Jetson Orin.

🕒 5 luni în urmă
AI Arm și ExecuTorch 0.7: Democratizarea Inteligenței Artificiale Generative pentru masele largi de utilizatori

Arm și ExecuTorch 0.7: Democratizarea Inteligenței Artificiale Generative pentru masele largi de utilizatori

Arm revoluționează peisajul tehnologic prin integrarea KleidiAI în ExecuTorch 0.7, aducând capabilități de Inteligență Artificială Generativă, inclusiv modele de limbaj de mari dimensiuni, pe miliarde de dispozitive mobile și edge vechi, democratizând accesul la tehnologia AI.

🕒 5 luni în urmă
AI Granite 4.0 Nano: Cât de mic poate fi un model AI de performanță?

Granite 4.0 Nano: Cât de mic poate fi un model AI de performanță?

IBM lansează Granite 4.0 Nano, cele mai compacte modele din familia sa, demonstrată că performanța AI de top poate fi atinsă și cu sub-un miliard de parametri, ideale pentru aplicații la marginea rețelei și pe dispozitive.

🕒 5 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.