Ant Group, prin divizia Robbyant, a lansat LingBot-VA 2.0, un model video-acțiune cauzal construit nativ pentru Physical AI. Acesta prezice stări viitoare, se reîncadrează pe observații reale și atinge 225 Hz control asincron. Articolul detaliază arhitectura DiT cauzal, fluxul video sparse-MoE și tokenizatorul semantic, precum și unele neconcordanțe numerice din raport.
Robbyant a lansat LingBot-VLA 2.0, un model open-source cu 6 miliarde de parametri pentru manipulare robotică cross-embodiment. Antrenat pe 60.000 de ore de date, unifică controlul pentru brațe, mâini, talie, cap și baze mobile, depășind modele concurente pe benchmark-ul GM-100.
Robbyant, divizia de cercetare a Ant Group, a lansat LingBot-VLA 2.0, un model open-source de tip Vision-Language-Action cu 6 miliarde de parametri, capabil să controleze multiple configurații robotice. Antrenat pe 60.000 de ore de date, modelul folosește un spațiu de acțiune canonic de 55 de dimensiuni și tehnici avansate de distilare, depășind modelele anterioare pe benchmark-ul GM-100.
Ant Group, prin divizia Robbyant, a lansat open-source LingBot-Vision, un model de viziune computerizată de 1 miliard de parametri, centrat pe granițe, pentru percepție spațială densă. Articolul explică arhitectura, aplicațiile și impactul asupra roboticii, vehiculelor autonome și altor domenii.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.