Ant Group, prin divizia Robbyant, a lansat LingBot-VA 2.0, un model video-acțiune cauzal construit nativ pentru Physical AI. Acesta prezice stări viitoare, se reîncadrează pe observații reale și atinge 225 Hz control asincron. Articolul detaliază arhitectura DiT cauzal, fluxul video sparse-MoE și tokenizatorul semantic, precum și unele neconcordanțe numerice din raport.
Robbyant a lansat LingBot-VLA 2.0, un model open-source cu 6 miliarde de parametri pentru manipulare robotică cross-embodiment. Antrenat pe 60.000 de ore de date, unifică controlul pentru brațe, mâini, talie, cap și baze mobile, depășind modele concurente pe benchmark-ul GM-100.
Robbyant, divizia de cercetare a Ant Group, a lansat LingBot-VLA 2.0, un model open-source de tip Vision-Language-Action cu 6 miliarde de parametri, capabil să controleze multiple configurații robotice. Antrenat pe 60.000 de ore de date, modelul folosește un spațiu de acțiune canonic de 55 de dimensiuni și tehnici avansate de distilare, depășind modelele anterioare pe benchmark-ul GM-100.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.