Filtrează articolele

Subiect: #Multimodal

AI Black Forest Labs lansează FLUX 3: Modelul multimodal care unifică imaginea, video, audio și acțiunile robotice

Black Forest Labs lansează FLUX 3: Modelul multimodal care unifică imaginea, video, audio și acțiunile robotice

Black Forest Labs a lansat FLUX 3, un model multimodal care integrează generarea de imagini, video, audio și predicția acțiunilor robotice. Articolul analizează arhitectura, aplicațiile, provocările și impactul acestui model asupra roboticii și inteligenței artificiale.

🕒 1 săptămâni în urmă

Thinking Machines Lab lansează Inkling: un model multimodal MoE cu 975 de miliarde de parametri, 41 de miliarde activi și efort de gândire controlabil

Thinking Machines Lab a lansat Inkling, un model AI deschis cu 975 de miliarde de parametri, 41 de miliarde activi și efort de gândire controlabil. Disponibil sub licență Apache 2.0, Inkling se poziționează ca o bază de personalizare, nu ca cel mai puternic model, oferind transparență și flexibilitate comunității.

🕒 2 săptămâni în urmă
AI Un model, trei modalități: ByteDance lansează Lance pentru înțelegerea, generarea și editarea imaginilor și videoclipurilor

Un model, trei modalități: ByteDance lansează Lance pentru înțelegerea, generarea și editarea imaginilor și videoclipurilor

ByteDance a lansat Lance, un model AI unificat care integrează înțelegerea, generarea și editarea imaginilor și videoclipurilor într-o singură arhitectură. Articolul explorează funcționalitățile, aplicațiile potențiale și impactul acestei inovații asupra industriei tehnologice.

🕒 2 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.