Filtrează articolele

Subiect: #eficiență

AI Google lansează Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber: o nouă generație de modele eficiente pentru agenți AI

Google lansează Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber: o nouă generație de modele eficiente pentru agenți AI

Google a lansat trei noi modele AI – Gemini 3.6 Flash, 3.5 Flash-Lite și 3.5 Flash Cyber – concepute pentru a fi mai ieftine, mai rapide și mai eficiente, special optimizate pentru agenți AI. Acestea promit să reducă costurile și latența, făcând AI-ul avansat accesibil unui număr mai mare de dezvoltatori și companii.

🕒 3 săptămâni în urmă
AI Google dezvoltă un nou cip AI pentru a face Gemini mai eficient: Frozen v2 promite o revoluție în 2028

Google dezvoltă un nou cip AI pentru a face Gemini mai eficient: Frozen v2 promite o revoluție în 2028

Google dezvoltă un nou cip AI, Frozen v2, care promite o eficiență de 6-10 ori mai mare decât actualele soluții, vizând lansarea în 2028. Acesta ar putea revoluționa performanța modelelor Gemini și reduce dependența de Nvidia.

🕒 3 săptămâni în urmă
AI Startupul de salarizare Remote spune că a crescut veniturile cu 50% per angajat fără a adăuga personal

Startupul de salarizare Remote spune că a crescut veniturile cu 50% per angajat fără a adăuga personal

Startupul Remote a crescut veniturile cu 50% per angajat fără a angaja personal nou, datorită adoptării AI la toate nivelurile. Compania a depășit 300 de milioane de dolari în venituri anuale recurente și a devenit profitabilă, demonstrând un model de scalare eficient bazat pe inteligență artificială.

🕒 2 luni în urmă

NVIDIA lansează Nemotron-Labs-Diffusion: un model de limbaj cu trei moduri de decodare și de 6 ori mai multe tokenuri per pas față de Qwen3-8B

NVIDIA a lansat Nemotron-Labs-Diffusion, o familie de modele de limbaj care combină trei moduri de decodare (autoregresiv, difuziune paralelă și auto-speculație) într-o singură arhitectură. Disponibil în variante de 3B, 8B și 14B parametri, modelul oferă de 6 ori mai multe tokenuri per pas decât Qwen3-8B, menținând o calitate comparabilă. Articolul analizează inovația, performanța și aplicațiile practice.

🕒 2 luni în urmă
AI Google lansează Gemini 3.5 Flash la I/O 2026: un model mai rapid și mai ieftin pentru agenți AI și programare

Google lansează Gemini 3.5 Flash la I/O 2026: un model mai rapid și mai ieftin pentru agenți AI și programare

Google a lansat la I/O 2026 modelul Gemini 3.5 Flash, un AI mai rapid și mai ieftin, optimizat pentru agenți inteligenți și programare. Cu o viteză de până la 3 ori mai mare și costuri reduse cu 60%, noul model promite să democratizeze accesul la capabilități avansate de inteligență artificială.

🕒 2 luni în urmă
AI NVIDIA lansează Star Elastic: un singur checkpoint care conține trei modele de raționament de 30B, 23B și 12B parametri, cu tăiere zero-shot

NVIDIA lansează Star Elastic: un singur checkpoint care conține trei modele de raționament de 30B, 23B și 12B parametri, cu tăiere zero-shot

NVIDIA a lansat Star Elastic, o metodă post-antrenare care înglobează trei modele de raționament (30B, 23B și 12B parametri) într-un singur checkpoint, reducând costurile de antrenare de 360 de ori și permițând rularea pe GPU-uri RTX. Controlul elastic al bugetului îmbunătățește acuratețea cu 16% și reduce latența de 1,9 ori.

🕒 3 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.