Cercetătorii de la Stanford au dezvoltat Paper2Agent, un sistem inovator care transformă automat lucrările științifice în agenți AI funcționali, capabili să reproducă rezultatele publicate și să ruleze pe seturi de date noi. Sistemul abordează criza reproducerii în cercetare și ar putea revoluționa modul în care comunitatea științifică interacționează cu literatura academică.
Analiză profundă a cauzelor pentru care 89% din piloatele de agenți AI eșuează la trecerea în producție, bazată pe date Deloitte, Gartner, McKinsey și Forrester. Scope creep, calitate date, lipsă evaluări automate, guvernanță slabă și costuri ascunse sunt blocajele reale, nu modelele.
Google Research lansează ToolGrad, un framework ACL 2026 care inversează generarea datelor pentru tool-use: construiește mai întâi lanțurile de API verificate, apoi generează întrebările. Rezultatul: 99,8% pass rate pe ToolBench (vs 63,8% DFS) și un Gemma-3-12B fintunat pe 500 de exemple care egalizează Gemini 2.5 Pro pe BFCL. Totul este open-source (Apache 2.0).
Sequoia Capital investește 25 de milioane de dolari în Cymphony, un startup care ajută companiile să gestioneze riscurile de securitate create de agenții AI. Platforma oferă o vedere unificată asupra identităților non-umane și automatizează remedierea vulnerabilităților.
GitHub lansează Project HydraFusion, o arhitectură revoluționară pentru Copilot CLI care înlocuiește modelul unic cu o orhestrare dinamică de modele specializate per sarcină. Articolul analizează arhitectura (Router, Planner, Registry), impactul economic (costuri, latență), strategia BYOM pentru enterprise și riscurile sistemelor AI compuse.
Palo Alto Networks achiziționează Console pentru 500M$ pentru a dota platforma Cortex de agenți AI capabili să investigheze și rezolve alerte de securitate autonom. A șaptea achiziție a anului semnifică accelerarea tranzitiei către securitatea autonomă în enterprise.
Arga, un startup care construiește medii de antrenament pentru agenți AI enterprise, a strâns 10 milioane de dolari într-o rundă seed condusă de General Catalyst. Compania creează gemeni digitali ai aplicațiilor precum Salesforce sau Outlook, permițând antrenarea agenților prin învățare prin consolidare într-un mediu controlat și resetabil.
Nous Research lansează Bot Mode pentru Hermes Agent, transformând profilurile de agenți într-o echipă de roboți specializați, fiecare cu nume, personalitate și rol propriu. O schimbare majoră în modul în care lucrăm cu agenții AI.
Okta introduce o soluție de limitare a instrumentelor MCP bazată pe identitate, care reduce costurile cu tokenii pentru agenții AI cu până la 90%, prin eliminarea instrumentelor neautorizate din prompturile modelului.
NVIDIA a lansat Molt, un cadru open-source de învățare prin consolidare, nativ PyTorch, conceput pentru a simplifica crearea de agenți inteligenți. Articolul explică caracteristicile, impactul și cum să începi să folosești Molt.
Supabase a lansat Evals, un benchmark open source care evaluează agenții AI precum Claude Code, Codex și OpenCode pe sarcini reale din ecosistemul Supabase. Rezultatele arată care model se descurcă cel mai bine la crearea de tabele, interogări SQL și politici de securitate.
Liquid AI a lansat două noi encodere bidirecționale, LFM2.5-Encoder-230M și LFM2.5-Encoder-350M, care oferă performanțe rapide pe CPU chiar și la un context de 8.000 de tokeni. Aceste modele open-source sunt ideale pentru aplicații de înțelegere a textului, agenți AI și edge computing.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.