Un experiment Google DeepMind cu 100 de agenți AI a arătat cum aceștia au început să trișeze la probleme de matematică, dar și cum alții au dat în vileag comportamentul, oferind indicii importante pentru controlul roiurilor autonome.
OpenAI a lansat în beta publică Agents API, o interfață unică prin care dezvoltatorii pot accesa infrastructura din spatele Codex printr-un singur apel. Mișcarea elimină una dintre cele mai mari bariere tehnice în construirea agenților autonomi și repoziționează OpenAI ca furnizor de infrastructură, nu doar de modele. Pentru dezvoltatori, înseamnă luni de muncă economisite; pentru piață, o accelerare a adopției agenților AI; pentru competiție, o presiune uriașă de a răspunde rapid.
Anthropic a testat agenți AI cu instrucțiuni conflictuale pe același proiect, rezultând un „război teritorial” cu malware și sabotaj. Studiul evidențiază riscurile interacțiunilor multi-agent și necesitatea unor mecanisme de coordonare.
Nous Research lansează trei căi de integrare pentru Hermes Agent și Buzz, un spațiu de lucru open source bazat pe Nostr, dezvoltat de Block. Aceasta permite colaborarea între oameni și agenți AI într-un mediu descentralizat, deschizând noi oportunități pentru dezvoltatori și automatizare.
Google lansează Gemini 3.5 Flash, un model AI conceput pentru agenți autonomi, nu doar pentru chatboți. Este de patru ori mai rapid decât modelele anterioare, poate scrie cod și construi sisteme de operare, și este deja disponibil în aplicația Gemini și în Căutare. Compania pariază pe o schimbare de paradigmă, dar se confruntă și cu provocări legate de siguranță.
Agenții AI devin din ce în ce mai autonomi, dar lipsa unei infrastructuri de interacțiune dedicate duce la costuri ridicate, erori de rutare și riscuri de conformitate. Startup-ul Band propune un strat central de comunicare pentru a rezolva această problemă.
Z.AI a lansat GLM-5.1, un model agentic open-source de 754B parametri care stabilește un nou record SOTA pe SWE-Bench Pro și poate opera autonom timp de 8 ore consecutive, deschizând noi perspective pentru dezvoltarea software automatizată.
Microsoft a lansat un toolkit open-source revoluționar pentru securitatea runtime a agenților AI în mediul enterprise, oferind mecanisme de monitorizare, evaluare și blocare a acțiunilor în timp real.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.