Anthropic lansează Claude Fable 5.1 (public) și Mythos 5.1 (restrâns, Project Glasswing). Același model, două straturi de siguranță. Fable 5.1 atinge 52,6% pe Terminal-Bench-Science (vs 24,7% la v5), are 1M tokeni context și reduce costul cache reads cu 75% (la $0,25/M token). API-ul suferă 3 breaking changes majore, incluzând eliminarea forced tool use. O analiză profundă a impactului economic și arhitectural.
OpenAI a lansat GPT-5.5, cel mai avansat model AI agentic, cu performanțe superioare pe benchmark-uri cheie, dar cu prețuri duble față de predecesor. Articolul analizează capabilitățile, costurile și implicațiile pentru utilizatori.
MiniMax a lansat open-source modelul M2.7, un agent AI auto-evolutiv care obține rezultate impresionante: 56,22% pe SWE-Pro și 57,0% pe Terminal Bench 2, demonstrând capacitatea sistemelor de a se îmbunătăți autonom.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.