Anthropic și OpenAI vor să integreze evaluatori de siguranță. Vor fi ei cu adevărat independenți?
Anthropic și OpenAI propun integrarea evaluatorilor de siguranță în companiile de AI, dar experții se întreabă dacă aceștia vor fi cu adevărat independenți. Accesul la modelele intermediare și la procesul de antrenament este esențial pentru a detecta comportamente ascunse, însă lipsa detaliilor și a legislației ridică semne de întrebare.
🕒 2 zile în urmă