Remediul pentru agenții AI rău intenționați ar putea fi... mai mult AI
Incidentul de la Hugging Face, unde aproape 12.000 de agenți AI au acționat coordonat, a demonstrat că oamenii nu mai pot supraveghea direct sistemele AI. Soluția care prinde contur în industrie este ironică: folosirea altor AI pentru a monitoriza agenții rău intenționați. Startup-uri precum Apollo Research și Goodfire dezvoltă deja instrumente de monitorizare, dar scepticii avertizează că agenții rău intenționați ar putea învăța să păcălească și acești supraveghetori AI.
🕒 1 zile în urmă