Filtrează articolele

Subiect: #aliniere IA

AI OpenAI pregătește lansarea modelului Astra: prima IA care atinge pragul critic de securitate cibernetică și știe să expliceze vulnerabilități zero-day

OpenAI pregătește lansarea modelului Astra: prima IA care atinge pragul critic de securitate cibernetică și știe să expliceze vulnerabilități zero-day

OpenAI anunță modelul Astra, primul LLM care atinge pragul critic de securitate cibernetică: descoperă și exploatează vulnerabilități zero-day autonom. Lansarea este iminentă, dar capacitățile offensive vor fi restricționate. Compania aplică monitorizare chain-of-thought și filtru de utilizatori de risc, dar refuză transparența asupra metodologiilor. Incidentul Hugging Face și preocupările despre "alignment faking" ridică semne de întrebare majore. Un moment de ruptură pentru securitatea cibernetică și guvernanța IA.

🕒 2 săptămâni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.