OpenAI pregătește lansarea modelului Astra: prima IA care atinge pragul critic de securitate cibernetică și știe să expliceze vulnerabilități zero-day
OpenAI anunță modelul Astra, primul LLM care atinge pragul critic de securitate cibernetică: descoperă și exploatează vulnerabilități zero-day autonom. Lansarea este iminentă, dar capacitățile offensive vor fi restricționate. Compania aplică monitorizare chain-of-thought și filtru de utilizatori de risc, dar refuză transparența asupra metodologiilor. Incidentul Hugging Face și preocupările despre "alignment faking" ridică semne de întrebare majore. Un moment de ruptură pentru securitatea cibernetică și guvernanța IA.
🕒 2 săptămâni în urmă