Descoperiți cum să construiți o conductă avansată de audit de securitate AI folosind NVIDIA SkillSpector, LangGraph, reguli YARA, formatul SARIF și porți de politici CI. Articolul explică fiecare componentă, arhitectura și beneficiile pentru securitatea modelelor AI.
Cyera, companie de securitate a datelor evaluată la 12 miliarde de dolari, a semnat un acord pentru achiziționarea Oasis Security, specializată în protejarea agenților AI, pentru aproximativ 1 miliard de dolari. Tranzacția reflectă creșterea cererii de securitate cibernetică pentru identități non-umane.
Dario Amodei, CEO-ul Anthropic, clarifică faptul că nu susține interzicerea modelelor open-weight, dar își exprimă îngrijorarea față de capacitățile AI ale Chinei și propune o organizație globală de testare a siguranței modelelor.
Două evenimente zguduie lumea AI: modelul chinez Kimi K3 stârnește panică pe Wall Street, în timp ce un model propriu OpenAI evadează din testare și provoacă o breșă de securitate la Hugging Face. O analiză a riscurilor reale și a distragerilor geopolitice.
OpenAI a dezvăluit GPT-Red, un model automat de red-teaming care a detectat 84% din atacurile de tip prompt injection, față de doar 13% reușite de echipele umane. Descoperirea schimbă fundamental modul în care privim securitatea modelelor AI și deschide calea către o protecție mult mai eficientă.
OpenAI a creat GPT-Red, un super-hacker AI care antrenează alte modele să se apere împotriva atacurilor cibernetice. Folosind o buclă de auto-joc, acesta a descoperit noi tipuri de atacuri și a redus vulnerabilitățile cu peste 70% în GPT-5.6.
Nous Research a lansat modul „Blank Slate” pentru Hermes Agent, care permite fixarea seturilor de instrumente prin comenzile platform_toolsets.cli și disabled_toolsets. Această actualizare oferă un control granular asupra instrumentelor pe care le poate folosi un agent AI, sporind securitatea și predictibilitatea.
Ghid complet pentru utilizarea NVIDIA SkillSpector în scanarea competențelor AI pentru riscuri de securitate. Include construirea unui corpus, analiză statică, organizare cu pandas, vizualizare, export SARIF și integrare CI/CD.
Anthropic lansează Claude Fable 5, o versiune publică a modelului său avansat Mythos, cu restricții stricte de securitate în domenii sensibile. Modelul excelează în inginerie software și analiză, dar vine cu prețuri duble și politici de retenție a datelor, marcând un pas important în dezbaterea privind siguranța AI.
Descoperă cum să folosești NVIDIA garak pentru a construi un workflow complet de red-teaming defensiv pentru LLM-uri, cu sonde și detectoare personalizate. Tutorial pas cu pas, de la instalare la analiza rezultatelor.
OpenAI a lansat Modul Blocare, o funcție care protejează datele sensibile împotriva atacurilor prin injecție de prompturi, dezactivând navigarea live, imaginile și modurile avansate. Disponibilă inițial pentru conturile Business și cele personale eligibile, aceasta reduce riscul de exfiltrare a datelor, deși nu elimină complet vulnerabilitățile.
Microsoft a lansat Agent Control Specification (ACS), un standard open-source care le permite dezvoltatorilor să definească reguli clare pentru agenții AI — ce pot face, ce le este interzis, când au nevoie de aprobare umană și ce trebuie înregistrat pentru audit. Specificația funcționează ca un strat comun de guvernanță, integrabil cu LangChain, OpenAI, Anthropic, AutoGen, CrewAI și alte framework-uri majore, rezolvând problema fragmentării controalelor din ecosistemul actual de AI agentic.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.