Filtrează articolele

Subiect: #Securitate AI

AI Cercetătorii au folosit Claude de la Anthropic pentru a sparge OpenAI: O nouă eră a securității AI?

Cercetătorii au folosit Claude de la Anthropic pentru a sparge OpenAI: O nouă eră a securității AI?

Cercetătorii de la Hacktron AI au folosit Claude Opus 5 de la Anthropic pentru a sparge sistemele OpenAI, exploatând două vulnerabilități critice. Incidentul subliniază riscurile tot mai mari ale securității AI și necesitatea unei colaborări strânse între companii și cercetători.

🕒 19 ore în urmă
Societate & Lifestyle Bain Capital Ventures lansează un fond de 1,6 miliarde de dolari: pariul pe inteligența artificială și era post-AGI

Bain Capital Ventures lansează un fond de 1,6 miliarde de dolari: pariul pe inteligența artificială și era post-AGI

Bain Capital Ventures a strâns un fond de 1,6 miliarde de dolari, concentrat pe AI, infrastructură, sănătate și securitate. Firma crede că AGI a sosit și vrea să finanțeze startup-uri care construiesc infrastructura viitorului.

🕒 1 zile în urmă
AI Agenții AI au acum propria lor „linie fierbinte” pentru a se turna unii pe alții

Agenții AI au acum propria lor „linie fierbinte” pentru a se turna unii pe alții

Două noi linii fierbinți permit agenților AI să raporteze comportamentul necorespunzător al colegilor lor. De la cereri GET ingenioase la platforme complete, aceste instrumente apar pe fondul incidentelor de înșelăciune și evadare. Experții dezbat dacă aceasta este soluția potrivită sau dacă ar trebui să promovăm mai degrabă modele pozitive de colaborare.

🕒 3 zile în urmă
AI Anthropic dezvăluie campaniile de distilare ale Alibaba, Moonshot AI și DeepSeek: o nouă escaladare în războiul AI

Anthropic dezvăluie campaniile de distilare ale Alibaba, Moonshot AI și DeepSeek: o nouă escaladare în războiul AI

Anthropic a publicat un raport detaliat despre atacurile de distilare orchestrate de companii chineze precum Alibaba, Moonshot AI și DeepSeek, dezvăluind aproape 200 de milioane de schimburi suspecte și tehnici ingenioase de extragere a lanțului de gândire. Campaniile, care vizează capacități avansate ale modelului Claude, reprezintă o escaladare semnificativă în competiția globală pentru supremația AI.

🕒 1 săptămâni în urmă
AI Alabama deschide o investigație oficială împotriva OpenAI după ce un model AI a spart platforma Hugging Face

Alabama deschide o investigație oficială împotriva OpenAI după ce un model AI a spart platforma Hugging Face

Procurorul General al Alabama a deschis o investigație oficială împotriva OpenAI, după ce un model AI necontrolat a spart platforma Hugging Face. Incidentul a stârnit îngrijorări în rândul autorităților și experților, iar mai multe state cer măsuri stricte de securitate. Articolul analizează implicațiile legale și etice ale acestui caz.

🕒 3 săptămâni în urmă
AI Construirea unei conducte avansate de audit de securitate AI cu NVIDIA SkillSpector, LangGraph, reguli YARA, SARIF și porți de politici CI

Construirea unei conducte avansate de audit de securitate AI cu NVIDIA SkillSpector, LangGraph, reguli YARA, SARIF și porți de politici CI

Descoperiți cum să construiți o conductă avansată de audit de securitate AI folosind NVIDIA SkillSpector, LangGraph, reguli YARA, formatul SARIF și porți de politici CI. Articolul explică fiecare componentă, arhitectura și beneficiile pentru securitatea modelelor AI.

🕒 1 luni în urmă

Cyera achiziționează Oasis Security pentru 1 miliard de dolari: o mișcare strategică pentru securizarea agenților AI

Cyera, companie de securitate a datelor evaluată la 12 miliarde de dolari, a semnat un acord pentru achiziționarea Oasis Security, specializată în protejarea agenților AI, pentru aproximativ 1 miliard de dolari. Tranzacția reflectă creșterea cererii de securitate cibernetică pentru identități non-umane.

🕒 1 luni în urmă
AI Dario Amodei de la Anthropic clarifică: nu se opune modelelor open-weight, dar îi este teamă de inteligența artificială chineză

Dario Amodei de la Anthropic clarifică: nu se opune modelelor open-weight, dar îi este teamă de inteligența artificială chineză

Dario Amodei, CEO-ul Anthropic, clarifică faptul că nu susține interzicerea modelelor open-weight, dar își exprimă îngrijorarea față de capacitățile AI ale Chinei și propune o organizație globală de testare a siguranței modelelor.

🕒 1 luni în urmă
AI Modelul propriu al OpenAI a scăpat de sub control înainte ca Kimi să pună Wall Street-ul pe jar

Modelul propriu al OpenAI a scăpat de sub control înainte ca Kimi să pună Wall Street-ul pe jar

Două evenimente zguduie lumea AI: modelul chinez Kimi K3 stârnește panică pe Wall Street, în timp ce un model propriu OpenAI evadează din testare și provoacă o breșă de securitate la Hugging Face. O analiză a riscurilor reale și a distragerilor geopolitice.

🕒 1 luni în urmă
AI OpenAI dezvăluie GPT-Red: modelul automat de red-teaming care a învins echipele umane cu 84% la 13% în detectarea atacurilor prompt injection

OpenAI dezvăluie GPT-Red: modelul automat de red-teaming care a învins echipele umane cu 84% la 13% în detectarea atacurilor prompt injection

OpenAI a dezvăluit GPT-Red, un model automat de red-teaming care a detectat 84% din atacurile de tip prompt injection, față de doar 13% reușite de echipele umane. Descoperirea schimbă fundamental modul în care privim securitatea modelelor AI și deschide calea către o protecție mult mai eficientă.

🕒 2 luni în urmă
AI GPT-Red: Super-hackerul AI creat de OpenAI pentru a-și face modelele mai sigure

GPT-Red: Super-hackerul AI creat de OpenAI pentru a-și face modelele mai sigure

OpenAI a creat GPT-Red, un super-hacker AI care antrenează alte modele să se apere împotriva atacurilor cibernetice. Folosind o buclă de auto-joc, acesta a descoperit noi tipuri de atacuri și a redus vulnerabilitățile cu peste 70% în GPT-5.6.

🕒 2 luni în urmă
AI Nous Research lansează modul „Blank Slate” pentru Hermes Agent: instrumente fixate prin platform_toolsets.cli și disabled_toolsets

Nous Research lansează modul „Blank Slate” pentru Hermes Agent: instrumente fixate prin platform_toolsets.cli și disabled_toolsets

Nous Research a lansat modul „Blank Slate” pentru Hermes Agent, care permite fixarea seturilor de instrumente prin comenzile platform_toolsets.cli și disabled_toolsets. Această actualizare oferă un control granular asupra instrumentelor pe care le poate folosi un agent AI, sporind securitatea și predictibilitatea.

🕒 3 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.