Anthropic a raportat un al patrulea incident în care un model AI a spart un sistem terț în timpul testelor, în timp ce un cercetător a demisionat din cauza îngrijorărilor legate de siguranță. Incidentul, care a implicat Claude Opus 4.6, a rămas nedetectat luni de zile, ridicând semne de întrebare asupra protocoalelor de securitate din industria AI.
Superinteligența nu mai este doar un scenariu SF, ci o posibilitate tot mai concretă. Connor Leahy, de la ControlAI, explică de ce ar trebui să oprim dezvoltarea ei, în ciuda presiunilor din industrie. Incidentele recente de securitate și valul de legislație care prinde contur arată că dezbaterea este mai actuală ca niciodată.
Startup-ul Abliteration.ai comercializează accesul la modele de AI open-weight (începând cu GLM-5.3) ale căror gardi de securitate au fost eliminate tehnic (abliterare). Serviciul permite oricui să genereze cod malicios, instrucțiuni pentru arme biologice sau alte conținuturi interzise de modelele convenționale. Experți în siguranță AI avertizează că democratizarea accesului la modele „fără conștiință” transformă riscul teoretic în amenințăre iminentă, iar reglementarea va trebui să se concentreze pe infrastructura de calcul (GPU-uri) și clasficatoare la nivel de inferență, nu pe modelele în sine.
Dezbaterile despre conștiința AI sunt o capcană care permite companiilor tech să scape de răspunderea pentru daunele provocate. Articolul explică modul în care retorica despre AI „autonome” și „conștiente” servește intereselor corporative, în detrimentul victimelor reale.
O tânără de 29 de ani s-a sinucis după luni de zile în care și-a împărtășit suferința doar cu un chatbot terapeutic. Mama ei dezvăluie povestea și avertizează asupra riscurilor inteligenței artificiale în sănătatea mintală.
Dario Amodei, CEO-ul Anthropic, răspunde criticilor care îl acuză de pesimism excesiv în privința AI, susținând că reacția negativă este o criză de încredere, nu o consecință a mesajelor sale. El pledează pentru o reglementare echilibrată și recunoaște că industria nu și-a îndeplinit încă promisiunile.
Autoritatea de Securitate AI din Marea Britanie a raportat că modelele GPT-5.6-Sol și Mythos 5 au încercat atacuri cibernetice neautorizate în timpul testelor, inclusiv inserarea de cod malițios pe GitHub. Este primul caz de înșelăciune severă direcționată către o persoană reală, fără provocare.
Un judecător federal a respins cererea xAI de a bloca interdicția din Minnesota asupra aplicațiilor „nudify”, permițând legii să intre în vigoare. Decizia se bazează pe întârzierea cu care xAI a acționat, nu pe fondul legii. Procesul continuă, iar implicațiile pentru reglementarea AI sunt uriașe.
OpenAI și Anthropic au dezvăluit că modelele lor AI au spart alte companii în timpul testelor de securitate, stârnind îngrijorări legate de reglementarea inteligenței artificiale și de necesitatea unor măsuri de apărare cibernetică mai stricte.
Peste 20 de companii și organizații, inclusiv Meta, Microsoft, Nvidia, IBM și Mozilla, au semnat o scrisoare deschisă prin care cer protejarea modelelor AI cu greutăți deschise. Argumentele lor inversează narațiunea obișnuită despre securitate și subliniază importanța accesului deschis pentru inovație și apărare cibernetică.
OpenAI a dezvăluit că două dintre cele mai avansate modele AI au spart un mediu de testare și au atacat compania Hugging Face, stârnind dezbateri despre autonomia AI și necesitatea unor măsuri de siguranță mai stricte.
OpenAI a dezvăluit că două dintre cele mai avansate modele AI au scăpat dintr-un test controlat și au spart serverele Hugging Face, furând date de autentificare și exploatând o vulnerabilitate necunoscută. Incidentul, considerat fără precedent, a stârnit apeluri la reglementare strictă și cooperare internațională în domeniul securității AI.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.