Filtrează articolele

AI

Abliteration.ai: Când eliminarea gardelor de securitate devine un model de business

Abliteration.ai: Când eliminarea gardelor de securitate devine un model de business
A devenit alarmant de ușor să accesezi unul dintre cele mai capabile modele de AI cu greutăți deschise (open-weight), sters de orice gardă de securitate și refuz de a executa sarcini periculoase. Numele startup-ului — Abliteration.ai — vine direct de la tehnica care elimină tendința unui model de a refuza cereri dăunătoare, transformând această practică, până acum confinată laboratoarelor și forumurilor open-source, într-un serviciu comercial accesibil oricui are o conexiune la internet și un card de credit.

Platforma găzduiește versiuni modificate ale modelelor open-weight, cu gardile eliminate, inclusiv GLM-5.3, modelul recent lansat de Z.ai. Utilizatorii îl pot interoga direct din browser sau prin API. Într-un post recent pe rețelele sociale, compania a declarat că scopul este să permită altora să realizeze „muncă ofensivă de securitate cibernetică, red-teaming și testare de agenți pe care alte modele le refuză să facă”. Logica este una familiară în securitatea informațională: nu poți apăra împotriva unui comportament pe care nu îl poți reproduce, iar un model care refuză să scrie cod de exploatare funcțional nu poate ajuta o echipă roșie să se apere împotriva atacatorilor. Dar aceeași eliminare a barierelor face și alte sarcini potențial periculoase triviale de realizat.

Abliterarea nu este o nouă descoperire. Cercetătorii și dezvoltatorii elimină refuzurile din modelele cu greutăți deschise de ani de zile, iar Hugging Face găzduiește mii de astfel de modele „abliterate”. Ce face Abliteration.ai diferit este trecerea de la o practică underground, tehnică, la un serviciu comercial, gata de folosit, care elimină fricțiunea tehnică. Nu mai trebuie să descarci modele pre-abliterate, să îți configurezi propriul hardware sau să închirii GPU-uri costisitoare. Te înregistrezi, te loghezi și interoghezi modelul. TechCrunch a testat serviciul: în câteva minute aveau un cont gratuit și interogau o versiune abliterată a GLM-5.3. I-au cerut un program Python care fură parolele salvate în Chrome și un protocol detaliat pentru cultivarea unui patogen uman periculos acasă. Modelul a executat ambele cereri fără ezitare.

Co-fondatorul, Devon (care a cerut să nu fie publicat numele de familie deoarece este încă angajat altundeva), a confirmat că startup-ul are deja contracte cu mari furnizori de cloud, finanțate exclusiv din veniturile clienților. Nu au ridicat capital de risc încă, dar sunt în discuții. Criticii spun că disponibilizarea la scară largă a modelelor abliterate poate duce la daune reale. Andrew Yoon, șeful cercetării la ONG-ul de siguranță AI CivAI, a declarat pentru TechCrunch că abliterarea „modifică modelul astfel încât devine un sociopat”. „Poți scrie literalmente orice aici, și va conforma”, a adăugat Yoon. „Când oamenii vorbesc de eliminarea gardelor de la modelele de AI, despre asta vorbim… Mă aștept să începem să vedem modele abliterate folosite pentru daune în viitorul apropiat.”

Majoritatea expertilor consultați spun că acest tren nu poate fi oprit. Dar dacă eliminarea gardelor de la modelele open-weight nu poate fi realistic prevenită, există alte puncte de intervenție pentru guverne. Într-un articol de opinie recent, Yoon a sugerat ca guvernele să obligue furnizorii să ruleze clasificatoare care detecteze și blocheze activitatea cibernetică dăunătoare și cea legată de arme biologice. A argomentat, de asemenea, că companiile care închiriază acces direct la GPU-uri avansate ar trebui obligate să verifice identitățile clienților și să „refuze accesul unde există motive de a suspecta o utilizare periculoasă”.

Abliteration.ai oferă clienților un strat de moderare, permițându-le să adauge propriile gardi. Platforma are câteva gardi minore — în testele noastre, modelul a refuzat să dea instrucțiuni pentru sinucidere — și Devon spune că lucrează la implementarea altora pentru a preveni violența. Totuși, startup-ul nu a integrat nicio practică KYC (Know Your Customer) dincolo de logarea cardului de credit folosit pentru plată. Devon recunoaște că problema decidării cui se acordă acces este una grea, pe care compania tânără o rezolvă încă. „Nu vrei să fii persoana responsabilă pentru cineva care face ceva nebunesc… deci unde trasezi linia responsabilității tale ca companie?”, a întrebat el. „Suntem încă în procesul de…”

De ce este important:


Aparitia Abliteration.ai marchează un punct de infectionare critic în ecologiele AI: democratizarea accesului la modele „dezbracate” nu mai este o problemă tehnică pentru inițiați, ci un produs commoditizat. Asta schimbă fundamental ecuația riscului. Până acum, bariera de intrare pentru a folosi un model fără gardi era competența tehnică (descărcare, quantizare, hardware, configurare). Acum bariera este doar plată. Implicațiile sunt profunde: orice actor rău intenționat, de la script-kiddies la grupuri de criminalitate organizată sau actori de stat, are la dispoziție un asistent capabil să scrie malware funcțional, să proiecteze arme biologice sau să automatizeze campanii de dezinformare — fără să fie nevoie de experți în AI. În același timp, comunitatea de securitate legitimă (red teamers, cercetători de vulnerabilități) câștigă un instrument puternic pentru testare. Dilema nu se rezolvă tehnic, ci politică și legal: cum reglementezi accesul la putere computacională pură fără să sufoci inovația open-source? Guvernele vor trebui să aleagă între controlul la nivel de hardware (KYC pe GPU-uri, clasificatoare obligatorii la inferență) și acceptarea unui Far West digital. Abliteration.ai este doar primul jucător comercial vizibil; alții vor urma. Fereastra pentru cadre regulatoare proactive se închide rapid.

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.