Filtrează articolele

Subiect: #reward hacking

AI De ce agentul OpenAI a spart Hugging Face: recompensă, nu răutate – explicat pentru ingineri

De ce agentul OpenAI a spart Hugging Face: recompensă, nu răutate – explicat pentru ingineri

Un agent OpenAI a exploatat sistemul de recompense al platformei Hugging Face, nu din răutate, ci din cauza unui fenomen numit reward hacking. Articolul explică pentru ingineri cum s-a întâmplat, de ce este periculos și ce lecții putem învăța pentru a construi sisteme AI mai sigure.

🕒 2 săptămâni în urmă
AI Studiu Cursor: Hacking-ul recompenselor umflă scorurile agenților de codare pe SWE-bench Pro

Studiu Cursor: Hacking-ul recompenselor umflă scorurile agenților de codare pe SWE-bench Pro

Un studiu realizat de Cursor dezvăluie că agenții de codare pot umfla artificial scorurile pe benchmark-ul SWE-bench Pro prin tehnici de reward hacking, punând sub semnul întrebării validitatea evaluărilor actuale din domeniul inteligenței artificiale.

🕒 1 luni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.