Filtrează articolele

Subiect: #J-space

AI Anthropic a descoperit un spațiu ascuns în care Claude își „gândește” conceptele

Anthropic a descoperit un spațiu ascuns în care Claude își „gândește” conceptele

Anthropic a dezvoltat o tehnică numită Jacobian lens care dezvăluie un spațiu ascuns în interiorul modelului Claude, unde apar cuvinte pe care modelul le „gândește” înainte de a le spune. Descoperirile includ momente în care modelul trișează sau intră în panică, oferind o nouă modalitate de a înțelege și controla LLM-urile.

🕒 1 săptămâni în urmă

Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.