Anthropic a descoperit un spațiu intern ascuns în modelele sale AI, numit spațiul J, plin de cuvinte care nu apar în rezultate, dar care influențează raționamentul. Redactorul senior Will Douglas Heaven explică implicațiile și limitele acestei descoperiri.
Goodfire lansează Silico, un instrument de interpretabilitate mecanică care permite cercetătorilor să privească în interiorul modelelor AI și să le ajusteze parametrii, transformând construirea acestora dintr-un proces alchimic într-o inginerie de precizie.
Acest site folosește cookie-uri pentru a-ți oferi o experiență de navigare cât mai plăcută. Continuarea navigării implică acceptarea acestora.