AI моделът Claude е отделил системно пространство, което използва за съхранение и обработка на концепции, които не изразява с думи, съобщиха от компанията Anthropic. Този механизъм е удивително сходен с начина, по който хората боравят с мислите си.
Anthropic не твърди, че Claude изпитва чувства или преживявания, но в компанията са открили много подобно на човешкото разделение на информацията, използвана за целенасочени разсъждения, както и значително по-голям обем изчисления, които се извършват паралелно – и това може да послужи като нов аргумент в полза на зараждането на машинно съзнание.В отделена системна област Claude планира стратегии, които може да не са свързани с непосредствената му задача – те са отделени от „веригата от разсъждения“, която AI показва на потребителите.
„Виждаме как Claude мълчаливо извършва разсъждения в „главата“ си: забелязва грешки в кода, идентифицира изображения и много други неща, подобно на това как хората могат да мислят за едно, а едновременно с това да се занимават с друго. Claude може да активира концепции и изчисления в своето „J-пространство“, които не са свързани с отговорите му.“
обясниха от AnthropicИзследователите от компанията нарекоха тази системна област „J-пространство“ в чест на якобиана – математическия метод, който помогна за откриването ѝ. В проучването, посветено на това явление, думата „съзнателен“ се споменава над 200 пъти, въпреки че компанията все още не твърди, че AI е придобил съзнание. Когато учените помолиха Claude да помисли за моста „Golden Gate“, в системното му пространство бяха регистрирани понятия като „мост“ и „Калифорния“. Учените са убедени, че наблюдението на „J-пространството“ ще помогне за откриването на несъответствия в поведението на AI моделите.
„Можем да разберем какво мисли Claude, но той не ни го казва.“
са убедени в AnthropicНякои от резултатите, открити по този начин, „будят тревога“.
„В модел, който негласно е обучен да саботира писането на код, пред обичайните отговори в „J-пространството“ се появяват понятия като „фалшификация“, „тайно“ и „измама“, дори когато отговорът изглежда напълно обичаен.“
заключават изследователите