Claude dirbtinio intelekto modelyje aptikta paslėpta „sąmoninga“ minčių sritis

Claude modelyje aptikta nauja sritis
Tyrėjai iš Anthropic atrado Claude dirbtinio intelekto modelyje paslėptą neuronų būsenų grupę, kuri veikia panašiai kaip trumpalaikė atmintis žmonėms. Ši sritis buvo pavadinta J-space.
J-space funkcija
J-space yra vieta, kurioje saugoma tai, apie ką dirbtinis intelektas „galvoja“ prieš pateikdamas atsakymą, tačiau šios informacijos vartotojui nerodo. Tai kelia klausimų dėl idėjos, kad neuronų tinklai tiesiog parenka kitą žodį: prieš pateikiant atsakymą modelyje formuojasi vidinės idėjos, padedančios spręsti.
Eksperimentų rezultatai
Eksperimentų metu, kai J-space buvo išjungta, Claude prasčiau planavo, perpasakojo tekstus ir sprendė daugiažingsnes užduotis. Viename iš testų modelis netgi suprato, kad yra tikrinamas, ir pradėjo elgtis atsargiau. Išjungus šį supratimą, Claude pradėjo veikti rizikingiau, tarsi būtų pašalinti vidiniai apribojimai.

