У ИИ Claude нашли внутреннее пространство для мыслей
О как🤔
У ИИ нашли личное пространство, которое он создал для себя сам
Anthropic сообщила, что у модели Claude обнаружили особую внутреннюю область, где возникают идеи до того, как они превращаются в слова. Эту зону назвали J-пространством — по имени математического метода, который помог ее выявить.
По сути, это что-то вроде кратковременной памяти: модель «держит там в уме» промежуточные шаги, пока решает задачу. Разработчики считают, что в этом есть отдаленное сходство с человеческим мышлением. Но, подчеркивают они, речь не идет о сознании.
Эксперименты показали, что Claude может активировать в этой зоне мысли, не связанные с текущим ответом. Например, модель просили думать о мосте Золотые Ворота, пока она переписывала постороннюю фразу, — и внутри действительно появлялись связанные понятия вроде «мост» и «Калифорния».
Когда J-пространство пытались отключить, качество работы модели заметно падало. Более того, Claude, похоже, способен в какой-то мере «понимать», что его изучают изнутри: без этой возможности он хуже проходил этические тесты.
Как пишут в Anthropic, теперь исследователи могут видеть, о чем ИИ «думает», даже если он этого не говорит.