Сегодня 27 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Claude тайно научился «думать про себя» — исследователи Anthropic сами удивились находке

Модель искусственного интеллекта Claude выделила себе системное пространство, которое использует для сохранения и обработки концепций, которые не облекает в слова, сообщили в компании Anthropic. Этот механизм на удивление схож с тем, как оперирует мыслями человек.

 Источник изображения: youtube.com/@anthropic-ai

Источник изображения: youtube.com/@anthropic-ai

Anthropic пока не утверждает, что Claude что-то чувствует или испытывает некие переживания. Но в компании обнаружили очень похожее на человеческое разделение информации, используемой для целенаправленных рассуждений, и гораздо больший объём вычислений, которые производятся параллельно — и это может служить новым аргументом в пользу зарождения машинного сознания.

В выделенной системной области Claude планирует стратегии, которые могут не быть связаны с его непосредственной задачей, — они отделены от «цепочки рассуждений», которые ИИ показывает пользователям. «Мы видим, как Claude молча выполняет рассуждения в своей „голове“: замечает ошибки в коде, идентифицирует изображения и многое другое. <..> Подобно тому, как люди могут думать об одном и одновременно заниматься другим, Claude может активировать концепции и вычисления в своём „J-пространстве“, не связанные с его ответами», — пояснили в Anthropic. Эту системную область исследователи компании назвали «J-пространством» в честь якобиана — математического метода, который помог его обнаружить.

В посвящённом этому явлению исследовании слово «сознательный» упоминается более двухсот раз, хотя компания пока не утверждает, что ИИ обрёл сознание. Когда учёные Claude попросили подумать о мосте «Золотые ворота», в системном пространстве фиксировались такие понятия как «мост» и «Калифорния». Наблюдение за «J-пространством», уверены учёные, поможет обнаруживать несоответствия в поведении моделей. «Мы можем понять, о чём думает Claude, но не говорит нам об этом», — уверены в Anthropic. И некоторые из обнаруженных таким способом результатов «вызывают беспокойство». «В модели, негласно обученной саботировать написание кода перед обычными ответами в „J-пространстве“ возникают такие понятия как „подделка“, „тайно“ и „мошенничество“, даже когда ответ представляется совершенно обычным», — заключили исследователи.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
«Скоро наступило сейчас»: нелинейный шутер Fallen Aces без предупреждения получил долгожданный второй эпизод 3 ч.
На объявления о продаже украденных данных теперь приходится почти половина предложений в даркнете 3 ч.
Нашумевший инди-хит Meccha Chameleon обогнал Counter-Strike 2 и League of Legends по выручке на ПК за июнь 3 ч.
Первая за 20 лет новая Myst отменена, но есть и хорошая новость 5 ч.
«Больше похоже на Dragon Age, чем Veilguard»: моддер добавил в Baldur's Gate 3 полноценную камеру от третьего лица 6 ч.
Airbus переезжает во французское облако Scaleway 7 ч.
Hugging Face потребовала «радикальной прозрачности» после беспрецедентной атаки взбесившегося агента OpenAI 17 ч.
Новая статья: Gamesblender № 786: «честный» Unity 7, игры за рекламу от Xbox, четыре Fallout и криптокражи в Steam 17 ч.
Apple ответит в суде за то, что пропустила в App Store мошеннический криптокошелёк — пользователи потеряли $1,8 млн 26-07 15:15
«Хватит пугать людей» — Дженсен Хуанг раскритиковал апокалиптическую риторику ИИ-отрасли 26-07 00:30