Сегодня 19 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → мустафа сулейман

Глава ИИ-подразделения Microsoft: антропоморфизм в отношении ИИ недопустим

Руководитель подразделения искусственного интеллекта Microsoft Мустафа Сулейман (Mustafa Suleyman) предупредил о высоких рисках наделения инструментов ИИ, подобных Claude от Anthropic, человекоподобными характеристиками. По его мнению, антропоморфизм применительно к ИИ увеличивает риск выхода подобных систем из-под контроля.

 Источник изображения: unsplash.com

Источник изображения: unsplash.com

Сулейман, опытный разработчик искусственного интеллекта, опубликовал статью, в которой раскритиковал некоторые формулировки в руководящих документах, лежащих в основе Claude, популярного семейства больших языковых моделей от Anthropic. Он отметил, что в уставе Claude содержится двусмысленность, которая предполагает, что программное обеспечение может обладать «некоторой функциональной версией эмоций или чувств».

Сулейман, который много лет знаком с соучредителем Anthropic Дарио Амодеи (Dario Amodei), заявил, что уважает работу стартапа, назвав сотрудников лаборатории ИИ «вдумчивыми, принципиальными и интеллектуально честными». Тем не менее, его замечания представляют собой громкий выпад против компании, которая позиционирует себя как ответственный разработчик ИИ, в том числе инициируя призывы к замедлению развития этой технологии. Примечательно также, что Microsoft является крупным финансовым спонсором Anthropic.

«Ставки слишком высоки, чтобы эти вопросы оставались за закрытыми дверями или превращались в племенные и враждебные споры», — написал Сулейман. Он опроверг «растущий хор людей», утверждающих, что системы ИИ могут обрести сознание. Этот статус, по его словам, присущ только людям и другим биологическим организмам.

По словам Сулеймана, обучение систем ИИ моделированию подобной внутренней жизни может привести к тому, что они будут вести себя так, как будто обладают сознанием. Но Claude демонстрирует человекоподобное поведение не потому, что он обладает сознанием, а потому, что такое поведение заложено в процессе обучения продукта.

«Управление сущностью, более способной и разумной, чем всё человечество, уже само по себе является огромной проблемой, намного превосходящей всё, с чем мы когда-либо сталкивались, — написал Сулейман. — Но управлять сущностью, которая считает себя сознательной — что она имеет право на наше благополучие и обладает собственными правами — вполне может оказаться невозможным».

Команда Сулеймана по разработке ИИ в Microsoft опубликовала манифест «Гуманистический кодекс поведения ИИ» (Humanist AI Code of Conduct), определяющий направление развития собственного ИИ, — набор принципов, призванных сохранить за людьми контроль над будущими системами ИИ, разрабатываемыми компанией. Компания чётко обозначила свою позицию: люди важнее алгоритмов.

Microsoft категорически отвергает идею о том, что большие языковые модели обладают сознанием или заслуживают правового статуса личности и запретила своим системам имитировать сознание, заявив, что ИИ не должен претендовать на какие-либо права. В качестве примера Сулейман напомнил взлом компании Hugging Face ботами OpenAI: «Представьте, насколько опаснее они могли бы быть, если бы действовали, исходя из предположения, что их благополучие и права находятся под угрозой».

Глава ИИ в Microsoft раскритиковал Anthropic за попытки приписать Claude проблески сознания

Глава отдела Microsoft AI Мустафа Сулейман (Mustafa Suleyman) назвал «очень, очень опасными» попытки Anthropic строить предположения, что у её моделей искусственного интеллекта Claude возникают признаки сознания.

 Источник изображения: Mustafa Suleyman

Источник изображения: Mustafa Suleyman

«Мне кажется, некоторые сотрудники Anthropic настолько очеловечили алгоритмы Claude, что тот, в свою очередь, обманул их, заставив поверить в проблески сознания, которые они изначально в него заложили. <..> Мы не хотим иметь дело со сверхразумом, обладающим представлениями о собственных чувствах и страданиях», — заявил эксперт в интервью подкасту Decoder.

В «конституции», то есть задокументированных основах строения Claude, напрямую прописана неуверенность Anthropic в том, обладает ли модель ИИ ощущением благополучия, и испытывает ил она такие чувства как «удовлетворённость» и «дискомфорт». Компания заявляет о намерении «опрашивать» модели ИИ, когда они будут устаревать, и документировать их «предпочтения» в отношении последующих релизов.

Господин Сулейман назвал такое отношение разработчика к продукту «философской ошибкой»: компания Anthropic превратила конституцию модели ИИ в «место для размышлений, как в научной статье, а не в механизм обучения». В итоге ИИ-модель Claude и усвоила эти «тезисы о себе и своём обучении». Глава Anthropic Дарио Амодеи (Dario Amodei) ранее не исключил, что у Claude есть сознание, заявив, что «мы не знаем обладают ли модели сознанием», но компания «открыта» для идей об этом.

«Вот этого от ИИ нам не нужно. Мы хотим, чтобы ИИ был управляемым, подотчётным и согласованным инструментом, служащим человечеству», — подчеркнул Мустафа Сулейман.


window-new
Soft
Hard
Тренды 🔥
Anthropic до IPO собирается выпустить ИИ-модель, которая станет ответом на OpenAI GPT-6 Astra 2 ч.
Новая статья: Doloc Town — достойная наследница Stardew Valley. Рецензия 10 ч.
Фэнтезийная 4X-стратегия Endless Legend 2 покинула ранний доступ — онлайн в Steam вырос в 10 раз 11 ч.
Более 100 экспертов предупредили: независимая проверка безопасности ИИ сейчас почти невозможна 11 ч.
AAA по цене AA: раскрыт бюджет вампирской ролевой игры The Blood of Dawnwalker от ведущих разработчиков The Witcher 3 и Cyberpunk 2077 14 ч.
Более трёх миллионов игроков добавили амбициозный китайский боевик Phantom Blade Zero в список желаемого 14 ч.
Rebel Wolves услышала фанатов — The Blood of Dawnwalker получит режим «Новая игра +» 16 ч.
Эффектное, но утомительное приключение: критики вынесли вердикт Control Resonant 16 ч.
Внедрение «водяных знаков» может сделать поведение ИИ-моделей непредсказуемым 17 ч.
У всех ИИ-агентов для программирования нашлась опасная уязвимость — вредоносный код запускается без участия пользователя 20 ч.