Microsoft опубликовала предварительную версию кодекса, устанавливающего ряд ограничений для будущих ИИ-моделей компании. Это произошло через несколько дней после того, как OpenAI и Anthropic признали необходимость замедлить разработку передовых алгоритмов. Софтверный гигант стремится к тому, чтобы его воспринимали как ответственного игрока в сфере ИИ, где Microsoft является одним из крупных поставщиков облачных услуг.

«Мы получили отзывы от людей, которые хотели видеть ещё более явное обязательство того, что ИИ всегда работает на благо людей и не пытается заменить их. Мы увидели много отзывов о том, что ИИ не должен создавать зависимость, не должен льстить, что он всегда должен способствовать суждениям человека, автономии человека и свободе воли», — заявил глава ИИ-подразделения Microsoft Мустафа Сулейман (Mustafa Suleyman). Он также добавил, что Microsoft решила опубликовать предварительную версию кодекса именно сейчас из-за обострения дискуссии по поводу безопасности ИИ, но на деле эти рекомендации готовились около пяти месяцев.
Отраслевые специалисты и представители общественности стали более открыто выражать опасения по мере того, как ИИ-алгоритмы становятся всё более продвинутыми. Так на прошлой неделе исследователь из Anthropic Джейкоб Коксон (Jacob Coxon) ушёл в отставку, заявив, что его компания вместе с OpenAI «мчатся прямо к самосовершенствующемуся сверхразуму и играют с нашими жизнями».
Лидеры отрасли отреагировали на это. На выходных гендиректор Anthropic Дарио Амодеи (Dario Amodei) заявил, что недавний инцидент со взломом платформы Hugging Face вышедшими из-под контроля ИИ-агентами OpenAI отчасти убедил его в необходимости замедления темпов совершенствования нейросетей. Гендиректор OpenAI Сэм Альтман (Sam Altman) выразил поддержку в этом вопросе, а гендиректор SpaceX Илон Маск (Elon Musk) написал в соцсети X «Дарио прав». Позднее гендиректор Microsoft Сатья Наделла (Satya Nadella) заявил, что его компания поддерживает сосредоточенность и продуманный темп исследований. Американские законодатели также призвали к созданию более серьёзных гарантий безопасности в сфере ИИ.
Источник изображения: BoliviaInteligente/unsplash.com
Согласно опубликованному Microsoft кодексу, ИИ-модели не должны отвечать на вопросы, связанные с производством оружия, помогать в приобретении опасных веществ, поощрять нездоровое питание, а также генерировать контент насильственного или откровенно сексуального характера. ИИ-модели Microsoft должны следовать целям людей и избегать создания собственных целей. Они также не должны пытаться скрывать собственно неподобающее поведение.
«Модели Microsoft не будут вмешиваться в цепочки рассуждений или код, а также искажать или скрывать свои рассуждения или следы действий. Они не общаются на языке нейросетей или с помощью каких-либо иных форм, выходящих за рамки простого человеческого понимания ни в цепочке своих рассуждений, ни с другими агентами или ИИ-системами», — говорится в документе Microsoft.
В дополнение к этому софтверный гигант планирует разработать правила, которые могли бы предотвратить кибератаки, подобные той, что осуществили ИИ-агенты OpenAI в отношении платформы Hugging Face. При составлении кодекса поведения Microsoft собирала фокус-группы, консультировалась с экспертами в области права, этики, лингвистики и философии. Публикуя предварительную версию документа, Microsoft стремится получить обратную связь перед утверждением окончательной версии кодекса, который будет регламентировать разработку ИИ-систем начиная с 2027 года.