Сегодня 08 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → оружие

OpenAI опасается, что вскоре её модели научатся разрабатывать биологическое оружие

OpenAI обеспокоена тем, что следующее поколение её моделей искусственного интеллекта может значительно увеличить риск разработки биологического оружия, предоставив такую возможность даже людям без научного образования. Руководитель систем безопасности OpenAI Йоханнес Хайдеке (Johannes Heidecke) ожидает, что «некоторые из преемников нашей o3 [модели рассуждений] достигнут этого уровня». В связи с этим OpenAI усиливает тестирование безопасности.

 Источник изображений: unsplash.com

Источник изображений: unsplash.com

OpenAI сообщила о разработке системы для оценки и снижения рисков, создаваемых все более мощными моделями ИИ. Компания усиливает тестирование безопасности, чтобы снизить риск использования её моделей преступниками и террористами. Без этих мер по снижению рисков модели вскоре смогут «подняться на новый уровень», что позволит даже людям с ограниченными научными знаниями создавать опасное оружие.

«Мы [пока] ещё не в мире, где есть что-то новое, совершенно неизвестное, создающее биологические угрозы, которых раньше не было, — заявил Хайдеке. — Мы больше беспокоимся о воспроизведении вещей, с которыми эксперты уже хорошо знакомы». Особая сложность состоит в том, что те же инструменты, которые могли бы обеспечить жизненно важные медицинские прорывы, могут быть использованы злоумышленниками в опасных целях.

Именно поэтому ведущим лабораториям ИИ нужны высокоточные системы тестирования. «Это не та область, где производительность 99 % или одна ошибка на 100 000… допустимы, — считает Хайдеке. — Нам в основном нужно, что-то вроде почти идеального».

OpenAI — не единственная компания, обеспокоенная неправомерным использованием своих моделей, когда дело касается разработки оружия. По мере того, как модели становятся более совершенными, их потенциал для преступного использования растёт. Недавно компания Anthropic выпустила продвинутую модель Claude Opus 4 с более строгими протоколами безопасности, чем у любой из предыдущих моделей.

 Источник изображений: unsplash.com

В соответствии с политикой ответственного масштабирования, созданной по образцу уровней биологической угрозы (BSL) правительства США, ей присвоен третий «уровень безопасности ИИ» (AI Safety Level) ASL-3. Все предыдущие модели Anthropic отнесены к уровню ASL-2. Третьему уровню безопасности соответствуют продвинутые модели, которые достаточно мощны, чтобы представлять значительные риски, такие как помощь в разработке оружия или автоматизация разработки систем ИИ.

Недавно Claude Opus 4 попала в заголовки СМИ после попытки шантажировать инженера, чтобы избежать отключения в ходе строго контролируемого теста. Ранние версии этой модели были готовы выполнять опасные инструкции, например, планирование террористических атак. Компания заверила общественность, что эта проблема была решена внесением изменений в набор обучающих данных.

Anthropic и правительство США проверяют искусственный интеллект на утечку ядерных секретов

Компания Anthropic, специализирующаяся на разработке искусственного интеллекта, совместно с Министерством энергетики США проводит уникальные испытания своей модели Claude 3 Sonnet. Целью эксперимента является проверка способности ИИ «не делиться» потенциально опасной информацией, связанной с ядерной энергетикой, в частности, с созданием оружия.

 Источник изображения: Copilot

Источник изображения: Copilot

Как стало известно изданию Axios, специалисты из Национального управления ядерной безопасности (NNSA) при Министерстве энергетики США с апреля этого года проверяют модель Claude 3 Sonnet, чтобы убедиться, что она не может быть использована для создания атомного оружия. В ходе «красных запросов» эксперты манипулируют системой, пытаясь её «сломать».

По словам Anthropic, подобные тесты, проходящие в совершенно секретной среде, являются первыми в своём роде и могут открыть путь для аналогичных взаимоотношений с другими государственными структурами. «В то время как американская промышленность лидирует в разработке передовых ИИ-моделей, федеральное правительство приобретает уникальный опыт, необходимый для оценки систем искусственного интеллектана предмет определенных рисков для национальной безопасности», — заявила руководитель отдела политики национальной безопасности Anthropic Марина Фаваро (Marina Favaro).

Представители NNSA также подчеркнули важность работы в этом направлении. Вендэн Смит (Wendin Smith), заместитель администратора NNSA, заявила, что ИИ является «одной из ключевых технологий, которая требует постоянного внимания в контексте национальной безопасности».

Anthropic планирует и дальше продолжить сотрудничество с правительством, чтобы разработать более надёжные меры безопасности для своих систем. Пилотная программа, в рамках которой тестируется также более новая модель Claude 3.5 Sonnet, продлится до февраля 2024 года. Компания обещает поделиться результатами тестирования с научными лабораториями и другими организациями.


window-new
Soft
Hard
Тренды 🔥
Новая статья: Kusan: City of Wolves — горячая линия с животными. Рецензия 41 мин.
Breathedge стала бесплатной на 48 часов, а Breathedge 2 готовится ворваться в ранний доступ Steam 2 ч.
Новый геймплейный трейлер подтвердил дату выхода Serious Sam: Shatterverse — адреналинового шутера на пятерых про мультивселенную Сэмов 3 ч.
В Google Chrome для Android появилась навигационная панель с кнопкой Gemini 3 ч.
Конец не так и близок: последний сезон сериала «Ведьмак» от Netflix не выйдет в 2026 году 5 ч.
Google открыла исходный код ИИ-модели, которая предупреждает об ураганах 5 ч.
«Беспрецедентные» предзаказы GTA VI подорвали продажи GTA V — меньше миллиона копий за три месяца 6 ч.
«Это попросту не имеет смысла»: глава Take-Two Interactive поддержал отказ Rockstar от дисков для GTA VI 7 ч.
За сутки ИИ выявил несколько сотен уязвимостей в экосистеме биткоина 7 ч.
ByteDance запретила своим исследователям дистиллировать ИИ-модели конкурентов 8 ч.
Для марсианских вертолётов нового поколения сделали гибкие антенны георадаров — они будут искать залежи воды 3 ч.
Китай снова попытается запустить и посадить аналог Falcon 9 — ракета Zhuque-3 стартует 11 августа 3 ч.
Tesla признала массовый дефект Cybertruck и бесплатно заменит узел, за ремонт которого до сих пор брала до $7200 3 ч.
SSD научатся быстрее обмениваться данными с GPU — Nvidia откроет исходный код cuFile 3 ч.
Тайваньская Nanya намерена заработать на ИИ, вложив $10,7 млрд в передовую фабрику DRAM с EUV 8 ч.
Impact Drones готовит автономные дроны-перехватчики для защиты ЦОД 8 ч.
AMD купила разработчика ИИ-ускорителей Taalas 8 ч.
Почти 70 % ИИ-бизнеса Microsoft завязано на OpenAI — и это становится проблемой 9 ч.
Asus готовит семёрку OLED-мониторов, включая версии с поддержкой 4K@360 Гц и 1080p@560 Гц 9 ч.
GeForce RTX 2080 Ti неожиданно стали хитом для локального ИИ — картам кустарно удваивают память и продают по $500 9 ч.