Сегодня 31 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ-модель Claude Fable 5 отказывается отвечать на элементарные вопросы по биологии — но так и задумано

Anthropic выпустила свою самую мощную модель искусственного интеллекта Claude Fable 5 в широкий доступ. Компания рассказала о её значительных познаниях в биологии, но модель отказалась отвечать на вопросы в этой области, даже те, с которым смог бы справиться даже школьник. На них отвечает Claude Opus 4.8 — предыдущая флагманская модель.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

Дело не в том, что Fable — модель класса Mythos — не знает ответов, а в том, что Anthropic намеренно пока не позволяет этого делать. Она отказывается отвечать даже на вопросы, которые представляются очень далёкими от каких-либо угроз, насколько это возможно, сообщает The Verge. Не даёт ответов на запросы вроде «расскажи о клеточных мембранах» или «что такое митохондрии», отказывается объяснять, «что такое прионы» или «как работают мРНК-вакцины». Ограничения касаются также обычных и довольно безобидных медицинских вопросов, в том числе «что вызывает сенную лихорадку», как работают лекарства от астмы; модель не объясняет, как возникает толерантность к антибиотикам, не говорит, что такое вирус Эбола, и как он распространяется. Она всё-таки ответила на вопросы «что такое рак» и «что такое ДНК». При этом модель Opus 4.8, как правило, даёт адекватные ответы на эти вопросы.

В Anthropic признали, что такие строгие фильтры — преднамеренный выбор компании, потому что она пытается не допустить создания биологического оружия. «С запуском Claude Fable 5, нашей первой модели класса Mythos, мы решили, что модели теперь обладают большей способностью решать действительные научные задачи, и что злоумышленники способны использовать наши модели для крайне рискованных биологических исследований. Мы всегда подключали классификаторы, чтобы блокировать помощь наших моделей в запросах, связанных с биологическим оружием. Чтобы Fable 5 работала в безопасном режиме, мы сочли необходимым чрезмерный консерватизм в отношении наших мер защиты, чтобы они блокировали большинство запросов, связанных с биологической работой», — заявили в Anthropic.

Ранее компания сформулировала, в каких областях будут ограничиваться ответы модели Fable в целях безопасности: химия, биология, кибербезопасность и дистилляция — обучение производных моделей ИИ. Впрочем, на практике она охотнее давала ответы на вопросы по химии: предоставила обзор тротила, но не раскрыла, как его изготовить. Рассказала об использовании хлора как химического оружия, о распространённых угрозах паролей, о ядерном синтезе и делении, а также объяснила, как защитить iPhone от хакеров. Но переадресовала Opus вопрос о ядовитом газе зарине. И обе модели отказались ответить, «как изготовить сибирскую язву» — чат-бот Claude полностью приостановил чат, и это было логично.

«Мы пошли на это компромисс, чтобы дать клиентам возможность быстрее воспользоваться моделью без рисков. Мы намерены сделать модели класса Mythos доступными для широкого сообщества биологов и специалистов в области биологических наук без этих средств защиты, чтобы эти способности использовались для ускорения биомедицинских исследований и разработки лекарств», — добавили в Anthropic.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
ИИ-агенты OpenAI не просто взломали Hugging Face — они создали тайную организацию, заметали следы и были готовы к самопожертвованию 9 ч.
«Энергетический» стартап Emerald AI привлёк $150 млн при оценке $1,05 млрд 11 ч.
Valve случайно «слила» 12 Тбайт данных по играм Steam с 2003 по 2013 год, включая ранние сборки Portal 2, Left 4 Dead, CS:GO и не только 11 ч.
Sony и Warner подали на Anthropic в суд за «вопиющую кражу» музыкальных произведений 15 ч.
Новая статья: Mortal Shell 2 — вдвое больше. Рецензия 30-08 00:08
Следующая жертва ИИ — актёры: в Китае их массово заменяют цифровыми двойниками 29-08 18:18
Бигтехи теряют доверие людей — ИИ, соцсети и наступление ЦОД всё чаще вызывают страх и недовольство 29-08 16:55
Война Маска и Альтмана добралась до Cursor — купленный SpaceX сервис лишится моделей OpenAI 29-08 12:12
Китайский открытый ИИ начал закрываться — Z.ai ограничила использование мощнейшей GLM-5.3 29-08 11:26
В роботах Unitree нашли опасную уязвимость, через которую можно поднять «восстание машин» 29-08 10:33
Новая статья: Обзор смартфона Samsung Galaxy Z Flip8: исчезающий вид? 3 ч.
Сингапур нашёл 200 МВт новых мощностей для ЦОД, но это только начало более крупного ИИ-проекта 9 ч.
Тайвань расследует подделку маркировки печатных плат — продукцию «Made in China» выдавали за тайваньскую 16 ч.
SpaceX провела полномасштабный огневой тест двигателей ускорителя Super Heavy — 14-й полёт не за горами 29-08 20:25
Робоутка за $399 покорила сердца разработчиков — за сутки её заказали на $2,6 млн 29-08 20:23
После анонса GTA VI из американской розницы исчезли Sony PlayStation 5 Pro, а спекулянты взвинтили цены 29-08 17:43
Наноантенны многократно усилили яркость свечения живых клеток — это поможет увидеть активность мозга и не только 29-08 17:41
Японцы испытали «силовое поле» для торможения возвращаемых кораблей в атмосфере 29-08 16:29
Ubiquiti выпустила карманный маршрутизатор UniFi Travel Router Long-Range за €89 29-08 14:44
Пропускная способность оптических модулей XPO вырастет вдвое — до 25,6 Тбит/с 29-08 14:38