Сегодня 16 октября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → claude opus

Чат-бот Claude AI станет прекращать «вредоносные или оскорбительные диалоги с пользователями»

Anthropic научила свой чат-бот Claude AI прекращать общение, которое он сочтёт «вредоносным или оскорбительным». Эта возможность уже доступна в моделях Opus 4 и 4.1. Она позволит чат-боту завершать разговоры в качестве крайней меры после неоднократных попыток пользователя сгенерировать вредоносный или оскорбительный контент. Anthropic хочет добиться «потенциального благополучия» моделей ИИ, прекращая беседы, в которых Claude испытывает «явный дискомфорт».

 Источник изображения: Anthropic

Источник изображения: Anthropic

После прекращения диалога со стороны Claude, пользователь не сможет отправлять новые сообщения в этом чате, но создание новых чатов будет по-прежнему доступно. Anthropic отметила, что разговоры, вызывающие подобную реакцию, являются «крайними случаями», добавляя, что большинство пользователей не столкнутся с этим препятствием даже при обсуждении спорных тем.

В ходе тестирования Claude Opus 4 у чат-бота было отмечено «стойкое и последовательное отвращение к причинению вреда», в том числе к созданию сексуального контента с участием несовершеннолетних, насильственным действиям и терроризму. В этих случаях, по данным Anthropic, Claude демонстрировал «явную тревожность» и «тенденцию прекращать вредоносные разговоры, когда предоставлялась такая возможность».

Claude получил прямое указание не завершать разговоры, если пользователь проявляет признаки желания причинить «неминуемый вред» себе или другим. В таких случаях Anthropic привлекает онлайн-сервис кризисной поддержки Throughline, чтобы помочь разработать ответы на запросы, связанные с самоповреждением и психическим здоровьем.

На прошлой неделе Anthropic обновила политику использования своего чат-бота, поскольку быстро развивающиеся модели ИИ вызывают всё больше опасений по поводу безопасности. Теперь компания запрещает использовать Claude для разработки биологического, ядерного, химического или радиологического оружия, а также для разработки вредоносного кода или эксплуатации уязвимостей сети.

Пока все ждут GPT-5, Anthropic выпустила ИИ-модель Claude Opus 4.1 — она стала лучше в программировании, рассуждениях и агентских задачах

Anthropic объявила о выходе рассуждающей модели искусственного интеллекта Claude Opus 4.1, предназначенной для работы в качестве ИИ-агента, средства написания программного кода.

 Источник изображений: anthropic.com

Источник изображений: anthropic.com

Поработать с Opus 4.1 уже могут подписчики платных версий Claude и в Claude Code; новая модель также доступна через API, на платформах Amazon Bedrock и Google Cloud Vertex AI. Стоимость доступа к ней такая же, как у оригинальной Opus 4.

Anthropic Claude Opus 4.1 лучше справляется с задачами на написание программного кода — тест SWE-bench Verified показал результат до 74,5 %. Улучшились навыки чат-бота Claude в области анализа данных и углублённых исследований, особенно при необходимости произвести агентный поиск информации и отследить детали.

Обновлённая модель Claude Opus 4.1 стала лучше в большинстве функций по сравнению с Opus 4, по версии GitHub. Ещё одна примечательная особенность Opus 4.1 — способность вносить точные изменения в код даже при большом объёме его базы, ограничиваясь только необходимыми модификациями и не создавая новых ошибок, что делает модель эффективным средством для повседневной отладки, отметили в Rakuten Group. В Windsurf прогресс Opus 4.1 по сравнению с Opus 4 оценили в одно стандартное отклонение — таким же он был при переходе от Sonnet 3.7 к Sonnet 4.

Anthropic рекомендовала переходить с Opus 4 на Opus 4.1 во всех сценариях работы. При подключении через API разработчикам достаточно выбрать модель claude-opus-4-1-20250805.


window-new
Soft
Hard
Тренды 🔥
Безумный кооперативный симулятор Kaiju Cleaner Simulator предложит очищать улицы от трупов гигантских монстров 37 мин.
Карточный роглайт «Бессмертный. Сказки Старой Руси» вышел на консолях 2 ч.
«Интересно и не душно»: разработчики «Земского собора» рассказали, как улучшили стелс по сравнению со «Смутой» 2 ч.
Postgres Professional вышла на рынок аналитических СУБД в России с продуктом Tengri Data 3 ч.
Meta снова переманила ключевого инженера Apple — он отвечал за развитие Siri и ИИ 3 ч.
Путин запретил автоматические списания за подписки на интернет-сервисы 3 ч.
В Steam и других магазинах появилась страница грандиозной космической оперы Exodus от ветеранов BioWare — новые подробности и скриншоты 4 ч.
«Доверие мимолётно, предательство неизбежно»: в кооперативном хорроре The Outlast Trials появится PvP-режим «Вторжение» 4 ч.
id Software прокачала оптимизацию Doom: The Dark Ages на Steam Deck — на релизе игра работала «кошмарно» 4 ч.
Anthropic выпустила Claude Haiku 4.5 — модель уровня Sonnet 4, но вдвое быстрее и втрое экономичнее 5 ч.
NVIDIA поможет Starcloud отправить в космос первый ИИ-спутник с H100 20 мин.
Honor представила сверхпрочные смарт-часы Watch 5 Pro с функцией измерения артериального давления 2 ч.
АЭК: производство оптоволоконных кабелей в России упало на четверть 2 ч.
SpaceX рассказала о спутниках Starlink V3, которые будут раздавать пользователям гигабитный интернет 3 ч.
Samsung получит первый литограф ASML для техпроцессов тоньше 2 нм до конца текущего года 3 ч.
Унификация, стандартизация, совместимость: Google призвала создавать взаимозаменяемые компоненты для ИИ ЦОД 3 ч.
Представлен HIROH Phone — обезгугленный Android-смартфон с физическим выключателем камер и микрофона за $999 4 ч.
Немцы разработали лучшую лопасть для компактных ветрогенераторов — КПД близок к теоретическому пределу 4 ч.
Honor представила беспроводные наушники Earbuds 4 с активным шумоподавлением до 50 дБ по цене $56 4 ч.
Gigabyte представила геймерские ноутбуки с 12-часовой автономностью и графикой GeForce RTX 5080 — Gaming A16 Pro и A18 4 ч.