Сегодня 18 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → водяные знаки

Anthropic объяснила, как Claude будет незаметно помечать тексты, написанные ИИ

На этой неделе Anthropic объявила, что будущие модели Claude будут незаметно добавлять в генерируемые тексты специальные «водяные знаки». Они сохранятся при копировании и вставке текста, а в некоторых случаях могут пережить даже его редактирование. Теперь разработчики подробнее рассказали, как работает эта технология и повлияет ли она на ответы ИИ-помощника.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

В Anthropic объяснили, что «водяные знаки» позволят определить вероятность того, что Claude участвовал в написании текста. Компания также отметила, что вместе с другими крупными разработчиками ИИ внедряет эту технологию для соблюдения требований Закона об искусственном интеллекте Евросоюза.

По словам Anthropic, технология не окажет заметного влияния на качество и содержание ответов Claude. Текст с «водяным знаком» не будет отличаться от обычного визуально, при этом в него не добавляются скрытые символы или другие дополнительные данные. Водяные знаки также не потребуют дополнительных токенов, поэтому их использование не приведёт к росту стоимости запросов.

Anthropic описывает технологию как изменение малозначимых решений при выборе слов. Языковая модель и без того выбирает между несколькими близкими по смыслу вариантами, а система водяных знаков изменяет источник случайности таким образом, чтобы в тексте формировался статистически проверяемый паттерн. Его невозможно обнаружить визуально, но специальный инструмент с соответствующим ключом сможет оценить вероятность того, что текст был сгенерирован Claude.

Эффективность технологии зависит от объёма текста. На длинных фрагментах водяной знак обнаружить проще, тогда как в коротких текстах и фактических отрывках возможностей для статистического анализа меньше. Если Claude лишь редактирует написанный человеком текст, метка может практически исчезнуть. В программном коде она также работает хуже, поскольку там выбор формулировок сильнее ограничен требованиями к синтаксису и результату.

При этом «водяные знаки» не содержат идентифицирующей информации и не позволяют установить, кто именно пользовался Claude, какая организация это делала или в каком чате был создан текст. Они будут характерны для моделей Claude и предназначены прежде всего для того, чтобы сторонние инструменты могли оценивать вероятность участия ИИ в создании текста. Для обычного пользователя практически ничего не изменится: Claude продолжит генерировать и редактировать текст так же, как раньше. Отличить текст с водяным знаком от обычного на глаз будет невозможно, а для его обнаружения потребуется специальный инструмент.

Пользователи отказываются от Anthropic Claude из-за появления «водяных знаков» в генерируемом тексте

На этой неделе Anthropic объявила о намерении начать внедрение в некоторые версии помощника с искусственным интеллектом Claude «незаметные водяные знаки». Они будут добавляться в тексты ответов, сохраняясь при копировании и вставке, а в отдельных случаях и при редактировании.

 Источник изображений: anthropic.com

Источник изображений: anthropic.com

Маркировка не повлияет на смысл, качество или читаемость ответов Claude, заверили в Anthropic, но потребители десятками стали сообщать в соцсетях об отмене платных подписок на Claude из-за этой инициативы. Людей отвратила перспектива постоянного присутствия водяных знаков в их работе, они опасаются, что при взаимодействии с клиентами и написании кода использование ими ИИ станет очевидным. О том, какое влияние исход пользователей может оказать на Anthropic, говорить ещё рано, но отрицательная реакция на новую инициативу пока не имеет признаков замедления. Тенденции к увеличения числа отмен подписок с момента анонса не наблюдается, заверили в компании издание Business Insider.

Один из пользователей, который отменил свою подписку на тариф Claude Max с ценником от $100 в месяц, обращался к ИИ-помощнику за написанием приложений и прочих инструментов. Его беспокоит возможность того, что водяной знак появится даже в том случае, когда текст был оригинальным, а Claude использовался только для перевода, исправления академических цитат или создания сводок. Водяной знак грозит проблемами в академической и профессиональной среде, где действуют строгие правила в отношении ИИ. Отказавшись от услуг Anthropic, этот клиент выбрал Cursor и Grok 4.6 для написания кода и Grok Bot — для рабочих и личных задач.

Другой отменивший платную подписку пользователь рассказал, что обращается к ИИ за проверкой кода и переводом, и он опасается, что ИИ-маркировка будет присутствовать в отправляемом клиентам коде, что грозит вопросами об авторстве и штрафными санкциями по договорам. Этот пользователь сделал выбор в пользу китайских поставщиков ИИ. Третий рассказал, что использует Claude для создания документации для бизнеса — он опасается присутствия маркировки в текстах, исходный материал к которым он составлял сам, а чат-бот только редактировал его.

Четвёртый пользователь, который отменил подписку, работает инженером-программистом — он отменил подписку на Claude Max ещё в июле. Качество сервиса на платформе, по его мнению, снизилось, доступ к лучшим моделям стал ограничен, и появились более надёжные альтернативы. Инцидент с водяными знаками лишь подтвердил правильность его решения: он не хотел бы, чтобы подготовленный им как профессионалом код вызвал вопросы об авторстве, соответствии требованиям или политике клиентов.

Среди положительных сторон появления водяных знаков отмечаются прозрачность в вопросах происхождения контента — в наши дни он всё чаще генерируется ИИ. Аудитория, говорят эксперты, имеет право знать, отражает ли опубликованный текст собственные мысли человека. Ещё одно преимущество — защита от обучения одних ИИ моделей на материалах других.

Помимо Anthropic, маркировку ИИ-контента производят Google, которая применяет собственную технологию SynthID, и ИИ-помощник в соцсети Илона Маска (Elon Musk) X. Маркировка последнего недавно ненадолго появилась в одном из официальных заявлений Белого дома. Anthropic заявила, что добавила водяной знак для соблюдения новых нормативных требований ЕС, и пообещала выпустить бесплатный API для проверки контента на предмет наличия маркировки Claude. Один из теперь уже бывших клиентов компании заявил, что её новая инициатива лишь усилила его опасения по поводу чрезмерной зависимости от Claude. Это характерно для закрытого ПО, признал он — разработчик в любой момент может изменить всё что угодно. Поэтому используемый в работе ИИ не должен зависеть от поставщика.

Учёные придумали невидимые для глаз световые водяные знаки для выявления дипфейков

Поддельные видео становится всё сложнее выявлять, поэтому исследователи Корнеллского университета представили новую криминалистическую технологию, которая поможет специалистам удостовериться в подлинности видеоматериалов. Метод заключается во встраивании невидимых цифровых водяных знаков непосредственно в световой поток источников освещения, используемых при съёмке — например, на месте преступления.

 Источник изображений: Cornell University

Источник изображений: Cornell University

Концепция «шумокодированного освещения» была представлена 10 августа на конференции SIGGRAPH 2025 аспирантом факультета компьютерных наук Корнеллского университета Питером Майклом (Peter Michael). Впервые этот подход был предложен и разработан доцентом Эйбом Дэвисом (Abe Davis) (на фото слева).

Обычно водяные знаки встраиваются непосредственно в видеофайлы, изменяя мельчайшие элементы изображения для создания скрытого идентификатора. Такие системы достаточно эффективны в контролируемых условиях, но требуют взаимодействия с устройством или платформой, создающей видеоматериал. При использовании несовместимой камеры или программного обеспечения цифровой водяной знак просто не появится.

Разработчики предложили при записи «встраивать» водяной знак непосредственно в световой поток от источников освещения. Это гарантирует, что любая камера — от профессионального оборудования до смартфона — запечатлеет его во время съёмки сцены.

В программируемые источники света, такие как компьютерные мониторы, студийное оборудование или некоторые светодиодные приборы, можно встроить кодированные шаблоны яркости с помощью ПО. Стандартные лампы также можно адаптировать, оснастив их компактным чипом размером примерно с почтовую марку, который плавно меняет интенсивность света в соответствии с секретным кодом.

Встроенный код, разработанный на основе исследований зрительного восприятия человека, состоит из минимальных изменений частоты и яркости освещения, практически незаметных невооружённому глазу и воспринимаемых мозгом как незначительный световой шум. Уникальный код каждого источника света фактически обеспечивает параллельную запись сцены с низким разрешением и временными метками, которые Дэвис называет «видеокодами».

«Когда кто-то манипулирует видео, изменённые фрагменты начинают противоречить тому, что мы видим на этих видеокодах, — пояснил Дэвис. — А если кто-то попытается сгенерировать поддельное видео с помощью ИИ, полученные видеокоды будут выглядеть просто как случайные вариации освещённости».

При анализе видеоматериала специалисты могут обнаружить пропущенные последовательности, вставленные объекты или изменённые сцены. Например, удалённый из интервью фрагмент отобразится как визуальный пробел в восстановленном видеокоде, а сфабрикованные элементы — как сплошные чёрные области. Исследователи показали, что в одной сцене можно использовать до трёх независимых кодов освещения. Такое наложение увеличивает сложность водяного знака и усложняет задачу потенциальных фальсификаторов.

«Даже если злоумышленник знает об этой технике и сможет вычислить коды, его задача всё равно будет значительно сложнее, — добавил Дэвис. — Вместо того чтобы имитировать свет только для одного видео, ему придётся подделывать каждый ролик с кодами отдельно, и все подделки должны будут согласовываться между собой».

Полевые испытания показали эффективность метода в определённых условиях и его стабильную работу при различных оттенках кожи. Исследователи отмечают, что технология шумокодированного освещения — многообещающий шаг вперёд, но не панацея от фейковых видео. По мере развития инструментов генеративного ИИ будут совершенствоваться и методы обхода средств проверки подлинности.

«Раньше видео рассматривалось как источник достоверной информации, но теперь мы не можем быть в этом уверены, — считает Дэвис. — Сегодня можно сгенерировать практически любой ролик. Это интересно, но и проблематично, потому что отличить реальность от подделки становится всё сложнее».

ИИ-модель Google Gemini 2.0 Flash оказалась на удивление хороша в удалении водяных знаков с изображений

Некоторые новейшие «экспериментальные» функции модели Gemini 2.0 Flash от Google вызывают нешуточные опасения у многих пользователей. В частности, модель показала «очень качественные» результаты при удалении водяных знаков с изображений.

 Источник изображений: Google

Источник изображений: Google

Gemini 2.0 Flash умеет не только генерировать изображения по текстовому запросу, но и редактировать их в соответствии с указаниями пользователя — примеры опубликованы на Reddit. На днях обнаружилось, что модель с высокой точностью может удалять водяные знаки. Это поведение радикально отличается от модели GPT-4o от OpenAI, которая запросы на удаление водяных знаков отклоняет.

Ранее уже существовали такие инструменты, как Watermark Remover.io, который умеет удалять водяные знаки со стоковых фотографий, а исследовательская группа Google создала в 2017 году подобный алгоритм, чтобы подчеркнуть необходимость более надёжной защиты авторских прав на изображения.

Gemini 2.0 Flash, похоже, лучше всех проявила себя при удалении сложных водяных знаков, такие как штампы Getty Images, и смогла качественно восстановить изображение. Конечно, после удаления водяного знака модель добавляет метку SynthID, фактически заменяя знак авторского права на «отредактировано с помощью ИИ». Но метки ИИ довольно легко удаляются при помощи другого ИИ, что ранее было продемонстрировано инструментом стирания объектов от Samsung.

По сообщениям пользователей, облегчённая Gemini 2.0 Flash также умеет добавлять узнаваемые изображения реальных людей на фотографии, чего не позволяет полная модель Gemini.

На данный момент описанные возможности доступны только разработчикам через AI Studio — общедоступный бот Gemini отказывается убирать защитные знаки, как показано на скриншоте выше. Google не ответила на запросы о наличии защиты от возможных злоупотреблений после выхода модели в открытый доступ.

Google начнёт помечать фотографии пользователей, в которые «вмешался» ИИ

Приложение «Google Фото» начнёт использовать цифровые водяные знаки SynthID для фотографий, отредактированных с помощью генеративного искусственного интеллекта (ИИ). По заявлению Google, новая функция предназначена для облегчения идентификации изображений, которые были изменены с помощью инструмента Reimagine в Magic Editor.

 Источник изображений: Google

Источник изображений: Google

Magic Editor позволяет легко редактировать фотографии через текстовые запросы, добавляя или удаляя различные детали. Хотя сами по себе ИИ-инструменты не представляют угрозы, Magic Editor может создавать неправомерные компиляции, например разбившиеся вертолёты, сцены аварий, причём без явных меток, указывающих на то, что изображение было изменено.

Водяные знаки призваны решить эту проблему. Однако SynthID визуально не изменяет изображение и чтобы понять, что оно было отредактировано ИИ, придётся дополнительно использовать функцию проверки «Об изображении». Более того, Google признаёт, что некоторые небольшие изменения, выполненные через Magic Editor, могут быть настолько незначительными, что SynthID не сможет идентифицировать эти изменения и применить маркировку.

Эксперты отмечают, что хотя водяные знаки могут помочь в идентификации компиляций, этой технологии недостаточно для масштабной проверки контента, созданного нейросетями. Для надёжности потребуется использовать целый комплекс подходов и программных средств.

Отметим, что система водяных знаков используется в нейросети Google Imagen AI, которая генерирует изображения на основе текста. Аналогичные инструменты были разработаны и другими компаниями, например, функция Content Credentials компании Adobe защищает от несанкционированного доступа к метаданным и позволяет авторам добавлять информацию о себе.

Технология SynthID была разработана командой DeepMind и представляет собой цифровой метатег, встроенный в изображения, видео, аудио или текст. Этот тег позволяет идентифицировать, были ли файлы созданы или изменены с помощью ИИ.


window-new
Soft
Hard
Тренды 🔥
Календарь релизов — 17–23 августа: Mortal Shell II, Brigador Killers и Steins;Gate: Re:Boot 3 ч.
«Эта игра будет невероятной»: финальный трейлер тактической стратегии Star Wars Zero Company от ветеранов XCOM заинтриговал фанатов 5 ч.
В открытый доступ попал геймплей Star Wars: Magellan — отменённого мультиплеерного боевика от ветеранов Diablo 7 ч.
У GitHub произошёл глобальный сбой — половина запросов оборачивается ошибкой 8 ч.
Проверенный инсайдер рассекретил дату выхода и наполнение Diablo IV для Nintendo Switch 2 8 ч.
В Firefox для iPhone появился встроенный блокировщик рекламы, но блокирует он не всё 8 ч.
Geekom случайно раздавала вредоносное ПО вместе с драйвером для мини-ПК — компания извинилась перед пользователями 8 ч.
«Ещё одна причина жить дальше»: культовое психоделическое приключение Sally Face спустя 10 лет получит продолжение 9 ч.
Ubuntu на Windows растёт быстрее, чем на Linux 12 ч.
«Яндексу» приписали создание тестов на традиционные ценности для ИИ 14 ч.
Lexar выпустила Thor Ultra — SSD с PCIe 5.0, до 4 Тбайт и скоростью до 11 Гбайт/с 3 ч.
В Нидерландах запустили беспилотный автобус — он возит людей бесплатно и без водителя 3 ч.
Новая статья: ИИ, который всегда с тобой 3 ч.
Концепция европейского ИИ-суверенитета Mistral AI включает создание 1 ГВт мощностей и… китайские LLM 10 ч.
AOC перевыпустила 27-дюймовый игровой монитор Agon Pro AG276UZ с круговой поляризацией и режимами 4K@240 Гц и 1080@480 Гц 10 ч.
В России внедрена поддержка полностью кириллических адресов электронной почты в доменах .RU и .РФ 11 ч.
Бигтехи потратят на ИИ на $3 трлн больше, чем говорят — большая часть расходов скрыта за балансом 12 ч.
Lenovo сообщила о рекордных результатах первого финансового квартала 13 ч.
Intel неожиданно привлекла до $23 млрд — аналитики увидели признаки успеха её контрактного бизнеса 14 ч.
CoreWeave продлила использование NVIDIA A100 до 2029 года 14 ч.