Будут Ли Водяные Знаки С Искусственным Интеллектом Сохраняться Или Они Просто Для Виду?
Крупнейшие технологические компании внедряют водяные знаки в свои системы искусственного интеллекта, в основном руководствуясь принятым в 2026 году Законом ЕС об искусственном интеллекте мандатом на идентификацию машиночитаемого контента с помощью искусственного интеллекта. Те же водяные знаки быстро обходятся бесплатными онлайн-инструментами, что вызывает споры об их эффективности. Несмотря на то, что эти водяные знаки легко портятся при редактировании или удалении, их цель - создать нормативный "бумажный след" для отчетности, а не служить надежной мерой безопасности. Однако их внедрение уже привело к негативной реакции пользователей и отмене подписки, поскольку некоторые считают их навязчивыми или ненадежными. Эксперты пришли к выводу, что водяные знаки - это нормативное требование по умолчанию, а не окончательная техническая блокировка, которая в большей степени формирует доверие пользователей, чем обеспечивает надежную защиту.
Бесплатный инструмент, который удаляет водяные знаки искусственного интеллекта из текста Клода, появился на GitHub через 24 часа после запуска функции водяных знаков Anthropic. В течение нескольких дней появилось еще несколько, нацеленных на все - от невидимых маркеров в Юникоде до подписанных метаданных, которые Anthropic прикрепляет к сгенерированным файлам. Если водяные знаки искусственного интеллекта можно так легко обойти, они созданы на века или просто для галочки?
Вот вопрос, который стоит задать, поскольку Anthropic, Google, Microsoft, Meta и OpenAI все чаще используют искусственный интеллект для маркировки своих продуктов, и на него есть более полезный ответ, чем "да" или "нет".
Почему водяные знаки искусственного интеллекта внезапно появились повсюду2 августа 2026 года вступила в силу статья 50 Закона Европейского союза об искусственном интеллекте, требующая от компаний, создающих системы искусственного интеллекта, маркировать свою продукцию в машиночитаемом формате, который можно обнаружить. Несоблюдение требований влечет за собой штрафы в размере до 15 миллионов евро или 3% от глобального годового оборота компании, в зависимости от того, что больше. Около 190 организаций, включая Anthropic, Google, Meta, Microsoft и OpenAI, досрочно подписали добровольный Кодекс практики ЕС по обеспечению прозрачности контента, созданного с помощью искусственного интеллекта, который дает подписантам презумпцию соответствия требованиям.
Через девять дней после истечения крайнего срока Anthropic объявила, что Claude внедрит водяные знаки искусственного интеллекта непосредственно в текстовый вывод, невидимый статистический шаблон, а также подписанные метаданные C2PA в сгенерированные файлы, которые будут доступны по всему миру, а не только пользователям из ЕС. Google использует водяные знаки на изображениях, созданных с помощью искусственного интеллекта, с 2023 года и с тех пор распространил их на текст, аудио и видео. Сообщается, что OpenAI несколько лет назад разработала аналогичную систему для создания текстовых водяных знаков, но решила не внедрять ее, опасаясь ложных срабатываний и предоставляя конкурентам возможность отслеживать шаблоны использования ChatGPT.
Почему водяные знаки с искусственным интеллектом так легко ломаютсяТехническая проблема, с которой сталкивается каждая из этих компаний, является асимметричной. Водяной знак с искусственным интеллектом должен выдерживать практически все действия пользователя с текстом или файлом. Злоумышленнику нужен только один метод, который работает.
- Статистические метки ухудшаются при редактировании. В собственной документации Anthropic признается, что корректура, перевод, подробное перефразирование или короткие выходные данные могут привести к тому, что водяной знак в тексте останется незамеченным.
- Removal tools move fast. The GitHub tool that appeared within a day of Anthropic's announcement gained roughly 72 stars a day by running Claude's output through one or two rewrite passes, enough to disrupt about 70% of the token sequences the watermark depends on.
- A detected watermark isn't proof of authorship. Anthropic itself notes a match only shows Claude "may have processed" the content, not that Claude wrote it, an ambiguity platforms and employers are unlikely to account for when treating an AI watermark check as a verdict.
The fragility of AI watermarks hasn’t stopped them from having a real effect on user behavior. Business Insider reported that dozens of users were canceling Claude subscriptions after the watermark rollout, and named several who followed through. An AI consultant told the outlet he canceled because the watermark can appear even on text he wrote and lightly edited himself, not just text Claude generated from scratch. A software engineer said the watermark confirmed a decision to leave he'd already made over other service concerns. A digital agency founder cited a broader worry: building a workflow around a vendor's tools means that vendor can change the terms later, unilaterally.
Anthropic told Business Insider it hasn't seen a measurable increase in cancellations tied to the announcement, and the company reports roughly 300,000 business customers as of last year, a scale at which a few dozen public complaints on X barely register.
Regardless of volume, the backlash is a useful data point regardless of its size. It shows that even an AI watermark easy enough to defeat with a free GitHub tool still changes how some users perceive the product they're paying for. The mark doesn't have to be technically robust to affect trust. It just has to be visible enough, or rumored enough, for people to feel like something changed.
Are AI Watermarks Here To Stay?As a technical guarantee, AI watermarks are close to theater. They don’t hold up to a determined adversary, and Anthropic doesn’t claim they do. But as regulatory infrastructure it’s likely that they’re here to stay, at least in the near term.
Their job at this stage is not to be unbreakable, it is to be the default. The long-term goal is a paper trail for the cases that actually get scrutinized: a dispute, an audit, a lawsuit, where nobody thought to strip the mark first.
Regulators built the underlying framework around that assumption. The EU's Code of Practice calls for a layered approach combining metadata, statistical marking and detection tools, precisely because no single layer was expected to hold on its own.
That's also the pattern digital rights management and other "easily circumvented" provenance systems have followed for two decades: broken within days of release, and still standard practice years later, because the institutional weight sits behind the mark rather than the mark's technical resilience.
What Are The Impacts Of AI Watermarks?For businesses producing or relying on AI-assisted content, three effects follow directly from that reality:
- A new default, and a new tell. AI-generated content now arrives marked unless someone deliberately strips it, which means the absence of an AI watermark starts to look more deliberate over time, the same way scrubbed metadata on a photo reads as more suspicious than a photo that simply never had any.
- Trust erodes faster than the technology does. The Anthropic cancellations show that user perception moves ahead of technical reality. A watermark doesn’t need to work perfectly to cost a vendor goodwill, and it doesn't need to be broken for a customer to feel surveilled by it.
AI watermarks aren’t just for show, but they're not the finished answer either. They were built to be a default, not a lock, and the businesses that treat them as anything more are the ones that will get caught out first.
>
