Попытки внедрить «цифровые отпечатки» в контент, созданный нейросетью, могут столкнуться с суровой реальностью человеческого редактирования. Об этом в эфире «Радио РБК» предупредил Илья Петухов, отвечающий за развитие AI-продуктов в компании Directum.
Поводом для дискуссии стала новость о том, что компания Anthropic начала внедрять в свои тексты невидимые водяные знаки. Однако эксперт сомневается в эффективности такой защиты. По словам Петухова, если человек решит серьезно переработать полученный от языковой модели материал, любые скрытые метки просто исчезнут.
Полностью переделав контент, водяные знаки теряют свой вес, — пояснил специалист. — Частиц маркировки в таком случае просто не останется.
Безусловно, новая технология позволяет идентифицировать конкретные фрагменты, написанные моделью Claude. Но здесь есть важная ловушка: наличие метки в одном абзаце не является доказательством того, что весь документ был полностью сгенерирован нейросетью.
Напомним, что Claude — это семейство мощных языковых моделей от Anthropic, которые славятся своим умением работать с текстом: от выстраивания структуры статьи с нуля до адаптации сложных инструкций под нужную аудиторию.
Разработчики из Anthropic подчеркивают, что их невидимая маркировка не портит читаемость и не меняет смысл материала. Более того, компания заявляет, что знаки сохраняются даже при обычном копировании текста. При этом охват технологии глобален — она работает по всему миру, включая использование Claude через сторонних облачных провайдеров. В планах Anthropic также есть предоставление специальных инструментов сторонним разработчикам, чтобы те могли самостоятельно распознавать эти цифровые следы. Тем не менее, вопрос о том, выстоит ли эта защита перед лицом профессионального редактора, остается открытым.

