Попытки внедрить скрытые «водяные знаки» в контент, созданный нейросетью, могут оказаться бессильными перед лицом человеческого редактирования. К такому выводу пришел Илья Петухов, занимающий пост руководителя проектов по развитию AI-продуктов и решений в компании Directum, в своем недавнем выступлении на «Радио РБК».
Поводом для дискуссии стала новость о том, что компания Anthropic начала внедрять невидимую маркировку в тексты, генерируемые их семейством моделей Claude. Однако эксперт сомневается в эффективности этой меры. По словам Петухова, если человек берет за основу материал от языковой модели и подвергает его глубокой переработке, «водяные знаки» попросту исчезают, теряя всякий смысл.
Речь идет о том, что маркировка способна лишь подтвердить: конкретный фрагмент текста был сгенерирован Claude. Но она не способна вынести вердикт всему документу целиком. Это создает серьезную проблему для верификации контента.
Напомним, что Claude AI — это мощная линейка языковых моделей от Anthropic, которая славится своими способными к работе с текстом. Эти модели незаменимы, когда нужно выстроить структуру статьи с чистого листа, адаптировать сложный технический язык под широкую аудиторию или создать качественные описания услуг.
Сами разработчики из Anthropic подчеркивают: их инновационные «водяные знаки» незаметны для глаза, не портят читаемость и не искажают смысл материала. Более того, компания заявляет, что метка сохраняется даже при копировании и вставке текста, а в некоторых случаях может оставаться и после правок. Технология охватывает использование Claude по всему миру, включая работу через сторонних облачных провайдеров. Чтобы сделать процесс проверки прозрачным, Anthropic также намерена предоставить внешним организациям специальные инструменты для поиска этой скрытой маркировки. Тем не менее, вопрос о том, сможет ли эта защита устоять перед полноценным рерайтом, остается открытым.

