Водяные знаки в ИИ-контенте признаны неэффективными
Евросоюз обязал разработчиков ИИ внедрять незаметные метки в контент, указывающие на его нейросетевое происхождение. Это должно помочь в борьбе с дезинформацией и повысить прозрачность технологий. Нововведение вступило в силу 2 августа. ChatGPT уже маркирует изображения и аудио, а вскоре планирует добавить текстовую маркировку. Anthropic также анонсировала, что новые версии Claude будут включать водяные знаки в генерируемые тексты. Об этом пишет сайт Наука.
Однако эксперты, опрошенные New Scientist, выражают сомнения по поводу эффективности этой меры. Главная причина — возможность легкого удаления таких меток из текста, в отличие от видео и изображений. Один из методов маркировки текста заключается в использовании математически обнаруживаемых закономерностей в выборе слов. Большие языковые модели формируют предложения, подставляя наиболее вероятные слова. Если немного изменить этот выбор, текст сохраняет смысл, но становится менее заметным.
Согласно «Акту об ИИ», компании должны предоставлять инструменты для выявления таких закономерностей, чтобы любой мог определить, что текст создан нейросетью. Инженер Джеймс Падолси из NOPE считает, что такие паттерны легко разрушить даже минимальной правкой. Он утверждает, что это бесполезно, и люди будут пытаться обойти систему. В качестве примера он приводит свой онлайн-инструмент declaude, который изменяет текст так, что он перестает распознаваться детекторами.
Кроме того, всегда будут доступны открытые ИИ-модели, не подчиняющиеся правилам ЕС, что позволит злоумышленникам генерировать контент без ограничений. Специалист подчеркивает, что такие модели могут быть дешевле и проще в использовании.
Другие эксперты выражают опасения по поводу ложных срабатываний, когда текст ошибочно принимается за продукт ИИ. Психолог Питер Скарф из Редингского университета отмечает, что существующие системы для выявления плагиата не всегда точны и могут вводить в заблуждение. Он подчеркивает, что водяные знаки не решат проблемы, с которыми сталкиваются преподаватели.
Тем не менее, некоторые специалисты, такие как Эрман Айдей из Университета Кейс Вестерн Резерв, считают, что водяные знаки могут создать определенные препятствия для злоумышленников, замедляя массовое создание дезинформации в соцсетях. Разработчикам предоставлен переходный период, и к 2 декабря все модели должны соответствовать требованиям о внедрении водяных знаков в тексты.



