ChatGPT начнёт помечать свои тексты невидимыми водяными знаками — как их обходить?

ChatGPT начнёт помечать свои тексты невидимыми водяными знаками — как их обходить?

Aleksandr Manin

OpenAI рассказала, как будет выполнять требования европейского Закона об искусственном интеллекте (AI Act). В ближайшие недели тексты, которые ChatGPT и Codex генерируют для пользователей из Евросоюза, начнут получать невидимые водяные знаки, причём на всех тарифах. Делать маркировку глобальной по умолчанию компания пока не стала: «Такой региональный подход позволяет нам учиться на реальном опыте использования и учитывать отзывы».

ChatGPT начнёт помечать свои тексты невидимыми водяными знаками — как их обходить?

Клиенты API по всему миру уже с 5 октября могут сами включать метки для отдельных моделей, но по умолчанию функция там выключена. Технология называется textGrain: она встраивает невидимый статистический сигнал в то, как модель подбирает слова, а специальный детектор ищет этот сигнал в тексте. На качестве ответов, по данным компании, метки не сказываются, а позже OpenAI обещает открыть исходный код технологии.

OpenAI уверяет, что textGrain не уступает другим решениям, включая SynthID от Google, но признаёт, что надёжность в реальных условиях не гарантирована. При целевой доле ложных срабатываний в 1% детектор находил метку примерно в 80% текстов длиной 200 токенов и в 95% текстов длиной 400 токенов — и это на темах вроде психологии. В математике, где свободы в выборе слов меньше, результаты заметно хуже.

Ослабить метку можно и обычной правкой. В тестах на текстах длиной 400 токенов замена синонимами 10% слов снизила долю обнаружений с 92% до 66%, а замена четверти слов — до 17%. Поэтому доступ к детектору поначалу получат только одобренные исследователи и профильные организации, широкой публике его не откроют.

OpenAI отдельно подчёркивает, что метка не указывает на пользователя, не раскрывает его запросы и переписку и ничего не говорит о достоверности текста. А её отсутствие не доказывает, что текст написал человек: он мог оказаться слишком коротким, отредактированным или переведённым.

Статья 50 Закона об ИИ требует, чтобы созданный генеративными моделями текст можно было распознать машинным способом. Компании, которые работали на европейском рынке и раньше, должны выполнить это требование до 2 декабря — оно касается и Google, Meta и Microsoft, а Anthropic начала маркировать тексты Claude ещё в этом году.

Как думаете, водяные знаки на текстах ИИ вообще имеют смысл, если их так легко ослабить? Пишите в комментариях.

😐 Netflix повторил жестокий эксперимент над людьми — и всё ради веселья
    0
    Об авторе
    Комментарии0