ChatGPT начнёт помечать свои тексты невидимыми водяными знаками — как их обходить?
OpenAI рассказала, как будет выполнять требования европейского Закона об искусственном интеллекте (AI Act). В ближайшие недели тексты, которые ChatGPT и Codex генерируют для пользователей из Евросоюза, начнут получать невидимые водяные знаки, причём на всех тарифах. Делать маркировку глобальной по умолчанию компания пока не стала: «Такой региональный подход позволяет нам учиться на реальном опыте использования и учитывать отзывы».
Клиенты API по всему миру уже с 5 октября могут сами включать метки для отдельных моделей, но по умолчанию функция там выключена. Технология называется textGrain: она встраивает невидимый статистический сигнал в то, как модель подбирает слова, а специальный детектор ищет этот сигнал в тексте. На качестве ответов, по данным компании, метки не сказываются, а позже OpenAI обещает открыть исходный код технологии.
OpenAI уверяет, что textGrain не уступает другим решениям, включая SynthID от Google, но признаёт, что надёжность в реальных условиях не гарантирована. При целевой доле ложных срабатываний в 1% детектор находил метку примерно в 80% текстов длиной 200 токенов и в 95% текстов длиной 400 токенов — и это на темах вроде психологии. В математике, где свободы в выборе слов меньше, результаты заметно хуже.
Ослабить метку можно и обычной правкой. В тестах на текстах длиной 400 токенов замена синонимами 10% слов снизила долю обнаружений с 92% до 66%, а замена четверти слов — до 17%. Поэтому доступ к детектору поначалу получат только одобренные исследователи и профильные организации, широкой публике его не откроют.
OpenAI отдельно подчёркивает, что метка не указывает на пользователя, не раскрывает его запросы и переписку и ничего не говорит о достоверности текста. А её отсутствие не доказывает, что текст написал человек: он мог оказаться слишком коротким, отредактированным или переведённым.
Статья 50 Закона об ИИ требует, чтобы созданный генеративными моделями текст можно было распознать машинным способом. Компании, которые работали на европейском рынке и раньше, должны выполнить это требование до 2 декабря — оно касается и Google, Meta и Microsoft, а Anthropic начала маркировать тексты Claude ещё в этом году.
Как думаете, водяные знаки на текстах ИИ вообще имеют смысл, если их так легко ослабить? Пишите в комментариях.
-
Подписку ChatGPT теперь можно тратить в сторонних приложениях — Notion, Devin и ещё 14 сервисов -
«Самая мощная — не всегда лучшая»: OpenAI рассказала, как выбирать между GPT-6 Astra, Sol и Luna и как сэкономить на токенах -
ChatGPT научился примерять одежду по фото — так же, как Google, только прямо в чате -
GPT-6 Astra за шесть часов расшифровала письмо Наполеона, которое не могли прочитать 217 лет
