chatgpt detection watermarking openai

OpenAI подтвердила, что начнёт автоматически добавлять невидимый водяной знак к текстам, созданным ChatGPT и Codex, но только для пользователей в Европейском союзе. Функция основана на собственной технологии под названием textGrain и представляет собой ответ компании на новые правила ЕС о прозрачности контента, созданного ИИ.

Главное

  • По умолчанию водяной знак OpenAI будет включён только для пользователей ChatGPT и Codex в ЕС; развёртывание начнётся в ближайшие недели.

  • За пределами ЕС, в том числе при использовании API, эта функция существует, но остаётся выключенной, пока разработчик её не включит.

  • Метод textGrain обеспечивает точность обнаружения около 92%, однако изменение всего 10% слов может снизить её примерно до 66%.

  • Пока OpenAI ограничивает доступ к детектору водяных знаков, предоставляя его только одобренным исследователям и профильным организациям.

  • В отличие от регионального подхода OpenAI, конкурирующая компания Anthropic внедрила водяные знаки по всему миру в августе.

Почему OpenAI добавляет водяные знаки в тексты ChatGPT только в ЕС

Пока OpenAI устанавливает водяные знаки по умолчанию только для пользователей из Европы и не планирует запускать эту функцию по всему миру. В сообщении в блоге, о котором рассказал TechCrunch, компания заявила, что «не будет включать водяные знаки в текстах по умолчанию во всём мире при запуске». При этом уже на этой неделе функция станет доступна разработчикам по всему миру через API, но по умолчанию будет отключена. Как сообщила Ars Technica, в ближайшие недели водяные знаки появятся у подходящих аккаунтов ChatGPT и Codex на всех тарифных планах в ЕС.

BleepingComputer процитировал формулировку OpenAI из анонса: «В ближайшие недели мы добавим невидимый водяной знак к подходящим текстовым материалам, созданным ChatGPT и Codex в Европейском союзе». Сам водяной знак невидим для тех, кто читает или копирует текст, а OpenAI утверждает, что он сохраняется вместе с содержимым, поскольку заключён в выборе слов, а не в видимой метке.

Закон ЕС об ИИ и требования к соблюдению его норм

Главная причина — требования к прозрачности, предусмотренные Законом ЕС об ИИ и вступившие в силу 2 августа 2026 года, сообщает TechCrunch. Правила обязывают компании, работающие с ИИ, маркировать созданный машинами контент так, чтобы его могли распознавать другие системы. Для этой цели уже существуют такие стандарты, как SynthID и проект C2PA, однако Ars Technica отмечает, что их по-прежнему относительно легко обойти, обладая базовыми техническими знаниями.

Как работает textGrain и в чём его ограничения

Метод OpenAI незаметно изменяет выбор слов моделью, создавая тонкие статистически обнаружимые закономерности, которые специализированный детектор может распознать с помощью секретного ключа. При этом для человека качество текста остаётся прежним. Компания опубликовала техническую статью о textGrain, подготовленную совместно с исследователями Пенсильванского университета и Йельского университета. В ней описано, как ключ упорядочивает варианты продолжения текста, чтобы формировать каждое предложение.

Ограничения этого подхода весьма заметны. Согласно тестам, на которые ссылаются Ars Technica и TechCrunch, точность обнаружения неотредактированного текста составляет около 92%, однако изменение примерно 10% слов может снизить её примерно до 66%, а изменение 20% текста — уменьшить долю успешного обнаружения почти на 75%. Короткие фрагменты, ответы с математическими выкладками и переведённый текст тоже сложнее точно распознать, признала OpenAI.

Из-за этих ограничений OpenAI заявила, что «предоставляет первоначальный доступ к детектору только одобренным исследователям и профильным организациям, которые могут помочь нам оценить его надёжность и ответственное применение», — цитирует TechCrunch. Со временем разрешение могут запросить и другие. Кроме того, OpenAI предупредила, что отсутствие водяного знака «не доказывает, что текст написал человек»: он может быть слишком коротким, слишком сильно отредактированным или целиком созданным ИИ другой компании. Как пояснила компания, водяные знаки «могут указывать на то, что система OpenAI создала или обработала часть текста, но не на то, сколько человеческого суждения, редактирования или творческого вклада в него было вложено».

Подход OpenAI и глобальное внедрение Anthropic

Различие с Anthropic очевидно. В августе Anthropic внедрила водяные знаки для текста, созданного Claude, и активировала их по всему миру. По данным TechCrunch, это вызвало недовольство некоторых пользователей Claude, которые утверждали, что именно они предоставили «инструкции, контекст и решения», а Claude был лишь «инструментом». В отличие от неё, OpenAI пока применяет настройки по умолчанию только там, где этого требуют нормативные требования, — по крайней мере, пока речь идёт о ChatGPT и Codex.

По данным TechCrunch, ранее OpenAI разработала водяной знак для текста, но решила не запускать его, отчасти опасаясь, что пользователи перейдут на конкурирующие инструменты без такой функции. Эта подробность взята из статьи Wall Street Journal за 2024 год, упомянутой в публикации. Как сообщает TechCrunch, Anthropic, Google, Meta, Microsoft и OpenAI обязались соблюдать кодекс практики ЕС в отношении контента, созданного ИИ.

Статья подготовлена при содействии искусственного интеллекта и проверена редакцией.