Мой блог
OpenAI запускает водяные знаки для текста в рамках правил EU AI Act
Компания OpenAI официально представила свою стратегию по внедрению текстовых водяных знаков в соответствии с европейским регламентом об искусственном интеллекте (EU AI Act). Нововведение включает опциональную активацию для API-клиентов по всему миру, а также интеграцию невидимых меток в ответы ChatGPT и Codex на территории Европейского Союза.
Действующее законодательство ЕС обязывает разработчиков генеративных систем делать создаваемый контент машиночитаемым и легко идентифицируемым. Руководство OpenAI подчеркивает, что современные инструменты маркировки и детекции находятся на ранней стадии развития и имеют серьезные ограничения, поэтому поэтапный запуск учитывает как юридические требования, так и технические особенности метода.

Поэтапный запуск API и региональное внедрение в ЕС
Начиная с октября 2026 года, разработчики, использующие API компании по всему миру, могут самостоятельно активировать водяные знаки для выбранных моделей в ручном режиме. По умолчанию эта функция отключена. Такой подход позволяет бизнесу самостоятельно решать, насколько маркировка соответствует их обязательствам по прозрачности и потребностям пользователей. Кроме того, компания активно взаимодействует с облачными партнерами, чтобы в ближайшие недели сделать эту опцию доступной для моделей OpenAI, вызываемых через сторонние облачные сервисы.
Что касается собственных продуктов компании, то невидимая текстовая маркировка появится у пользователей ChatGPT и Codex всех тарифных планов, но исключительно на территории Европейского Союза. В OpenAI отмечают, что пока не делают водяные знаки глобальным стандартом по умолчанию, предпочитая изучать реальный опыт эксплуатации и отзывы аудитории в рамках регионального пилота.
Параллельно стартовал прием заявок на доступ к специализированному детектору текстовых водяных знаков. На первом этапе инструмент предоставляется ограниченному кругу одобренных исследователей и профильных организаций. Доступ выдается в индивидуальном порядке в строгом соответствии с европейским Кодексом практики по прозрачности контента, созданного с помощью ИИ. Стоит уточнить, что данные нововведения касаются исключительно текста: ранее выпущенные инструменты верификации аудио- и визуального контента продолжают работать в прежнем общедоступном режиме.
Как функционирует технология textGrain
В основе новой системы лежит фирменная технология textGrain, которая встраивает невидимый статистический сигнал в последовательность слов, выбираемых языковой моделью. Детектор анализирует фрагмент текста на наличие этого скрытого маркера. Технический отчет, подготовленный исследователями совместно со специалистами из Пенсильванского и Йельского университетов, описывает математическую модель процесса.
Согласно документации, метод связывает генерацию токенов с ключевой случайностью через решение задачи оптимального транспортирования. Затраты в данном алгоритме определяются случайными величинами Гамбеля, а регуляризация Кульбака — Лейблера наказывает любые отклонения от независимости. Специальный бюджет энтропии ограничивает средний показатель случайности выборки, принесенный в жертву ради внедрения водяного знака. При этом коэффициент регуляризации в точности равен средней удаляемой энтропии, что придает параметру четкий информационно-теоретический смысл.
Применение этого алгоритма к ключевым блокам словарных токенов позволяет существенно уменьшить масштаб оптимизации, сохраняя относительные вероятности токенов внутри каждого блока неизменными. Для проверки подлинности детектору требуются лишь сам сгенерированный текст и секретный ключ, без необходимости знать объем затраченной при генерации энтропии. В дальнейшем компания планирует перевести технологию в категорию open-source, чтобы разработчики могли использовать ее в собственных проектах.
Эффективность детекции и существующие ограничения
Внутренние тесты OpenAI показали, что textGrain демонстрирует результаты, сопоставимые или превосходящие другие протестированные решения, включая аналоги вроде SynthID для текстов. Тем не менее, разработчики предупреждают, что высокая точность в лабораторных условиях не гарантирует безупречную работу при повседневном использовании.
При целевом уровне ложных срабатываний в один процент детектор успешно распознавал водяные знаки примерно в 80% случаев для текстов объемом 200 токенов и в 95% для отрывков из 400 токенов (на примере материалов психологической тематики). Для текстов математического профиля, где вариативность лексики значительно ниже, показатели распознавания оказались существенно скромнее.
Кроме того, серьезным испытанием для алгоритма становится редактирование. В ходе тестирования 400-токеновых фрагментов замена всего лишь 10% слов на синонимы снижала вероятность успешной детекции примерно с 92% до 66%, а замена 25% лексики обрушивала показатель до 17%. Что касается влияния на качество генерации, то при оценке новейшей пограничной модели Astra компания не зафиксировала заметных расхождений в производительности с активными водяными знаками и без них.
Что именно не доказывают водяные знаки
Эксперты компании подчеркивают, что текстовая метка дает лишь ограниченную информацию об участии искусственного интеллекта в создании конкретного материала. Водяной знак не измеряет степень реального вклада человека, не подтверждает авторские права или юридическую ответственность, не раскрывает личность пользователя и не гарантирует общую достоверность фактов в тексте.
Более того, отсутствие обнаруженного маркера никоим образом не доказывает чисто человеческое происхождение материала. Текст мог оказаться слишком коротким, подвергнуться глубокой редакции или переводу, быть созданным неподдерживаемой моделью, сгенерирован до внедрения системы маркировки или вовсе написан с помощью инструментов другого вендора. Сам детектор сообщает лишь факт наличия фирменной метки OpenAI, не раскрывая при этом автора запроса и содержимое диалогов.
Юридические обязательства по прозрачности в Европейском Союзе
Нормы статьи 50 европейского регламента об искусственном интеллекте вступили в силу 2 августа 2026 года. Они регулируют вопросы маркировки и выявления искусственно созданного контента, а также требования к обозначению дипфейков и некоторых категорий ИИ-публикаций. Параллельно был сформирован официальный Кодекс практики по прозрачности, финализированный в начале лета.
Соблюдение данного кодекса носит добровольный характер, тогда как требования статьи 50 являются строгим юридическим обязательством. Европейская комиссия и профильный Совет по ИИ подтвердили, что кодекс служит адекватным инструментом для демонстрации соответствия закону. К концу июля к нему присоединилось около 190 компаний и организаций. В OpenAI заявляют, что продолжат совершенствовать алгоритмы обнаружения, изучать устойчивость меток к переводу и редактированию, а также искать способы разделения понятий ИИ-помощи и полного ИИ-авторства.
