AI Radar
OpenAI включит невидимые водяные знаки textGrain в ChatGPT и Codex для ЕС
OpenAI начнёт маркировать ответы ChatGPT и Codex в ЕС невидимым водяным знаком textGrain. Для API функция уже доступна на отдельных моделях по всему миру, однако по умолчанию выключена.
Что изменилось
Маркировка вводится в ответ на требования EU AI Act о машиночитаемом обозначении ИИ-сгенерированного контента, вступившие в силу 2 августа. В ближайшие недели textGrain появится у подходящих для маркировки текстовых ответов ChatGPT и Codex для пользователей всех тарифов в Евросоюзе. На экране не будет ни значка, ни подписи: след должен быть различим детектором, а не читателем. OpenAI не делает технологию глобальным стандартом на старте: за пределами ЕС она не включается автоматически, а API-клиенты могут отдельно активировать её для некоторых моделей.
textGrain работает не как метаданные файла, которые легко потерять при копировании, а как слабый статистический отпечаток в самих формулировках. При генерации модель с помощью секретного ключа слегка меняет ранжирование допустимых следующих слов; накопленный по длинному тексту паттерн затем ищет детектор, располагающий текстом и ключом. Поэтому маркировка сохраняется при обычном copy-paste и не должна раскрывать личность пользователя. OpenAI также заявляет, что включение механизма не дало заметного ухудшения качества ответов. Технический отчёт по методу подготовлен совместно с исследователями Пенсильванского университета и Йеля.
Это не универсальный способ доказать происхождение текста. В тестах OpenAI замена примерно 10% слов синонимами снижала вероятность обнаружения приблизительно с 92% до 66%; по другой оценке, при замене четверти слов показатель падал до 17%. Короткие фрагменты и математические ответы также создают проблемы для детекции: отпечатку просто не хватает материала, а у формальных ответов меньше пространства для безопасных лексических вариаций. Иными словами, textGrain полезнее как вероятностный сигнал для проверки, чем как неоспоримая экспертиза авторства или инструмент для наказания автора одного абзаца.
Подход OpenAI близок к текстовой маркировке SynthID от Google DeepMind, на которой основано и ранее объявленное решение Anthropic, но модель внедрения заметно отличается. Для обычных продуктов в ЕС OpenAI выбирает обязательное включение в рамках регионального режима прозрачности, а разработчикам API оставляет выбор. Это снижает риск неожиданного влияния на глобальные корпоративные процессы, но одновременно означает, что один и тот же текстовый сервис может по-разному вести себя в зависимости от региона и способа доступа. Организациям понадобится учитывать это при аудитах контента, интеграциях Codex и внутренних правилах использования генеративных инструментов.
Почему это важно
Для компаний в ЕС происхождение текста постепенно становится технической характеристикой, которую нужно учитывать в контентных и инженерных процессах. Водяной знак может облегчить автоматическую проверку, но редактирование способно быстро ослабить сигнал. API-командам важно отдельно решить, включать ли textGrain, и не путать обнаружение с надёжным установлением авторства.
Первоисточники и подтверждения
- OpenAI will start watermarking ChatGPT’s text in the EUОткроется в новой вкладке
- OpenAI will watermark ChatGPT text in the EU but makes it optional for API users worldwideОткроется в новой вкладке
- ChatGPT начнет помечать тексты невидимыми водяными знакамиОткроется в новой вкладке
- Our approach to EU text provenance rulesОткроется в новой вкладке
- OpenAI is adding text watermarking in ChatGPT and CodexОткроется в новой вкладке
Подборку проверяет редакция DSML. AI помогает дедуплицировать сигналы и готовить текст, но опубликованный выпуск остаётся редакционным продуктом, а не лентой отдельных каналов.