Обнаружение маркировки textGrain на языках ЕС: результаты испытаний OpenAI

OpenAI вводит невидимую маркировку текстов ChatGPT: как она работает и зачем нужна

OpenAI объявила 5 октября о textGrain. В ближайшие недели невидимая метка появится в поддерживаемых текстовых ответах ChatGPT и Codex всех тарифов в ЕС, включая Латвию. Для отдельных моделей API маркировка уже доступна по выбору клиента по всему миру; по умолчанию она выключена. Об этом сообщила компания.

Зачем маркировать написанное ИИ

Цель — дать читателям и платформам инструмент проверки происхождения текста. Европейская комиссия связывает прозрачность ИИ с противодействием обману и манипуляциям. Статья 50 AI Act разделяет обязанности разработчика системы и того, кто публикует результат: первый обеспечивает машиночитаемую маркировку, второй в определённых случаях раскрывает использование ИИ.

Для текста на общественно значимые темы предусмотрено исключение: материал прошёл человеческую проверку или редакционный контроль, а человек либо организация несёт редакционную ответственность. Формальной проверки орфографии недостаточно. Поэтому скрытая техническая метка и видимое уведомление читателю решают разные задачи.

Правила прозрачности применяются с 2 августа 2026 года. Для систем, выведенных на рынок до этой даты, срок выполнения обязанности по машинной маркировке и обнаружению перенесён на 2 декабря 2026 года. Это уточнение содержится в разъяснениях Еврокомиссии.

Метка содержится в выборе слов

Языковая модель строит ответ последовательно, выбирая очередной токен — слово или часть слова — из возможных продолжений. textGrain связывает выбор с псевдослучайными значениями, зависящими от секретного ключа и предшествующего текста. В результате возникает статистическая закономерность: она формируется во время генерации, а не добавляется к готовому ответу как подпись.

Детектор восстанавливает эту закономерность по тексту и ключу. Ему не нужны исходный запрос и доступ к модели. Проверяется специально встроенный сигнал, а не сходство со «стилем ИИ».

Сила сигнала требует компромисса: чем больше выбор продолжений зависит от ключа, тем меньше свободы остаётся случайному выбору модели. В textGrain предусмотрен параметр, ограничивающий это изменение. Математические гарантии действуют при оговорённых условиях и не обещают безошибочную проверку любого фрагмента. Подробности изложены в техническом отчёте.

Правка ослабляет сигнал

В тесте OpenAI замена 10% слов синонимами снизила обнаружение с 92% до 66%, а замена 25% — до 17%. Короткие фрагменты, перевод и тексты с ограниченным выбором формулировок также затрудняют проверку.

Что можно узнать об авторе

Метка не раскрывает аккаунт, запрос или переписку, не измеряет человеческий вклад и не подтверждает достоверность. Отсутствие сигнала тоже не доказывает человеческое авторство. На старте детектор доступен только одобренным исследователям и экспертным организациям.

Для редакций и преподавателей это повод выяснить обстоятельства работы. Автор мог самостоятельно собрать сведения и сформулировать позицию, а затем использовать ИИ для подготовки текста. Делать вывод о плагиате или самостоятельности работы только по результату детектора было бы ошибкой.

Поделиться

TelegramFacebookLinkedInWhatsAppX