OpenAI объявила 5 октября о textGrain. В ближайшие недели невидимая метка появится в поддерживаемых текстовых ответах ChatGPT и Codex всех тарифов в ЕС, включая Латвию. Для отдельных моделей API маркировка уже доступна по выбору клиента по всему миру; по умолчанию она выключена. Об этом сообщила компания.
Зачем маркировать написанное ИИ
Цель — дать читателям и платформам инструмент проверки происхождения текста. Европейская комиссия связывает прозрачность ИИ с противодействием обману и манипуляциям. Статья 50 AI Act разделяет обязанности разработчика системы и того, кто публикует результат: первый обеспечивает машиночитаемую маркировку, второй в определённых случаях раскрывает использование ИИ.
Для текста на общественно значимые темы предусмотрено исключение: материал прошёл человеческую проверку или редакционный контроль, а человек либо организация несёт редакционную ответственность. Формальной проверки орфографии недостаточно. Поэтому скрытая техническая метка и видимое уведомление читателю решают разные задачи.
Правила прозрачности применяются с 2 августа 2026 года. Для систем, выведенных на рынок до этой даты, срок выполнения обязанности по машинной маркировке и обнаружению перенесён на 2 декабря 2026 года. Это уточнение содержится в разъяснениях Еврокомиссии.
Метка содержится в выборе слов
Языковая модель строит ответ последовательно, выбирая очередной токен — слово или часть слова — из возможных продолжений. textGrain связывает выбор с псевдослучайными значениями, зависящими от секретного ключа и предшествующего текста. В результате возникает статистическая закономерность: она формируется во время генерации, а не добавляется к готовому ответу как подпись.
Детектор восстанавливает эту закономерность по тексту и ключу. Ему не нужны исходный запрос и доступ к модели. Проверяется специально встроенный сигнал, а не сходство со «стилем ИИ».
Сила сигнала требует компромисса: чем больше выбор продолжений зависит от ключа, тем меньше свободы остаётся случайному выбору модели. В textGrain предусмотрен параметр, ограничивающий это изменение. Математические гарантии действуют при оговорённых условиях и не обещают безошибочную проверку любого фрагмента. Подробности изложены в техническом отчёте.
Правка ослабляет сигнал
В тесте OpenAI замена 10% слов синонимами снизила обнаружение с 92% до 66%, а замена 25% — до 17%. Короткие фрагменты, перевод и тексты с ограниченным выбором формулировок также затрудняют проверку.
Что можно узнать об авторе
Метка не раскрывает аккаунт, запрос или переписку, не измеряет человеческий вклад и не подтверждает достоверность. Отсутствие сигнала тоже не доказывает человеческое авторство. На старте детектор доступен только одобренным исследователям и экспертным организациям.
Для редакций и преподавателей это повод выяснить обстоятельства работы. Автор мог самостоятельно собрать сведения и сформулировать позицию, а затем использовать ИИ для подготовки текста. Делать вывод о плагиате или самостоятельности работы только по результату детектора было бы ошибкой.
1 комментарий
Обсуждение закрыто.