VMTech
Обсудить проект →

OpenAI запустит водяные знаки для текстов ChatGPT и Codex в ЕС

OpenAI запустит водяные знаки для текстов ChatGPT и Codex в ЕС

OpenAI объявила о поэтапном внедрении водяных знаков для текста в ответ на требования EU AI Act. В ближайшие недели невидимая маркировка появится в подходящих ответах ChatGPT и Codex для пользователей из Европейского союза, а API-клиенты по всему миру уже могут добровольно включить её для отдельных моделей.

Функция в API по умолчанию выключена. Одновременно компания открыла приём заявок на доступ к детектору: на первом этапе им смогут пользоваться одобренные исследователи и экспертные организации, а не широкая публика.

Как работает textGrain

Технология OpenAI называется textGrain. Она добавляет в выбор слов модели невидимый статистический сигнал, который детектор ищет в переданном фрагменте. Результат должен показывать наличие водяного знака OpenAI, но не раскрывать пользователя, учётную запись, запрос или содержание диалога.

В тестах при целевой вероятности ложноположительного результата в 1% детектор находил маркировку примерно в 80% отрывков длиной 200 токенов и примерно в 95% отрывков длиной 400 токенов на материале вроде психологии. Для математики показатели были заметно ниже: в таких текстах у модели меньше свободы при выборе формулировок.

Редактирование дополнительно снижает эффективность. В опыте с фрагментами на 400 токенов замена 10% слов синонимами уменьшила обнаружение примерно с 92% до 66%, а замена 25% слов — до 17%. OpenAI отмечает, что хорошие результаты в контролируемых условиях не гарантируют надёжного обнаружения в повседневном использовании.

Что не подтверждает маркировка

Наличие водяного знака не измеряет вклад человека и не устанавливает, кому принадлежит текст, законно ли его использование и кто несёт ответственность за публикацию. Он также не говорит, верен ли текст, вводит ли он в заблуждение или приведён ли в надлежащем контексте.

Отсутствие сигнала, в свою очередь, не доказывает человеческое авторство. Текст мог быть слишком коротким, отредактированным или переведённым; он мог быть создан до запуска маркировки, неподдерживаемой моделью или инструментом другой компании.

Контекст запуска и последствия для компаний

OpenAI заявляет, что на используемых ею бенчмарках для модели Astra существенной разницы между ответами с маркировкой и без неё не выявлено. Компания также планирует опубликовать технологию в открытом исходном коде и расширять сведения в техническом отчёте.

Маркировка текста дополняет уже используемые OpenAI механизмы происхождения контента: Content Credentials для поддерживаемых изображений, соответствие C2PA, водяные знаки SynthID для части изображений и аудио, а также инструменты проверки файлов. Для организаций практический вывод состоит в том, что результат детектора следует трактовать как ограниченный сигнал прозрачности, а не как самостоятельное доказательство авторства, достоверности или нарушения правил.

#openai#aiwatermarking#euaiact#contentprovenance
Открытая аналитика
На сайте 0 просмотров
мин чтения 3 05.10.2026
Instagram

OpenAI запустит водяные знаки для текстов ChatGPT и Codex в ЕС

Открыть публикацию в Instagram ↗