🛡 OpenAI запустила невидимые водяные знаки для ИИ-текста

OpenAI опубликовала свой подход к правилам ЕС по провенансу текста, генерируемого ИИ. Невидимый водяной знак — это технология textGrain: статистический сдвиг при выборе слов, который затем находит отдельный детектор. С сегодняшнего дня клиенты OpenAI API по всему миру могут opt-in включить маркировку для отдельных моделей — по умолчанию она выключена, облачным партнерам её подключат в ближайшие недели, а вскоре знак появится в выводе ChatGPT и Codex, пока только в ЕС и на всех тарифах.

🌍 Для отрасли это первая практическая реализация требований EU AI Act — Кодекса практики ЕС по ИИ-генерируемому контенту — о машинно-читаемой маркировке генеративного текста крупным провайдером. Вместе с запуском OpenAI публикует техотчет textGrain: Entropy-Calibrated Watermarking for Language Model Text и обещает открыть исходный код. По бенчмаркам флагманской модели Astra (GPQA Diamond, BrowseComp, Terminal-Bench 4.0) качество вывода с watermarking меняется незначительно, но на старте работоспособна пока только генерация знака: детектор закрыт, и его качество подтверждено самим вендором.

👤 Обычному пользователю знак не виден: доступ к детектору на старте получат только одобренные исследователи и экспертные организации по правилам Кодекса практики ЕС. Точность зависит от длины текста — около 80% для 200 токенов и около 95% для 400 при 1% ложных срабатываний, а замена 25% слов синонимами снижает детекцию до 17%. Проверка изображений и звука уже открыта на openai.com/verify вместе с Content Provenance API для разработчиков; отсутствие водяного знака — не признак человеческого текста, а 1% ложных срабатываний несет риск обвинить живого автора в машинной генерации.

Источник 1: https://openai.com/index/eu-text-provenance/ Источник 2: https://cdn.openai.com/pdf/e9508624-d767-41b6-a26d-e34ca798ada6/textgrain-entropy-calibrated-watermarking-for-language-model-text.pdf