5 октября OpenAI объявила: в ближайшие недели тексты, которые ChatGPT и Codex пишут для пользователей в Евросоюзе, начнут нести невидимый водяной знак. На всех тарифах. И только в ЕС — глобально по умолчанию его не включают. Компаниям, которые работают через API, по всему миру дали возможность включить его самим для отдельных моделей, но по умолчанию он выключен.
Причина простая — закон. Европейский AI Act, статья 50: текст, картинки, звук и видео, созданные ИИ, должны нести метку, которую может распознать машина. Есть исключения, например короткие фрагменты и программный код. Правило действует с 2 августа 2026 года, а для систем, которые уже были на рынке, обязанность маркировать начинается со 2 декабря 2026 года. Штраф — до 15 миллионов евро или 3% мирового оборота. Anthropic ещё в августе пообещала ставить такие метки на тексты и картинки Claude, причём по всему миру. То есть это не жест доброй воли, а исполнение закона.
Как это устроено и почему вы его не увидите
Первое, что хочется сделать, — найти этот знак глазами. Не получится. Это не скрытые символы и не невидимые пробелы, OpenAI прямо это пишет. Технология называется textGrain, и метка живёт в самом выборе слов. Когда модель пишет, у неё на каждом шаге есть несколько подходящих слов. Секретный ключ чуть-чуть подталкивает выбор в нужную сторону. Одно слово ничего не говорит. А на сотнях слов складывается статистический узор, который детектор с тем же ключом узнаёт.
Получается, это как почерк, а не как печать. Печать видно сразу. Почерк — только если знаешь, на что смотреть, и если текста достаточно много.
И вот тут главное: детектор вам не дадут. На старте доступ только у одобренных исследователей и экспертных организаций. Публично его не открывают — сама OpenAI объясняет это риском пропусков и ложных срабатываний. То есть учитель, редактор или кадровик, который захочет проверить текст, проверить его не сможет: заявки принимают только от организаций, которые изучают эту тему. А сервисы, которые обещают «найти водяной знак ChatGPT», секретного ключа OpenAI не имеют. Обратите на это внимание, прежде чем им верить.
Как он пропадает
Интересно, что самые честные цифры дала сама OpenAI. Замена 10% слов синонимами снижает обнаружение примерно с 92% до 66%. Замена четверти слов — до 17%. И длина решает: если допускать 1% ложных срабатываний, короткий текст в 200 токенов, это примерно 150 английских слов, находится примерно в 80% случаев, текст в 400 токенов — в 95%. Это на текстах по психологии, на математике заметно хуже. А перевод или серьёзная переработка, по словам самой компании, может убрать метку полностью. С кодом ещё сложнее: его вообще труднее маркировать.
Получается, лёгкая правка метку ослабляет, но не убирает: даже после замены каждого десятого слова её находят в двух случаях из трёх. А настоящий пересказ своими словами или перевод могут стереть её совсем. То есть «убрать» водяной знак — это, по сути, по-настоящему переписать текст. Если же его просто скопировали из чата и отправили, метка, скорее всего, на месте.
Что это меняет для нас
Казахстан не в Евросоюзе, и у нас ChatGPT пока пишет без метки. Но если вы строите свой сервис на API, включить маркировку теперь можно и отсюда. А если ваш ИИ-продукт работает на европейских пользователей, требования закона касаются и вас, где бы вы ни находились. Мне кажется, через год-два такие метки станут нормой не только в ЕС. Google открыла код похожей технологии для текстов, SynthID Text, ещё в 2024 году.
Мы в разработке работаем с ИИ каждый день, и для меня вывод тут один. Метка отвечает на вопрос «трогала ли этот текст модель OpenAI». Она не отвечает на вопрос «кто за этот текст отвечает». А это как раз самое важное. В образовании это особенно чувствуется: учитель, который будет ставить оценку по детектору, может ошибиться в обе стороны: пропустить метку или увидеть её там, где её нет. Не уверен, что школы к этому готовы.
Поэтому простой шаг на сегодня. Если у вас в компании или в школе есть правило про тексты, написанные с ИИ, перепишите его так, чтобы оно опиралось на ответственность автора, а не на детектор. Детектор можно обойти переводом. Ответственность — нет.
