Оглавление
Компания OpenAI внедряет систему невидимой маркировки текста для пользователей ChatGPT в Европейском союзе, стремясь соответствовать требованиям Закона об ИИ (EU AI Act). Согласно информации The Decoder, новая технология под названием textGrain внедряет статистический сигнал непосредственно в процесс выбора слов моделью.
В отличие от компании Anthropic, которая сделала водяные знаки обязательными для всех пользователей Claude, разработчики из Сан-Франциско выбрали более гибкий путь. Для клиентов, использующих API по всему миру, включая платформу Microsoft Azure, функция маркировки останется опциональной, что сохраняет пространство для маневра профессиональным разработчикам.
Эффективность textGrain и уязвимость перед правками
Система textGrain работает через анализ энтропии при генерации токенов, создавая машиночитаемый след, незаметный для человеческого глаза. Внутренние тесты OpenAI на модели Astra показали, что детектор успешно распознает около 95% фрагментов объемом 400 токенов (примерно 300 слов) в текстах по психологии.
Однако точность идентификации заметно снижается в дисциплинах с жесткой терминологией, таких как математика, где у модели меньше свободы в выборе синонимов. Кроме того, надежность защиты оказалась весьма хрупкой перед лицом обычного редактирования. Замена всего 25% слов на синонимы обрушивает вероятность обнаружения до 17%, превращая «невидимый след» в статистический шум.
Nехнология textGrain выглядит как изящный компромисс между регуляторным давлением и интересами бизнеса, но ее реальная ценность сомнительна. Пока любая косметическая правка или перевод текста в стороннем сервисе стирает цифровой отпечаток, водяные знаки остаются лишь декорацией для юристов Еврокомиссии, а не инструментом борьбы с дезинформацией. Это классическая игра в имитацию безопасности, где побеждает тот, кто умеет пользоваться словарем синонимов.
Ограниченный доступ к инструментам проверки
На текущем этапе OpenAI не планирует открывать публичный доступ к детектору водяных знаков. Воспользоваться им смогут только отобранные исследовательские организации и специалисты после подачи заявки. Компания объясняет это решение риском ложноположительных срабатываний, которые могут привести к несправедливым обвинениям в использовании ИИ.
Важно понимать, что наличие или отсутствие метки textGrain не является окончательным доказательством авторства. Система лишь подтверждает, что текст был сгенерирован конкретной моделью, но не учитывает вклад человека в редактирование и не гарантирует достоверность фактов. Для проверки изображений и аудио компания продолжает поддерживать открытые инструменты в рамках Content Provenance API.
Несмотря на технические ограничения, OpenAI намерена опубликовать исходный код технологии, чтобы сделать textGrain отраслевым стандартом. Это выглядит как попытка переложить ответственность за верификацию контента на плечи сообщества, одновременно выполняя формальные требования европейских регуляторов без ущерба для глобальной экспансии своего API.
Оставить комментарий