OpenAI внедрит невидимую маркировку текстов ChatGPT и Codex в ЕС

OpenAI начнёт внедрение невидимой водяной метки для текстов, созданных ChatGPT и Codex, предназначенных для пользователей из Европейского союза. Об этом компания сообщила в понедельник в своем блоге, ссылаясь на требования законодательства ЕС об искусственном интеллекте. Новые правила прозрачности, вступившие в силу 2 августа, требуют от разработчиков обозначать контент, созданный ИИ, так, чтобы его могли распознавать другие системы. Об этом пишет портал Science XXI.

Распространение метки среди пользователей ChatGPT и Codex на всех тарифах начнётся в ближайшие недели. На первом этапе функция будет доступна только в ЕС. Разработчики, использующие программный интерфейс OpenAI в других странах, могут включить её для отдельных моделей, однако по умолчанию она отключена. На данный момент компания не планирует делать маркировку текста глобальным стандартом.

Метка формируется за счёт незаметной корректировки выбора слов моделью и не выглядит как отдельный символ. В результате в тексте появляется последовательность, которую читатель не видит, но может обнаружить специальный детектор. Поскольку признак содержится непосредственно в словах, он сохраняется при копировании и вставке. OpenAI утверждает, что технология не позволяет установить личность пользователя и не оказывает заметного влияния на работу моделей.

Метод называется textGrain (текстовое зерно), а его техническое описание было опубликовано одновременно с объявлением. Документ подготовлен совместно с исследователями Пенсильванского и Йельского университетов. В нём описан способ сортировки вариантов следующего слова с помощью секретного ключа, что позволяет детектору определить происхождение текста, используя только сам текст и ключ.

Проверки OpenAI показали, что редактирование текста может ослабить действие метки. Если заменить синонимами десять процентов слов, точность обнаружения снижается примерно с 92% до 66%. Короткие фрагменты, математические ответы и переведённые тексты также труднее распознавать. «Эти ограничения повлияли на наше решение сначала предоставить доступ к детектору только одобренным исследователям и экспертным организациям, которые помогут оценить его надёжность и ответственное применение», — отметила компания.

OpenAI подчёркивает, что отсутствие метки «не доказывает авторство человека»: текст может оказаться слишком коротким, сильно отредактированным или созданным другой системой искусственного интеллекта. «[Водяные знаки] могут указывать, что система OpenAI создала или обработала часть фрагмента, но не показывают, сколько человеческого суждения, редактирования или творчества в него вложено», — говорится в заявлении. Как сообщает TechCrunch, решение OpenAI стало известным через два месяца после объявления Anthropic о всемирной маркировке текстов Claude; ранее OpenAI разрабатывала подобную технологию, но не выпускала её из-за опасений, что пользователи могут перейти к конкурентам без водяных знаков. Anthropic, Google, Meta (признана в РФ экстремистской и запрещена), Microsoft и OpenAI также присоединились к кодексу ЕС для контента, созданного искусственным интеллектом.