Технология позволяет устанавливать источник материала, но теряет точность после редактирования
Компания OpenAI начала внедрение невидимой маркировки текстов, созданных ChatGPT, в странах Европейского Союза. Это нововведение связано с требованиями европейского законодательства об искусственном интеллекте, которое предполагает возможность машинного определения контента, созданного генеративными моделями.

Для маркировки применяется технология textGrain. Она не вводит в текст скрытые символы, пробелы или необычные знаки, а изменяет статистическое распределение слов и токенов по заданному алгоритму. Благодаря этому специальный детектор может определить вероятное происхождение текста.
Ранее OpenAI разрабатывала аналогичную систему, но не запускала ее в массовом порядке из-за опасений, что она может приводить к ошибочным выводам, например, при проверке студенческих работ. Теперь маркировка постепенно появляется в текстах ChatGPT и Codex, созданных пользователями в ЕС.
При этом технология остается уязвимой к редактированию. Внутренние тесты OpenAI показали, что детектор распознавал около 80% маркированных фрагментов объемом 200 токенов и до 95% текстов на 400 токенов. Если заменить четверть слов, уровень обнаружения снижается примерно до 17%.
OpenAI подчеркивает, что наличие маркировки не подтверждает полное копирование текста из ChatGPT: система не отображает, какую часть материала создал ИИ и сколько текста изменил человек. Подобный подход к маркировке текстов для соответствия требованиям ЕС уже используется Anthropic в некоторых моделях Claude.
Источники:Neowin
Не пропускайте наши новостиДобавьте сайт в предпочитаемые источники, чтобы видеть нас чащеДобавить в Google
3ChatGPT49 минут назад
Источник