Познать — значит внутренне изменить себя (Авессалом Подводный).

ChatGPT добавит в закладки ваши тексты в ЕС с помощью textGrain


ChatGPT добавит в закладки ваши тексты в ЕС с помощью textGrain

В течение многих лет мы пытались выяснить, исходит ли текст от искусственного интеллекта, наблюдая за тем, как он написан, ища шаблоны, повторы или варианты предположительно характерных слов. Результаты никогда не были особенно надежными, и сама OpenAI в конечном итоге отозвала в 2023 году свой первый публичный детектор. Теперь ChatGPT пойдет по совершенно иному пути в Европе: вместо того, чтобы пытаться впоследствии распознать текст, сгенерированный искусственным интеллектом, он будет оставлять невидимый сигнал во время его создания.

В ближайшие недели OpenAI начнет добавлять невидимые водяные знаки в подходящие тексты, созданные ChatGPT и Codex в Европейском Союзе, и сделает это во всех поддерживаемых планах. Клиенты API смогут добровольно активировать ту же систему на определенных моделях из любого региона, хотя по умолчанию она останется отключенной. Этот шаг соответствует обязательствам по обеспечению прозрачности Европейского закона об искусственном интеллекте, который требует, чтобы определенный контент, созданный с использованием искусственного интеллекта, мог быть идентифицирован машиночитаемым способом.

Используемая технология называется textGrain, и она не работает, вводя скрытые символы, невидимые пробелы или какой-либо небольшой код, скрытый между словами. Что он делает, так это немного изменяет вероятности, с которыми модель выбирает слова или фрагменты слов во время генерации. Эти небольшие решения формируют статистический шаблон, который, накапливаясь на протяжении всего текста, впоследствии может быть распознан детектором, который знает сигнал. Таким образом, копирование и вставка содержимого само по себе не снимает отметку.

При благоприятных условиях textGrain может работать довольно хорошо, хотя он далек от надежной идентификации. При целевом уровне ложноположительных результатов в 1% OpenAI удалось обнаружить около 80% отметок в текстах на 200 токенов и около 95% в текстах на 400 токенов в контенте с достаточной свободой написания. Производительность значительно падает в таких областях, как математика, кодирование или ответы с очень условными ответами, где у модели меньше альтернатив при выборе способа самовыражения.

Читать  Google начинает показывать рекламу в режиме ИИ (ответы ИИ)

Редактирование также может быстро испортить этот сигнал. В тесте с использованием текстов с 400 токенами замена 10% слов синонимами снизила уровень обнаружения примерно с 92% до 66%, в то время как изменение на 25% снизило его до 17%. Интенсивное перефразирование, перевод или переписывание контента также может ослабить брендинг до такой степени, что его невозможно будет обнаружить. Таким образом, textGrain может помочь распознать текст, сгенерированный непосредственно ChatGPT, но он не превращает каждый ответ в постоянную подпись, которую невозможно удалить.

Есть еще один, еще более важный нюанс: нахождение отметки также не доказывает, что “этот текст был написан ИИ” в обычном смысле этого выражения. OpenAI настаивает на том, что textGrain не позволяет измерить объем человеческого труда, не идентифицирует пользователя, организацию, учетную запись или подсказку, не определяет, кому принадлежит текст, и не устанавливает юридическую ответственность. Это также не подтверждает, что контент является истинным. Обнаружение сигнала указывает на то, что система OpenAI, вероятно, сгенерировала или обработала часть отрывка, не более того. И, наоборот, невозможность их найти также не доказывает, что текст является человеческим.

Именно из-за этих ограничений OpenAI изначально не будет открывать прослушиватель для любого пользователя. Доступ будет ограничен исследователями и утвержденными экспертными организациями, которые смогут использовать его для оценки надежности системы и помощи в совершенствовании технологий. Инструмент сообщит, обнаруживает ли он товарный знак OpenAI, но не сообщит, кто создал контент, и не разрешит доступ к подсказкам или разговорам. Компания считает, что ложные срабатывания и отрицательные результаты делают все еще слишком рискованным публично выносить вердикт, который может быть истолкован как окончательное доказательство авторства.

Несколько лет назад OpenAI уже пытался ответить на вопрос, был ли текст написан ChatGPT, изучив его извне. Теперь он хочет оставить свой след при создании — подход, технически гораздо более интересный, но также не решающий проблему полностью. textGrain не претендует на то, чтобы решить, является ли текст человеческим или искусственным, а скорее дает дополнительный сигнал о его происхождении. И, вероятно, это различие становится все более важным: в сценарии, когда человек может написать, попросить ИИ просмотреть, отредактировать и затем перевести результат, граница между человеческим и искусственным авторством вряд ли может быть сведена к простому «да» или «нет».

Читать  Китай построил крупнейший в мире дата-центр для ИИ: под одной крышей разместят до миллиона ускорителей

 

Узнать больше

Редактор: AndreyEx

Если статья понравилась, поделитесь ей в социальных сетях

Это может быть вам интересно


Спасибо!

Теперь редакторы в курсе.

Прокрутить страницу до начала