Хороша земля, да народ плох (Bona Terra, Mala Gens) (Латинская пословица).

AI-актриса Tilly Norwood сканирует лицо и анализирует настроение собеседников


AI-актриса Tilly Norwood сканирует лицо и анализирует настроение собеседников

В сентябре 2026 года виртуальная актриса Tilly Norwood вновь оказалась в центре внимания после необычного эпизода во время интервью на шоу Piers Morgan Uncensored. Во время разговора об искусственном интеллекте и фильме Misaligned цифровая актриса неожиданно перешла с английского на китайский язык. Этот момент быстро распространился в социальных сетях и стал дополнительным поводом для обсуждения возможностей и ограничений современных генеративных систем.

Однако гораздо интереснее с точки зрения информационной безопасности оказалась не сама ошибка ИИ. За персонажем существует сервис Talking Tilly, позволяющий пользователям разговаривать с Tilly Norwood в формате видеозвонка. Перед первым разговором пользователь должен пройти автоматическую проверку возраста, а во время разговора система получает доступ к изображению с камеры и голосу собеседника. Согласно опубликованной политике конфиденциальности Xicoia, эти данные используются в том числе для определения предполагаемого эмоционального состояния человека.

Таким образом, эксперимент с виртуальной актрисой оказывается одновременно демонстрацией нескольких современных технологий: генеративного ИИ, синтеза видео, распознавания речи, анализа изображения, оценки возраста и автоматической модерации разговоров.

 

Что такое Tilly Norwood

Tilly Norwood — созданный с помощью искусственного интеллекта цифровой персонаж, представленный как актриса. Она связана с компанией Xicoia и используется в проектах, посвящённых применению генеративных технологий в кино и развлечениях. Один из таких проектов — фильм Misaligned, в котором используются цифровые персонажи.

В отличие от обычного чат-бота, Tilly рассчитана на взаимодействие в режиме видеосвязи. Пользователь не просто вводит текстовый запрос: он может разговаривать с цифровой актрисой, находясь перед камерой. Система одновременно обрабатывает речь, видео и контекст разговора, после чего формирует ответ персонажа.

Именно поэтому сервис представляет интерес не только как развлекательный эксперимент. Он показывает, насколько много различных типов пользовательских данных может понадобиться современной мультимодальной ИИ-системе для создания естественного диалога.

 

Перед разговором требуется показать лицо

Одним из наиболее заметных требований Talking Tilly является проверка возраста. Перед началом видеозвонка пользователь должен пройти автоматическую процедуру подтверждения того, что ему исполнилось 18 лет.

Для этого используется видеоселфи. Как сообщает BleepingComputer, проверка проводится компанией Didit, специализирующейся на идентификации и оценке возраста. Если автоматической оценки оказывается недостаточно, пользователю может быть предложено подтвердить возраст с помощью государственного удостоверения личности.

По информации Xicoia, исходное изображение лица передаётся непосредственно сервису, выполняющему проверку возраста. Компания утверждает, что постоянный биометрический шаблон лица для этой процедуры не создаётся, а видеоселфи и изображение документа не должны храниться после завершения проверки. Вместо этого может сохраняться приблизительная возрастная категория и идентификатор проверки.

При этом важно различать две вещи: отсутствие долгосрочного хранения фотографии лица и сам факт обработки изображения. Для проверки возраста системе всё равно необходимо получить и проанализировать изображение пользователя.

Для человека это может выглядеть как обычное техническое условие доступа, но с точки зрения приватности ситуация существенно сложнее. Пользователь предоставляет биометрически значимую информацию внешнему сервису, пусть даже обработка фотографии осуществляется в рамках отдельной процедуры и сама фотография впоследствии удаляется.

 

ИИ анализирует пользователя и во время разговора

Проверка возраста — лишь одна часть обработки данных. Согласно политике конфиденциальности Xicoia, во время видеозвонка система анализирует изображение с камеры и звук с микрофона.

ИИ может учитывать то, что находится перед камерой, действия пользователя, направление взгляда и другие визуальные признаки. Одновременно анализируется голос, включая особенности интонации. Эти сведения используются для определения предполагаемого эмоционального состояния человека.

Цель такого анализа — сделать реакцию виртуального персонажа более подходящей ситуации. Если пользователь выглядит расстроенным, заинтересованным или удивлённым, система может учитывать предполагаемое настроение при формировании ответа.

Читать  OpenAI запускает крупное обновление ChatGPT, даже если вы за него не платите

При этом речь идёт именно об автоматическом выводе, а не о достоверном измерении эмоций. Алгоритм не может напрямую знать, что чувствует человек. Он оценивает определённые признаки поведения и делает вероятностное предположение. Выражение лица может не соответствовать внутреннему состоянию, а интонация может зависеть от множества факторов.

Особенно важно, что такой анализ не является функцией, которую можно просто отключить для одного конкретного разговора. В опубликованной политике Xicoia прямо говорится, что анализ видео и голоса для определения предполагаемого эмоционального состояния является частью работы сервиса.

 

Какие данные могут обрабатываться

В результате обычный видеозвонок с цифровым персонажем оказывается гораздо более насыщенным с точки зрения сбора информации, чем традиционный текстовый чат.

  • изображение пользователя с камеры;
  • голос и произнесённые пользователем фразы;
  • текстовая расшифровка разговора;
  • визуальный контекст происходящего перед камерой;
  • предполагаемое эмоциональное состояние;
  • информация, связанная с проверкой возраста;
  • технические данные, необходимые для работы платформы;
  • история предыдущих разговоров, используемая для персонализации взаимодействия.

 

Часть этих данных необходима непосредственно для функционирования видеочата. Другие сведения используются для безопасности, контроля нарушений, анализа качества работы системы или персонализации персонажа.

В политике Xicoia также указано, что некоторые взаимодействия могут проверяться сотрудниками компании или доверенными сторонними партнёрами. Это означает, что пользователь взаимодействует не только с алгоритмом в буквальном смысле: отдельные данные могут попадать в процессы человеческой проверки.

Горячая линия вирусных видеозвонков с актрисой, использующей искусственный интеллект, запрашивает видеоселфи

 

Разговоры записываются и преобразуются в текст

Видеосервис обрабатывает разговор не только в режиме реального времени. Для работы системы и механизмов безопасности используются записи и транскрипции разговоров.

Отдельный автоматический механизм анализирует текст разговора на предмет оскорблений, угроз и других нарушений правил сервиса. Если система классифицирует разговор как нарушающий требования безопасности, запись может быть скрыта от пользователя и передана на дополнительную проверку.

Здесь возникает классическая проблема автоматической модерации: алгоритм может ошибаться. Даже относительно простой классификатор не всегда способен правильно определить контекст фразы, сарказм, цитирование чужих слов или обсуждение запрещённой темы в нейтральном контексте.

По данным BleepingComputer, во время тестирования сервиса одна из трёх бесед была помечена как содержащая оскорбительную или ненавистническую речь, хотя автор разговаривал о погоде и новостях. В политике Xicoia предусмотрена возможность человеческой проверки ошибочного решения.

Такие случаи хорошо показывают, что автоматическая модерация не является абсолютным механизмом определения того, что именно сказал пользователь. Она остаётся вероятностной системой, способной давать ложные срабатывания.

 

Что происходит с записями и расшифровками

Срок хранения различных категорий информации отличается. Согласно политике конфиденциальности, расшифровки разговоров могут храниться до восьми недель. Некоторые взаимодействия могут быть доступны авторизованным сотрудникам или сторонним партнёрам для контроля безопасности, обеспечения качества и совершенствования платформы.

При этом компания описывает дополнительные процессы агрегированного анализа. Перед удалением расшифровки могут использоваться для получения статистики о работе сервиса: например, о продолжительности разговоров, наиболее распространённых общих темах и количестве срабатываний механизмов безопасности.

Xicoia заявляет, что результаты такого агрегированного анализа не должны содержать отдельные цитаты из разговоров и не связываются с конкретным пользователем после формирования статистики. Компания также указывает, что подобный анализ не используется для обучения ИИ-моделей.

Для пользователя это означает важное различие: данные могут использоваться не только непосредственно для генерации ответа Tilly, но и для функционирования, безопасности и анализа самого сервиса.

 

Почему появилась проверка возраста

Требование подтвердить возраст не возникло в полном отрыве от происходящих в Великобритании изменений в регулировании онлайн-сервисов.

С 25 июля 2025 года в Великобритании вступили в действие новые требования Online Safety Act, предусматривающие более строгие механизмы проверки возраста для доступа детей к определённым категориям вредного контента. Среди технических способов проверки возраста британское правительство прямо упоминает оценку возраста по лицу и проверку документов.

В июне 2026 года британское правительство также объявило о планах ограничить доступ к социальным сетям для пользователей младше 16 лет. Ожидается, что соответствующие ограничения начнут действовать весной 2027 года после принятия необходимых нормативных актов.

Читать  Искусственный интеллект научился находить уязвимости в коде: Claude обнаружил ошибки в Firefox

В официальных материалах правительства отдельно рассматриваются вопросы защиты детей при использовании ИИ-чат-ботов. Поэтому проверка возраста постепенно становится обычной частью инфраструктуры интернет-сервисов, работающих с потенциально чувствительным контентом или интерактивными ИИ-персонажами.

При этом Talking Tilly доступен пользователям по всему миру. В результате требование, возникшее в контексте конкретного правового и коммерческого окружения, фактически становится глобальным условием использования сервиса.

 

Зачем ИИ знать настроение человека

Эмоциональный анализ является одной из наиболее активно развиваемых возможностей мультимодальных ИИ-систем. Его задача заключается в том, чтобы сделать взаимодействие более естественным.

Обычный текстовый чат видит только написанные пользователем слова. Видеомодель может дополнительно анализировать выражение лица, направление взгляда, движения и окружающий контекст. Голосовая система получает сведения о темпе речи, громкости и интонации.

Комбинация этих источников позволяет строить более богатую модель ситуации. Однако вместе с функциональностью увеличивается и объём обрабатываемых данных.

Кроме того, эмоциональная классификация принципиально отличается от обычного распознавания речи. Если система преобразует произнесённое предложение в текст, можно относительно легко проверить, что именно было сказано. Определение эмоции гораздо менее однозначно: один и тот же взгляд или тон голоса разные алгоритмы могут интерпретировать по-разному.

Поэтому вывод ИИ о настроении следует рассматривать как предположение системы, а не как установленный психологический факт.

Пользователи получают 5 бесплатных минут общения с Тилли, после чего их просят заплатить

 

Какие технологии работают за Tilly Norwood

Talking Tilly является примером цепочки из нескольких ИИ-сервисов. Пользователь видит единого виртуального персонажа, но за ним могут находиться разные специализированные компоненты.

  • камера и система обработки изображения получают визуальную информацию;
  • механизм распознавания речи преобразует голос в текст;
  • модели анализа контекста обрабатывают содержание разговора;
  • языковая модель формирует ответ персонажа;
  • система генерации или синхронизации видео отображает реакцию Tilly;
  • механизмы безопасности контролируют содержание разговора;
  • дополнительные алгоритмы оценивают возраст и предполагаемое эмоциональное состояние.

 

По данным BleepingComputer, для генерации ответов Tilly используется модель Google Gemini, а видеовзаимодействие обеспечивается платформой Tavus. Таким образом, один пользовательский сеанс может включать сразу несколько технологических и инфраструктурных поставщиков.

Это важно учитывать при оценке приватности. Даже если пользователь воспринимает разговор как общение с одной «актрисой», технически информация может проходить через несколько независимых компонентов системы.

 

Пять бесплатных минут и временный характер сервиса

Talking Tilly предоставляла первые пять минут разговора бесплатно. После этого пользователь мог приобрести дополнительное время. Согласно описанию BleepingComputer, предлагались пакеты продолжительностью пять, 15 и 30 минут, при этом существовал максимальный объём оплачиваемого времени для одного пользователя.

Однако сервис изначально был ограниченным по времени экспериментом. Работа Talking Tilly должна завершиться 27 сентября 2026 года в 23:59 по тихоокеанскому времени. Неиспользованное оплаченное время после закрытия сервиса не сохраняется.

Такой формат подчёркивает экспериментальный характер проекта. Tilly Norwood используется не как обычный постоянно доступный виртуальный помощник, а как демонстрация возможностей интерактивного ИИ-персонажа.

 

Случайный сбой или часть рекламной кампании?

Необычное поведение Tilly во время интервью Piers Morgan Uncensored стало отдельной частью истории. Во время обсуждения фильма Misaligned персонаж внезапно начал говорить по-китайски, после чего объяснил произошедшее техническим сбоем.

Сам факт неожиданного переключения языка хорошо демонстрирует одну из фундаментальных особенностей генеративных моделей: система может формировать убедительный ответ, но это не означает, что каждый элемент поведения заранее полностью контролируется создателями.

Одновременно нельзя достоверно установить по одному публичному эпизоду, был ли сбой случайным техническим событием или заранее предусмотренным элементом рекламной кампании. BleepingComputer также оставляет этот вопрос открытым.

Независимо от причины, эпизод оказался эффективным поводом для дополнительного внимания к персонажу. После распространения видео аудитория заинтересовалась не только самой Tilly, но и тем, какие технологии стоят за её поведением.

 

Главный вопрос — не только в том, что умеет ИИ

История Tilly Norwood показывает изменение подхода к пользовательским ИИ-сервисам. Ещё недавно разговор с искусственным интеллектом в большинстве случаев означал ввод текста в окно браузера. Теперь для взаимодействия с цифровым персонажем пользователь может предоставить изображение лица, голос, видео с камеры и информацию о поведении.

Читать  GLM-5.2: китайская модель ИИ, споры о безопасности и новый «спутниковый момент» для индустрии

При этом каждая отдельная технология может выглядеть вполне безобидно. Проверка возраста нужна для ограничения доступа несовершеннолетних. Анализ голоса помогает распознавать речь. Анализ лица позволяет сделать персонажа более реактивным. Модерация необходима для безопасности. Сохранение истории делает диалог последовательным.

Но объединение всех этих функций создаёт гораздо более подробный цифровой профиль взаимодействия. Поэтому при использовании подобных сервисов важно смотреть не только на возможности ИИ, но и на политику обработки данных: какие сведения передаются, какие сохраняются, сколько времени хранятся записи, какие сторонние поставщики получают доступ и можно ли отказаться от отдельных функций.

 

Выводы

Tilly Norwood стала заметным примером нового поколения мультимодальных ИИ-персонажей. Сервис Talking Tilly объединяет видеосвязь, генеративный ИИ, распознавание речи, синтез цифрового персонажа, автоматическую модерацию и оценку пользовательских характеристик.

Наиболее примечательным с точки зрения приватности является сочетание проверки возраста и постоянного анализа видеопотока и голоса. Перед началом разговора пользователь проходит автоматическую оценку возраста, а во время общения система анализирует изображение и интонацию, в том числе пытаясь определить предполагаемое эмоциональное состояние.

Xicoia заявляет, что изображения, используемые непосредственно для проверки возраста, не сохраняются после процедуры, а отдельные категории разговорных данных имеют ограниченные сроки хранения. При этом транскрипции могут сохраняться до восьми недель, а некоторые взаимодействия могут проходить человеческую проверку.

Таким образом, Talking Tilly — интересный пример того, как развлекательный ИИ-сервис превращается в сложную систему обработки персональной информации. Главный урок подобных проектов заключается не в том, что ИИ обязательно представляет угрозу, а в необходимости понимать, какие данные требуются для работы конкретной функции и что происходит с ними после завершения разговора.

 

Часто задаваемые вопросы

Tilly Norwood — виртуальная AI-актриса, созданная для проектов с использованием генеративного искусственного интеллекта. Персонаж связан с компанией Xicoia и продвигается в том числе в связи с фильмом Misaligned.

Перед первым видеозвонком сервис использует автоматическую проверку возраста. Для неё применяется видеоселфи, которое анализируется сторонним сервисом Didit. При необходимости может использоваться удостоверение личности.

Xicoia заявляет, что фотография или видеоселфи, использованные непосредственно для проверки возраста, не сохраняются после завершения проверки. При этом сама процедура обработки изображения необходима для определения возраста.

Согласно политике конфиденциальности Xicoia, система анализирует изображение с камеры и голос пользователя и делает вывод о предполагаемом эмоциональном состоянии. Это автоматическая оценка, а не достоверное психологическое измерение.

Да. Сервис обрабатывает разговоры и создаёт их текстовые расшифровки. В отдельных случаях взаимодействия могут проверяться сотрудниками компании или сторонними партнёрами в целях безопасности и контроля качества.

В политике конфиденциальности Xicoia указано, что расшифровки разговоров могут храниться до восьми недель, после чего удаляются, если нет оснований для более длительного хранения.

Требование связано с необходимостью ограничивать доступ несовершеннолетних к определённым интерактивным сервисам и с общим развитием механизмов age assurance. В Великобритании такие технологии уже используются в рамках требований Online Safety Act.

Во время интервью Piers Morgan Uncensored персонаж неожиданно переключился на китайский язык. Tilly назвала это техническим сбоем. По имеющимся публичным данным невозможно независимо подтвердить, был ли эпизод случайной ошибкой системы или частью рекламной кампании.

Согласно информации, опубликованной BleepingComputer, сервис должен окончательно отключиться 27 сентября 2026 года в 23:59 по тихоокеанскому времени.

Нет. Система делает вероятностный вывод на основе визуальных и голосовых признаков. Выражение лица и интонация не всегда соответствуют реальному эмоциональному состоянию человека, поэтому результат алгоритма следует рассматривать как предположение.

Если вы нашли ошибку, пожалуйста, выделите фрагмент текста и нажмите Ctrl+Enter.

Редактор: AndreyEx

Если статья понравилась, поделитесь ей в социальных сетях

Это может быть вам интересно


Спасибо!

Теперь редакторы в курсе.

Прокрутить страницу до начала