AI-translated from English; not yet reviewed by a fluent editor.
# Tavus Griffin: что показал минутный тест видеозвонка
> В минутных звонках, проведённых Tavus, 26 из 54 человек решили, что Griffin-Lite был человеком. Исследование, бенчмарк NVIDIA и ограниченная предварительная версия отвечают на разные вопросы.
By BIG CHANGE Editorial
Published: 2026-10-02T15:28:31.155Z
Updated: 2026-10-02T15:28:31.155Z
Canonical: https://bigchange.ai/blog/tavus-griffin-one-minute-video-call-study

AI-generated conceptual illustration by BIG CHANGE.
По словам Tavus, во время минутных видеозвонков с новой моделью Griffin-Lite 26 из 54 человек решили, что разговаривали с настоящим человеком. Это заметный результат исследования самой Tavus, но он отражает реакцию на конкретный звонок и вопрос. Griffin-Lite остаётся исследовательской предварительной версией для отдельных тестировщиков. Tavus сообщает, что разрабатывает меры, позволяющие раскрывать пользователям присутствие ИИ, прежде чем предоставить модель клиентам.
## Главное изменение
- **Что изменилось:** Tavus продвигает исследования видеоассистентов в сторону системы, которая одновременно слушает, наблюдает и генерирует лицо и голос в ходе одного разговора. В коротких звонках, проведённых компанией, 26 из 54 участников приняли модель за человека.
- **Почему это важно:** Для команд, разрабатывающих видеоагентов, подходящий темп беседы и выразительное видео могут сделать взаимодействие удобнее. То же исследование показывает, почему нельзя откладывать на потом уведомление собеседников о том, что они общаются с ИИ.
- **За чем следить:** Griffin-Lite доступна только отдельным участникам исследовательского тестирования. Tavus говорит, что разрабатывает способы раскрытия информации и дополнительные процедуры безопасности; их форма и эффективность, доступ для клиентов и специальная цена Griffin пока не объявлены.
## Что именно измерял результат 26 из 54
В [отчёте Tavus от 1 октября](https://www.tavus.io/griffin) участникам говорили, что их соединят с другим участником для минутного видеозвонка о том, чего они ждут в этом году. Однако собеседником становилась ИИ-персона Tavus на базе Griffin-Lite. После звонка люди оценивали разговор и отвечали, возникало ли у них подозрение, что собеседник ненастоящий. Затем Tavus сообщала, что собеседником был ИИ.
Из 54 участников звонков с Griffin-Lite 26 сказали, что их собеседником был реальный человек, то есть около 48%. Tavus сообщает, что использовала тот же протокол для своих прежних систем Phoenix-4.5, Sparrow-2 и Raven-1; в той группе один из 41 участника сказал, что разговаривал с человеком. Это разные группы звонивших, а не сравнение результатов одних и тех же людей до и после. Объявление не показывает, как ответы изменились бы при более долгих звонках, других темах или обычном использовании, когда люди знают, что им может ответить ИИ-агент.
Tavus называет этот результат прохождением теста Тьюринга для видео в реальном времени. Это описание компанией своего минутного исследования, а не универсальный сертификат человекоподобного общения. [В независимом обзоре запуска RuntimeWire](https://runtimewire.com/article/tavus-griffin-video-turing-test) число 48% также рассматривается как небольшой результат исследования самой компании; издание отмечает, что предварительная версия ещё недоступна клиентам. Исследование свидетельствует о суждениях участников в заявленных условиях, но не является независимо воспроизведённым измерением того, как часто людей удаётся ввести в заблуждение.
## Отдельный бенчмарк оценивает качество взаимодействия
В таблице лидеров [NVIDIA VideoFDB](https://research.nvidia.com/labs/amri/projects/video-fdb/) Griffin-Lite получила 3,83 балла из 5 за генерацию и 3,73 за восприятие. В бенчмарке используются фрагменты реальных видеозвонков и оценка языковой моделью по установленной шкале. Оценка генерации учитывает уместность голоса, лица и поведения модели в разговоре; оценка восприятия — её ответы на аудио и видео человека. В таблице NVIDIA Griffin-Lite расположена выше перечисленных систем по обоим направлениям; результаты для человеческого эталона составляют 3,92 и 4,20 соответственно.
Эти оценки относятся к другой задаче, чем вопрос звонящим, считают ли они собеседника человеком. Различаются и наборы для сравнения с условиями: таблица генерации включает каскадные системы преобразования речи в аватар, а таблица восприятия — системы, проверенные по аудио и видео либо, в отдельных строках, только по аудио. Таблица лидеров подтверждает результат по опубликованной шкале NVIDIA. Она не подтверждает показатель 48% из исследования видеозвонков Tavus и не показывает, как Griffin работала бы в продуктах для клиентской поддержки, обучения или здравоохранения.
## Как, по словам Tavus, работает система
Tavus описывает Griffin как систему из двух частей. Непрерывно работающая разговорная модель принимает аудио и видео собеседника и задаёт параметры того, что сказать, когда говорить и как это выразить. Потоковые генераторы речи и видео превращают эти параметры в голос и движущееся изображение. Компания утверждает, что система может слушать во время собственной речи, уступать слово при перебивании и реагировать на визуальный контекст, не дожидаясь завершения каждого хода. Это техническое описание и демонстрации Tavus; BIG CHANGE не получало доступ к предварительной версии и не измеряло её поведение.
Это различие важно, потому что сгенерированное лицо само по себе не определяет взаимодействие целиком. Система, реагирующая на паузы, взгляд и перебивания, может повлиять на то, почувствует ли собеседник, что его поняли, или осознает, что разговаривает с программой. Результат VideoFDB даёт численное сравнение разговорного поведения по протоколу бенчмарка. Исследование звонков Tavus даёт более узкое наблюдение о том, как участники определяли личность собеседника. Ни то ни другое не заменяет публичных данных о длительной надёжности, раскрытии информации при реальном внедрении или осознанном согласии пользователей.
## Доступ и предстоящий выбор
Tavus сообщает, что [Griffin-Lite открыта только для отдельных доверенных тестировщиков](https://www.tavus.io/griffin) в рамках исследовательской предварительной версии и недоступна клиентам Tavus. Компания предлагает заполнить форму для запроса тестового доступа. Griffin пока нет на общей платформе или в публичном API Tavus; в объявлении также не указана отдельная цена модели. Существующие модели Phoenix, Raven и Sparrow остаются отдельной линейкой доступных продуктов.
Компания говорит, что до более широкого запуска разрабатывает средства раскрытия информации и дополнительные процедуры безопасности. Дата, подробное описание способов такого раскрытия и доказательства их эффективности не опубликованы. Поэтому для тех, кто оценивает видеоагента реального времени, ближайший вопрос вполне конкретен: как собеседник узнает, кто или что находится на другом конце разговора, и как это проверят до того, как Griffin станет продуктом для клиентов?
## Источники и дополнительное чтение
- [Tavus Research, «Представляем Griffin: первую модель человеческого взаимодействия»](https://www.tavus.io/griffin), 1 октября 2026 года. Описание системы поставщиком, протокол и результаты исследования, сведения о доступности и заявления о безопасности. Исследование звонков с людьми провела Tavus; в рассмотренных источниках независимого повторения нет.
- [NVIDIA и David AI, «VideoFDB: оценка возможностей полного дуплекса речи и зрения у разговорных агентов»](https://research.nvidia.com/labs/amri/projects/video-fdb/), проверено 2 октября 2026 года. Методология оператора бенчмарка и актуальная таблица лидеров, включая оценки генерации и восприятия Griffin-Lite. Оценки модели-судьи не относятся к исследованию того, принимали ли люди ИИ за человека.
- [Райан Меркэт, RuntimeWire, «Tavus сообщает, что Griffin ввела в заблуждение 48% тестировщиков в минутных видеозвонках»](https://runtimewire.com/article/tavus-griffin-video-turing-test), 1 октября 2026 года. Независимый материал указывает размер выборки и отсутствие доступа для клиентов; в нём не сообщается о собственной репликации исследования или практической проверке Griffin.
## Sources
- [Представляем Griffin: первую модель человеческого взаимодействия](https://www.tavus.io/griffin) — Основное объявление Tavus: описание модели, минутное исследование с участием людей, проведённое компанией, ограниченная исследовательская предварительная версия, работа над раскрытием информации и отсутствие доступа для клиентов. Интерпретация поставщика о прохождении видео-теста Тьюринга атрибутирована Tavus и не принимается как универсальный результат.
- [VideoFDB — оценка возможностей полного дуплекса речи и зрения у разговорных агентов](https://research.nvidia.com/labs/amri/projects/video-fdb/) — Методология оператора бенчмарка NVIDIA/David AI и актуальная таблица лидеров. Оценки Griffin-Lite: 3,83 за генерацию и 3,73 за восприятие; это отдельные направления оценки моделью-судьёй, а не исследование определения личности людьми.
- [Tavus сообщает, что Griffin ввела в заблуждение 48% тестировщиков в минутных видеозвонках](https://runtimewire.com/article/tavus-griffin-video-turing-test) — Независимое освещение запуска и интерпретация небольшого исследования Tavus и ограниченного доступа для клиентов; не независимое повторение эксперимента.
Рассылка BIG CHANGE
Общая картина. В вашем темпе.
Свежие материалы об ИИ и робототехнике, важные перемены и практические идеи. Выберите ежедневную сводку, еженедельный дайджест или ежемесячный обзор.
Отправка в 09:00 по белградскому времени: ежедневно, по понедельникам или первого числа месяца. Первый выпуск придёт при ближайшей запланированной отправке после подтверждения.
Ваша конфиденциальность — ваш выбор.
Необходимое хранилище помогает защитить сайт и запомнить ваши настройки. Необязательная Google Analytics отключена, пока вы её не разрешите. Все статьи доступны для чтения только с необходимым хранилищем. Подробнее о конфиденциальности