Кратко
- Tavus сообщает, что 26 из 54 участников (48%) поверили, что Griffin-Lite — реальный человек, после минутного видеозвонка, против 1 из 41 для их предыдущей системы.
- Griffin-Lite занимает первое место в бенчмарке VideoFDB от Nvidia, набрав 3,83 из 5 за генерацию против 2,80 у следующей лучшей системы и 3,92 у человеческого эталона.
- Результаты взяты со страницы собственного исследования Tavus, участникам сказали, что они встретятся с другим человеком, а Griffin-Lite ограничен избранными доверенными тестировщиками, пока Tavus работает над мерами безопасности.
AI-стартап Tavus утверждает, что его новая модель Griffin убедила 48% людей, которые общались с ней в прямом видеозвонке, что они разговаривают с реальным человеком.
Компания представила её 1 октября и называет её первой Моделью Человеческого Взаимодействия — ИИ, созданным для понимания и генерации разговора лицом к лицу, обращая внимание на выражения и паузы, а также на слова. Её предыдущая система набрала 2,4% в том же тесте.

Griffin-Lite, версия, которую тестировала Tavus, взаимодействовала с 54 людьми, и 26 из них после сказали, что поверили, что их партнёр — реальный человек. Старая система взаимодействовала с 41 человеком и получила ровно одного поверившего.
Tavus объясняет, что участникам сказали, что их подберут в пару с другим человеком для минутного видеозвонка о том, чего они ждут в этом году. Только в конце их спросили, не приходило ли им в голову, что их партнёр может быть не настоящим.
Это не классический тест Тьюринга, предложенный в 1950 году британским математиком Аланом Тьюрингом, где судья разговаривает со скрытым человеком и скрытой машиной и должен определить, кто есть кто. Никому в звонке не говорили, что на другом конце может быть бот.
Результаты взяты со страницы собственных исследований Tavus, а участники были набраны через то, что компания называет независимой исследовательской платформой. Заметка сообщества в X уже отметила, что результаты не подтверждены независимо и не следуют стандартному протоколу. Tavus говорит, что люди, которые начинали подозревать, обычно делали это в течение 20 секунд.
AI-компании, работающие в этом направлении, занимаются этим уже некоторое время. Исследование UC San Diego показало, что GPT-4.5 от OpenAI убедил судей, что он человек, в 73% разговоров, когда ему было предложено сыграть интровертного, подкованного в интернете молодого человека. Тот тест был только текстовым.
Griffin добавляет лицо и голос в реальном времени.
В бенчмарке VideoFDB от NVIDIA, тесте живого аудио- и видеосообщения, Tavus утверждает, что Griffin-Lite занимает первое место. Его трек генерации, который оценивает, насколько естественны и выразительны ответы модели, дал Griffin-Lite 3,83. Следующая лучшая система получила 2,80, а человеческий эталон набрал 3,92.
Трек восприятия, который проверяет, понимает ли модель то, что видит и слышит, показывает, где она всё ещё отстаёт от людей. Griffin-Lite набрал 3,73 против 3,44 у самого сильного базового уровня, в то время как человеческий эталон достиг 4,20. Tavus говорит, что NVIDIA проводила оценку независимо.
БиткоинBTC · USD
$84,141+0.14%
25 сен27 сен29 сен1 окт2 окт
$86.8k$85.4k$84.0k$82.7k
24ч МаксимумМаксимум$87,086
24ч МинимумМинимум$84,473
ОбъёмОбъём$2.2B
Рыночные прогнозыКоэффициенты от Myriad
Купить Биткоин за USDT
Работает на Jupiter
Griffin также является полнодуплексным, то есть он слушает, смотрит и говорит одновременно, как при телефонном разговоре, а не как при использовании рации. В демонстрации Tavus он помогает мужчине собрать кубик Рубика, основываясь на том, что видит в его руках, и ждёт, когда тот замолкает, чтобы подумать. Средняя задержка аудио-видео составляет 0,43 секунды на чипах NVIDIA H100, которые используются в центрах обработки данных ИИ, и, по словам Tavus, это вдвое меньше, чем у следующего самого быстрого метода.
Почему это должно волновать кого-то за пределами технологической сферы? Ну, хотя бы потому, что мошенники уже работают с видеозвонками.
Ещё в январе связанные с Северной Кореей хакеры использовали дипфейки — созданное ИИ видео, имитирующее реального человека, — в звонках через Zoom или Teams, чтобы выдавать себя за доверенных контактов. Исследователи по безопасности приписывают вторжение BlueNoroff, дочерней структуре Lazarus Group. Жертв уговаривают установить вредоносное ПО, замаскированное под исправление звука.
Дэвид Либерман, соавтор Gonka, децентрализованной сети для ИИ-вычислений, сказал в том отчёте, что фотографиям и видео больше нельзя доверять как доказательству того, что что-то реально. Те модели не были такими продвинутыми, как эта.
Компании уже импровизируют со своей защитой. В 2025 году Kraken отметила подозреваемого северокорейского соискателя после того, как её служба безопасности задала спонтанные вопросы, например, запросила государственное удостоверение личности и названия местных ресторанов. Кандидат не справился.
Мы попробовали модели Tavus, и результаты были… разочаровывающими. После некоторых исследований выяснилось, что Griffin-Lite недоступен для клиентов, только для избранных доверенных тестировщиков в качестве исследовательского предпросмотра, и компания говорит, что работает над функциями раскрытия и с организациями по безопасности ИИ.
Это потому, что, по словам Tavus, Griffin нуждается в мерах безопасности перед публичным выпуском.
Tavus привлекла 40 миллионов долларов в раунде Series B в ноябре 2025 года под руководством CRV. Система, набравшая 2,4%, объединила три отдельные модели: одну для визуальной части, одну для диалога и одну для восприятия.
Доверенные тестировщики могут запросить доступ к Griffin-Lite, отправив форму на сайте Tavus.






