En resumen
- Tavus afirma que 26 de los 54 participantes (48%) creyeron que Griffin-Lite era una persona real tras una videollamada de un minuto, frente a 1 de 41 en su sistema anterior.
- Griffin-Lite ocupa el primer lugar en el benchmark VideoFDB de Nvidia, con una puntuación de 3,83 sobre 5 en generación, frente a 2,80 del siguiente mejor sistema y 3,92 de una referencia humana.
- Los resultados provienen de la propia página de investigación de Tavus, a los participantes se les dijo que conocerían a otra persona, y Griffin-Lite está limitado a probadores de confianza seleccionados mientras Tavus trabaja en medidas de seguridad.
La startup de IA Tavus afirma que su nuevo modelo, Griffin, convenció al 48% de las personas que hablaron con él en una videollamada en vivo de que estaban hablando con un ser humano real.
La empresa lo presentó el 1 de octubre y lo llama el primer Modelo de Interacción Humana, una IA creada para comprender y generar conversaciones cara a cara, prestando atención a las expresiones y las pausas, así como a las palabras. Su sistema anterior obtuvo un 2,4% en la misma prueba.

Griffin-Lite, la versión que Tavus probó, se enfrentó a 54 personas, y 26 de ellas dijeron después que creían que su interlocutor era una persona real. El sistema anterior se enfrentó a 41 personas y consiguió exactamente un creyente.
Tavus explica que a los participantes se les dijo que serían emparejados con otra persona para una videollamada de un minuto sobre lo que esperaban con ansias este año. Solo al final se les preguntó si se les había pasado por la cabeza que su compañero podría no ser real.
Eso no es el clásico test de Turing, propuesto en 1950 por el matemático británico Alan Turing, donde un juez conversa con un humano oculto y una máquina oculta y tiene que averiguar cuál es cuál. A nadie en la llamada se le dijo que un bot podría estar al otro lado.
Los resultados provienen de la propia página de investigación de Tavus, y los participantes fueron reclutados a través de lo que llama una plataforma de investigación independiente. Una nota de la comunidad en X ya ha señalado que los resultados no están verificados de forma independiente y no siguen un protocolo estándar. Tavus dice que las personas que se volvieron sospechosas generalmente lo hicieron en menos de 20 segundos.
Las empresas de IA que construyen hacia esto han estado en ello desde hace un tiempo. Un estudio de UC San Diego encontró que GPT-4.5 de OpenAI convenció a los jueces de que era humano en el 73% de las conversaciones, cuando se le pidió interpretar a una persona joven introvertida y experta en internet. Esa prueba fue solo de texto.
Griffin añade una cara y una voz, en tiempo real.
En el benchmark VideoFDB de NVIDIA, una prueba de conversación en vivo de audio y video, Tavus dice que Griffin-Lite ocupa el primer lugar. Su pista de generación, que califica cuán naturales y expresivas son las respuestas de un modelo, le dio a Griffin-Lite 3.83. El siguiente mejor sistema obtuvo 2.80, y la referencia humana obtuvo 3.92.
La pista de percepción, que verifica si un modelo entiende lo que ve y oye, muestra dónde todavía está por detrás de las personas. Griffin-Lite obtuvo 3.73 frente a 3.44 del baseline más fuerte, mientras que la referencia humana alcanzó 4.20. Tavus dice que NVIDIA realizó la evaluación de forma independiente.
BitcoinBTC · USD
$84,141+0.14%
Sep 25Sep 27Sep 29Oct 1Oct 2
$86.8k$85.4k$84.0k$82.7k
24h HighHigh$87,086
24h LowLow$84,473
VolVol$2.2B
Market projectionsOdds by Myriad
Buy Bitcoin with USDT
Powered by Jupiter
Griffin también es full-duplex, lo que significa que escucha, observa y habla al mismo tiempo, como una llamada telefónica en lugar de un walkie-talkie. En una demostración de Tavus, guía a un hombre a través de un cubo de Rubik basándose en lo que ve en sus manos, y espera cuando él se queda en silencio para pensar. El retraso de audio a video promedia 0.43 segundos en chips NVIDIA H100, del tipo utilizado en centros de datos de IA, lo que Tavus dice es la mitad del del siguiente método más rápido.
¿Por qué debería importarle a alguien fuera del sector tecnológico? Bueno, por una cosa, porque los estafadores ya trabajan en videollamadas.
En enero, hackers vinculados a Corea del Norte usaron deepfakes, video creado con IA que imita a una persona real, en llamadas de Zoom o Teams para hacerse pasar por contactos de confianza. Los investigadores de seguridad atribuyen la intrusión a BlueNoroff, una subsidiaria del Grupo Lazarus. Las víctimas son convencidas de instalar malware disfrazado de una solución de audio.
David Liberman, cocreador de Gonka, una red descentralizada para computación de IA, dijo en ese informe que las fotos y los videos ya no pueden ser confiables como prueba de que algo es real. Esos modelos no eran tan avanzados como este.
Las empresas ya improvisan sus defensas. En 2025, Kraken señaló a un presunto solicitante de empleo norcoreano después de que su equipo de seguridad hiciera preguntas espontáneas, como solicitar una identificación gubernamental y los nombres de restaurantes locales. El candidato tuvo dificultades.
Probamos los modelos de Tavus y los resultados fueron… decepcionantes. Después de investigar un poco, resulta que Griffin-Lite no está disponible para los clientes, solo para probadores de confianza seleccionados como una vista previa de investigación, y la empresa dice que está trabajando en funciones de divulgación y con organizaciones de seguridad de IA.
Esto se debe a que Tavus dice que Griffin necesita medidas de seguridad antes de un lanzamiento público.
Tavus recaudó 40 millones de dólares en una Serie B en noviembre de 2025, liderada por CRV. El sistema que obtuvo un 2,4 % combinó tres modelos separados, uno para imágenes, otro para diálogo y otro para percepción.
Los probadores de confianza pueden solicitar acceso a Griffin-Lite enviando un formulario en el sitio de Tavus.






