Tavus dice que el 48% confundió a Griffin con una persona

Tavus dice que el 48% confundió a Griffin con una persona

Tavus dice que 26 de 54 personas confundieron a Griffin-Lite con un humano tras una videollamada de un minuto.

Por Humberto Toledo el 3 de octubre del 2026 a las 1:25 am PDT

✨︎ Resumen (TL;DR):

  • Tavus presentó Griffin el 1 de octubre de 2026 y probó Griffin-Lite con 54 participantes en un protocolo de llamadas de un minuto.
  • 26 personas, el 48%, creyeron que hablaban con un humano; el sistema anterior obtuvo 2.4% entre 41 participantes.
  • NVIDIA registró para Griffin-Lite 3.83 en generación y 3.73 en percepción, con una latencia mediana de 1,892 milisegundos, frente a 900 milisegundos de la referencia humana.

Tavus presentó el 1 de octubre de 2026 a Griffin, una IA de conversación por video que, según un ensayo propio, hizo que 26 de 54 participantes, el 48%, creyeran que Griffin-Lite era una persona después de una llamada de un minuto. Con ese ensayo propio, Tavus asegura haber superado por primera vez la “prueba de Turing por video” y presenta a Griffin como el primer Human Interaction Model (HIM).

Un impresionante pavo real muestra sus plumas vibrantes en una cautivadora escena de vida salvaje.
Foto: Magda Ehlers / Pexels

Los participantes esperaban hablar con otra persona

Para el ensayo, Tavus reclutó a los participantes mediante una plataforma de investigación independiente. Les dijo que hablarían con otra persona sobre lo que esperaban de este año.

La pregunta sobre si su interlocutor podía ser una IA llegó al final de la encuesta. Después, los participantes recibieron la información de que habían hablado con un modelo.

El resultado tiene un alcance concreto: fue una llamada breve, sin advertencia previa de que el interlocutor era una IA.

Griffin escucha, observa y responde a interrupciones

Tavus también presenta a Griffin como el primer Human Interaction Model (HIM), o modelo de interacción humana. Human Interaction Model (HIM) es un modelo de interacción humana que escucha y observa mientras genera voz y video.

El sistema full-duplex puede reaccionar con gestos o dejar de hablar cuando la otra persona lo interrumpe. La presentación de Tavus incluye una demostración de conversación con su avatar de IA.

El sistema anterior quedó en 2.4%

Para comparar el resultado, la configuración anterior de Tavus usaba Phoenix-4.5, Sparrow-2 y Raven-1. Bajo el mismo protocolo, el 2.4% de los 41 participantes identificó ese sistema como humano.

La comparación incluida en el anuncio de Tavus se refiere a ese sistema previo.

NVIDIA separa calidad de generación y latencia

La clasificación pública de NVIDIA confirma que Griffin-Lite lidera las puntuaciones generales de generación y percepción de VideoFDB entre las IA publicadas. VideoFDB usa clips de videollamadas reales y un modelo de lenguaje como juez.

En esta evaluación, generación puntúa la voz y el rostro producidos; percepción evalúa cómo responde el sistema a lo que ve y escucha. Ambas categorías se califican de 0 a 5.

Categoría Griffin-Lite Referencia humana
Generación 3.83 3.92
Percepción 3.73 4.20

En generación, VideoFDB registró una mediana de latencia de 1,892 milisegundos para Griffin-Lite, frente a 900 milisegundos para la referencia humana. La puntuación de generación se acerca a la referencia, pero la respuesta tarda más.

Tavus restringe Griffin-Lite por su potencial de engaño

Tavus limita Griffin-Lite a evaluadores de confianza porque reconoce el potencial de engaño asociado con ese realismo. Antes de ofrecerlo a sus clientes, prepara mecanismos para comunicar la identidad artificial del interlocutor y otras medidas de seguridad.

El dato del 48% corresponde a un escenario acotado: una llamada de un minuto, con 54 participantes que esperaban hablar con otra persona y sin aviso previo sobre la IA. La clasificación de NVIDIA añade otra diferencia: Griffin-Lite se acerca a la referencia humana en generación, pero registra una mediana de latencia más alta. Tavus mantiene el acceso restringido mientras prepara la forma de comunicar que el interlocutor es artificial.

Fuentes: 1, 2, 3, 4

+ Temas Relacionados

Más de AI

Feed