Imagínate entrar a una videollamada de trabajo, charlar tranquilamente sobre tus planes para este año y descubrir al colgar que tu interlocutor era una máquina. Suena a un episodio de Black Mirror, pero acaba de convertirse en realidad. La startup Tavus ha puesto patas arriba el sector de la inteligencia artificial anunciando un avance que asusta y fascina a partes iguales. Y es que Griffin-Lite, su nueva IA conversacional, logra mantener un nivel de interacción visual y sonoro tan humano que engaña al cerebro sin esfuerzo.
Si vamos a los datos crudos, la sorpresa es mayúscula. En un riguroso experimento realizado con 54 participantes, un apabullante 48 % de los usuarios creyó firmemente haber estado hablando con una persona de carne y hueso tras un minuto de charla. Para ponerlo en perspectiva, con el sistema anterior de la empresa apenas un individuo entre 41 cayó en la trampa. El salto cualitativo es gigantesco y confirma lo que muchos temían. Ese modelo se llama Griffin y promete cambiar las reglas de la comunicación digital. La barrera del realismo ha caído.
El polémico «test de Turing» en formato audiovisual
Como era de esperar, desde Tavus ya se han colgado la medalla de ser los primeros en superar un supuesto «test de Turing en vídeo» totalmente en directo. Pero claro, la comunidad científica pide calma porque no hay un protocolo oficial para medir un formato tan novedoso. Debemos recordar que el planteamiento que Alan Turing publicó en 1950 se basaba exclusivamente en texto. Quería evitar, precisamente, que un parpadeo extraño o una voz robótica delataran a la máquina. Puro pragmatismo histórico.

Por si fuera poco, ya teníamos antecedentes recientes espectaculares en el formato escrito. Un estudio publicado en PNAS en mayo de 2026 demostró que GPT-4.5 podía hacerse pasar por humano un 73 % de las veces si se le inyectaba una personalidad muy marcada en el prompt. Evidentemente, los protocolos de texto no son comparables directamente con lo que acaba de presentar esta startup. El verdadero mérito aquí es trasladar esa tremenda confusión al plano audiovisual, cara a cara y sin red de seguridad. Cero trucos.
Full-duplex: el secreto de una IA que sabe escuchar
El verdadero músculo técnico de este nuevo agente reside en su arquitectura full-duplex. ¿Qué significa esto? Básicamente, que el modelo sigue escuchando y observando activamente mientras genera su propia voz y vídeo en tiempo real. No espera educadamente a que tú termines tu frase para procesar la respuesta, sino que evalúa la conversación en intervalos de menos de un segundo. Si le enseñas un objeto a la cámara o le cortas a mitad de frase, sabe reaccionar.

A ello se le suma una sincronización milimétrica entre facetas que antes iban por separado. La voz, la mirada y los gestos nacen de las mismas decisiones que toma la red neuronal al conversar. De hecho, su rendimiento es tan brutal que NVIDIA incluye a este sistema en su exigente benchmark VideoFDB, basado en cientos de fragmentos de llamadas reales para poner a prueba a la IA.
Si miramos los números de esa tabla, la herramienta lidera la percepción visual con un sobresaliente 3,73 sobre 5, pisándole los talones al 4,20 que marca la referencia humana. En la parte de generación pura, clava un 3,83 frente al 3,92 humano. Es decir, roza la perfección técnica. Aún así, los investigadores advierten de que falta un empujón final para igualar nuestra naturalidad conversacional absoluta. Todavía hay margen.
El choque contra la ética y la regulación europea
La letra pequeña de este avance es que no vas a poder probarlo en tu móvil u ordenador esta misma tarde. De momento, es solo una versión preliminar de investigación reservada para unos pocos testers. Aunque la compañía ya comercializa una plataforma de agentes para ventas o formación, saben que tienen un arma de doble filo entre las manos. Una inteligencia tan convincente es terreno abonado para estafas y suplantaciones de identidad.
Precisamente por eso, la firma trabaja en funciones de aviso para abordar ese riesgo antes de ampliar el lanzamiento a nivel global. Su política interna ya exige un consentimiento explícito para clonar los rasgos de alguien, pero el marco legal no les va a dejar margen de error. El AI Act obliga desde el 2 de agosto de 2026 en toda Europa a advertir de forma cristalina al usuario cuando interactúe con un sistema sintético. La ley intenta, a duras penas, acorralar el engaño masivo.
Acostumbrarnos a dudar de lo que ven nuestros propios ojos va a ser el mayor reto tecnológico de esta década. Herramientas audiovisuales de este calibre no solo rompen métricas de rendimiento en los laboratorios, sino que difuminan por completo la línea entre el código y la consciencia en nuestro día a día. La tecnología ya está lista, funciona de escándalo, y ahora la pelota está en el tejado de los legisladores. Veremos si como sociedad estamos preparados para este nivel de hiperrealismo.

Me dedico al SEO y la monetización con proyectos propios desde 2019. Un friki de las nuevas tecnologías desde que tengo uso de razón.
Estoy loco por la Inteligencia Artificial y la automatización.







