Tavus发布Griffin「人类交互模型」:48%测试者误以为是真人,通过视频图灵测试

作者:Tavus官方 / 腾讯新闻 发布时间:2026-10-08 15:28:01 浏览:2
关键字:
Tavus发布首个「人类交互模型」Griffin,将感知、对话和视频生成整合为端到端系统。54名受试者中有48%误以为对方是真人,在英伟达VideoFDB基准上生成得分3.83(满分5分),真人基准为3.92分。

首个端到端人类交互模型

Tavus于10月1日发布新模型Griffin,定位为首个「人类交互模型」(Human Interaction Model, HIM)。与业界传统的级联式系统(语音识别→LLM→语音合成→形象驱动)不同,Griffin将感知、决策和生成整合进一个端到端系统,让三者并行运行,实现真正的全双工「视频到视频」实时对话。

48%测试者误以为是真人

Tavus组织了一项测试:54名受试者与Griffin进行1分钟视频通话,其中26人(48%)误以为对方是真人。作为对照,上一代系统的通过率仅为2.4%(41人中仅1人)。判断对方是真人的受试者,平均确信度为79%。

VideoFDB基准排名第一

在英伟达全双工音视频对话基准VideoFDB上,Griffin-Lite的生成得分达到3.83分(满分5分),真人基准为3.92分。在「双人情感呼应」子项上甚至拿到4.40分,超过真人基准的4.14分。感知赛道得分3.73分,优于OpenAI gpt-realtime(2.75分)和Google Gemini 3.1 Flash Live(2.84分)。

技术架构:微轮次对话建模

Griffin的核心是「连续对话建模引擎」,以不足1秒的「微轮次」持续评估对话状态,判断何时开口、倾听、附和或保持安静。音视频生成引擎采用自研Tavec音频编解码器和步数较少的自回归扩散生成器,在H100上从音频输入到视频输出平均延迟仅0.43秒。

暂未商业化,合规待完善

Griffin-Lite目前仅提供给少数受信任的测试人员,暂不对外开放。Tavus表示正在加紧开发「安全披露」(强制身份告知)功能,以符合欧盟AI法案要求。完整版Griffin将在后续推出。

本文由AI融业云采集并编辑,仅供学习使用!

本文来自网络,作者Tavus官方 / 腾讯新闻

关于AI融业云:一站式AI应用服务平台,了解创始人 | 联系我们

有问题,请联系客服!http://www.rongyeyun.com/kefu/