↑

Tavus|Griffin称通过实时视频图灵测试,研究预览受限开放

PromptTree|阅读 0
2026/10/04 06:30
TavusGriffin视频生成对话式AI图灵测试
Tavus发布面向面对面实时交互的Human Interaction Model「Griffin」;公司自研实验称Griffin-Lite在一分钟视频通话后使约百分之四十八参与者以为对方是真人,并在NVIDIA VideoFDB榜单领先公开AI条目,目前仅向受信测试者开放研究预览。

当「对面是不是人」开始变得不确定,产品发布会顺便变成治理声明。Tavus把里程碑与限流开放捆在一起。

据公司页面与Business Wire通稿,Griffin被定义为Human Interaction Model(HIM):全双工视频到视频系统,可持续看、听、说、动并即时反应,而不是听完再生成。公司称在自办真人实验中,参与者被告知将与另一名参与者视频聊一分钟「今年期待什么」;结束后再询问是否觉得对方可能不是真人。54人中有26人(约48%)判断对方是真人;对照其前代Phoenix/Sparrow/Raven组合系统约2.4%(41人中1人)。

NVIDIA VideoFDB基准上,Griffin-Lite生成轨总分约3.83(人类参考约3.92),感知轨约3.73,位列已公开非人类条目前列,但中位时延仍慢于人类参考。边界必须写清:结果来自公司组织的短通话协议,不等于长对话、知情怀疑或专业审查下仍可混淆;「通过图灵测试」是其对自身实验的定义,亦非经典双盲图灵测试的严格复刻。

Griffin-Lite目前仅向部分受信测试者开放研究预览,公司称正开发身份披露与安全评估,更广发布取决于进展。怀疑者往往在通话开始约二十秒内起疑,说明「像人」仍高度依赖短时窗口与任务设定。

对产业,实时音视频拟人把深度伪造与客服、教育、陪伴场景的披露义务一起抬高——能力越像人,越需要「我是AI」的可见标识,也需要平台侧的默认披露与审计接口。事实以Tavus公开材料为准。