据《科技日报》报道,美国旧金山AI视频公司Tavus官网称,该公司最新发布的新模型Griffin-Lite,在组织54名受试者进行一分钟视频通话后,26人误以为对方是真人,占比48%。
同样的测试流程下,上一代系统只有2.4%的受试者这样判断。
Tavus称,这是首个通过“视频图灵测试”的实时视频对话模型,并把它定义为“人类交互模型”。与传统语音助手不同,Griffin-Lite能在双方同时说话的情况下,实时作出反应,无论是附和还是打断,都如同真人聊天一样。
“视频图灵测试”是在实时视频通话场景下检验AI能否在对话中表现得更像真人,受试者不知道对方身份,通过自然交流判断对方是人还是机器。
如果相当比例的人在短时间内误以为AI是真人,就视为通过了测试,标准比纯文本图灵测试更严格,还要考验表情、语气、反应速度等非语言能力。
这项成绩也被拿到独立基准中验证。英伟达的VideoFDB专门考察全双工视频对话(双方可以同时说话、同时做反应),从生成和感知两条线打分。
Griffin-Lite在两条线上都超过参与对比的公开模型,生成得分与真人参考水平相当接近,主要差距在于响应速度仍慢于真人。在画质、口型同步和延迟的单项对比中,它也处于领先。
能做到这一步,关键是改变了技术路线。Griffin-Lite用端到端方式把感知、判断和生成合在一起。一个连续对话引擎不断接收对方的音视频,以不足一秒的间隔判断当下该说话、附和、插话还是安静等待,同时定下内容和语气,以及表情、手势、身体姿态。
另一套生成引擎随之实时生成语音和全身画面,从一张参考照片就能渲染出动态影像,背景、阴影、椅子移动都会跟着变,长时间对话也不会失真。
目前Griffin-Lite仅向少量受信任测试者开放,商业平台没有接入。Tavus解释,暂不大范围开放的原因是太像真人,容易让人误以为对话对象不是AI。
欧盟《人工智能法案》已要求,与人类直接交互的AI必须明确告知AI身份。Tavus正加紧开发强制身份披露功能,并与AI安全机构合作,完整版Griffi则要等合规问题解决后推出,时间表和定价均未公布。



