返回上一页
首次通过“视频图灵测试” 新AI模型在视频对话中的表现几可乱真
来源:科技日报 作者:张梦然 2026-10-09
美国旧金山AI视频公司Tavus官网称,该公司最新发布的新模型Griffin-Lite,在组织54名受试者进行一分钟视频通话后,26人误以为对方是真人,占比48%。同样的测试流程下,上一代系统只有2.4%的受试者这样判断。Tavus称,这是首个通过“视频图灵测试”的实时视频对话模型,并把它定义为“人类交互模型”。与传统语音助手不同,Griffin-Lite能在双方同时说话的情况下,实时作出反应,无论是附和还是打断,都如同真人聊天一样。
“视频图灵测试”是在实时视频通话场景下检验AI能否在对话中表现得更像真人,受试者不知道对方身份,通过自然交流判断对方是人还是机器。如果相当比例的人在短时间内误以为AI是真人,就视为通过了测试,标准比纯文本图灵测试更严格,还要考验表情、语气、反应速度等非语言能力。
这项成绩也被拿到独立基准中验证。英伟达的VideoFDB专门考察全双工视频对话(双方可以同时说话、同时做反应),从生成和感知两条线打分。Griffin-Lite在两条线上都超过参与对比的公开模型,生成得分与真人参考水平相当接近,主要差距在于响应速度仍慢于真人。在画质、口型同步和延迟的单项对比中,它也处于领先。
能做到这一步,关键是改变了技术路线。Griffin-Lite用端到端方式把感知、判断和生成合在一起。一个连续对话引擎不断接收对方的音视频,以不足一秒的间隔判断当下该说话、附和、插话还是安静等待,同时定下内容和语气,以及表情、手势、身体姿态。另一套生成引擎随之实时生成语音和全身画面,从一张参考照片就能渲染出动态影像,背景、阴影、椅子移动都会跟着变,长时间对话也不会失真。
目前Griffin-Lite仅向少量受信任测试者开放,商业平台没有接入。Tavus解释,暂不大范围开放的原因是太像真人,容易让人误以为对话对象不是AI。
欧盟《人工智能法案》已要求,与人类直接交互的AI必须明确告知AI身份。Tavus正加紧开发强制身份披露功能,并与AI安全机构合作,完整版Griffi则要等合规问题解决后推出,时间表和定价均未公布。
最新资讯- “梦想”号完成南海大洋钻探试钻任务 深海探“心”
- 田湾核电七号机组并网发电
- 打造一批“中国制造”卓著品牌 六论工信系统学习贯彻
- “人工智能+民航”迈向规模化落地
- 国务院国资委与中国科学院签署一批重大合作项目
- AI“语音时钟”可从声音评估衰老程度
- 超薄电子皮肤让触摸实时“看得见”
- AI联手量子计算重塑未来医疗格局
- 首次通过“视频图灵测试” 新AI模型在视频对话中的
- 由“事后补救”迈向“事前预警”——AI正深度嵌入食
- 我国科研团队获联合国粮农组织农业粮食体系“同一健康
- 科学家首次观测到临界拓扑现象
- “梦想”号成功钻获深海洋盆玄武岩样品
- 年度计划安排相关投资约两万亿元—— 央企发力建设“
- 第29届京台科技论坛在京举办——探索两岸科技融合发
手机版

公众号

头条号


