Tavus 公布 Griffin,希望让视频对话 AI 同时理解说话内容、表情和停顿,并在交流过程中生成自己的声音与画面。它把团队此前分别研究的实时感知、对话和人物视频能力放到同一个视频到视频系统中,目标是让虚拟人物的反应更贴近现场对话。
这类系统的难点不只在嘴型是否对得上声音。用户插话、犹豫或看向别处时,系统还要决定是否继续说、何时回应,以及用什么表情表达。Griffin 的介绍因此把互动过程作为主要测试对象,而不是只展示一段预先写好台词的数字人口播。官网公布了演示、技术方法、评估与局限说明。
目前对外的是 Griffin-Lite 的限量研究预览,完整 Griffin 还没有成为 Tavus 常规平台里可直接选用的产品。开发者现阶段仍可使用原有 Phoenix、Raven 和 Sparrow 构建面对面应用。做客服、陪练或虚拟角色的团队,可以先从演示了解交互方向,但需要把预览资格、实际可用接口和现有平台能力分开确认。