Tavus 推出实时视频对话模型 Griffin,48% 测试者误认为真人
Tavus 推出名为 Griffin 的 Human Interaction Model,可在接收和生成视频的同时处理语音、面部表情、语调、手势和停顿。Tavus 的一项研究中,48% 的参与者在 1 分钟视频通话后认为 Griffin 是真人,此前系统最高为 2%。
Tavus 推出名为 Griffin 的 Human Interaction Model,可在接收和生成视频的同时处理语音、面部表情、语调、手势和停顿。Tavus 的一项研究中,48% 的参与者在 1 分钟视频通话后认为 Griffin 是真人,此前系统最高为 2%。
Google DeepMind 发布 Gemini Omni 1.1 Flash,为开发者带来更可控的生成视频能力,通过 Gemini API 在 Google AI Studio 提供。
推荐理由:原文列出场景延长、首尾帧插值与 4K 放大等具体能力变化,可据此判断生成视频工作流的可控程度。
Google DeepMind 发布 Nano Banana 2 Lite 和 Gemini Omni Flash 两款模型,前者是 Nano Banana 系列中速度最快、成本最低的图像模型,后者支持高质量视频生成与对话式编辑。
推荐理由:两款新模型同时开放开发者入口,并给出延迟、价格与能力边界,便于评估多模态工作流成本。
Google DeepMind 发布 Gemini Omni 家族首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并通过自然语言对话逐轮编辑视频。
推荐理由:Gemini Omni 把多模态输入与对话式视频编辑结合,可了解其能力边界与首发落地渠道。