Gemini 3.8 Live 推出 Live Avatar 实时虚拟形象功能
Google DeepMind 在 Gemini 3.8 Live 中推出 Live Avatar 功能,把近实时视频生成与原生语音对话结合,为企业场景提供带口型同步、自然表情和流畅轮换的对话体验。
Google DeepMind 在 Gemini 3.8 Live 中推出 Live Avatar 功能,把近实时视频生成与原生语音对话结合,为企业场景提供带口型同步、自然表情和流畅轮换的对话体验。
Google Beam 新增加拿大、英国、法国、德国、日本共 5 个国家,覆盖扩展至 6 个国家,由 18 家渠道合作伙伴交付 HP Dimension 设备。
Google DeepMind 在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 中上线 agentic 视频理解功能,可将 token 消耗降低最多 88%、成本降低最多 66%,分析精度最高提升 7%。
推荐理由:对比传统固定帧率处理方式,原文给出 token 消耗与精度的具体改进幅度,可作为评估新视频管线效果的参考。
Google DeepMind 推出 Gemini Omni 1.1 Flash,新增场景延长、首尾帧插值、4K 放大和视频参考等视频生成控制能力。场景延长可参考最多 10 秒上文,单次累计上限 40 秒;360p 预览生成速度比 720p 快 60%,成本降至三分之一。
推荐理由:原文列出了 Omni 1.1 Flash 在场景延长、首尾帧插值和 4K 放大等具体控制能力上的更新,可帮助开发者判断它能接入哪些视频生产工作流。