Google DeepMind·· 2026-05-18精选AI 评分85
Google DeepMind 发布 Gemini Omni Flash,支持多模态输入与对话式视频编辑
Introducing Gemini Omni
AI 导读
Google DeepMind 发布 Gemini Omni 系列首款模型 Gemini Omni Flash,支持结合图像、音频、视频和文本生成视频,并通过多轮对话编辑。
推荐理由
多模态参考输入与多轮对话编辑把视频生成延伸到持续修改的工作流,音频输入和输出模态的开放边界也有明确说明。
来源:Google DeepMind · deepmind.google