Google DeepMind·· 2026-05-18
Google DeepMind 发布 Gemini Omni Flash,支持多模态输入生成与对话式视频编辑
Introducing Gemini Omni
SI 导读
Google DeepMind 发布 Gemini Omni 家族首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本输入生成高质量视频,并通过自然语言多轮对话编辑视频。
精选SI 评分82
推荐理由
Gemini Omni Flash 把视频生成与对话式编辑合并到同一模型,读者可据此判断多模态创作入口的变化。
来源:Google DeepMind · deepmind.google