Google DeepMind(Veo)·· 2026-05-18精选AI 评分88
Google DeepMind 发布 Gemini Omni Flash,支持多模态输入生成与对话式视频编辑
Introducing Gemini Omni
AI 导读
Google DeepMind 发布 Gemini Omni 家族首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本作为输入生成高质量视频,并通过自然语言对话进行多轮编辑,保持角色一致性与物理表现。
推荐理由
Gemini Omni Flash 支持图像、音频、视频和文本混合输入生成视频,并可用自然语言多轮编辑,读者可据此判断它能否接入自己的创作流程。
来源:Google DeepMind(Veo) · deepmind.google