跳到正文
原文
Google DeepMind(Veo)·· 2026-05-18精选AI 评分88

Google DeepMind 发布 Gemini Omni Flash,支持多模态输入生成与对话式视频编辑

Introducing Gemini Omni

AI 导读

Google DeepMind 发布 Gemini Omni 家族首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本作为输入生成高质量视频,并通过自然语言对话进行多轮编辑,保持角色一致性与物理表现。

推荐理由

Gemini Omni Flash 支持图像、音频、视频和文本混合输入生成视频,并可用自然语言多轮编辑,读者可据此判断它能否接入自己的创作流程。

来源:Google DeepMind(Veo) · deepmind.google