跳到正文
原文
Google DeepMind·· 2026-05-18精选AI 评分69

Google DeepMind 发布 Gemini Omni Flash

Introducing Gemini Omni

AI 导读

Google DeepMind 发布 Gemini Omni Flash,支持图像音频视频文本多模态输入生成视频并通过自然语言对话编辑,模型融合物理理解与世界知识推理。该模型今日起面向 Gemini app、Google Flow 及 YouTube Shorts 开放,所有视频均带有 SynthID 数字水印。

推荐理由

Google DeepMind 发布 Gemini Omni Flash,将推理与创造能力结合,支持图像音频视频文本多模态输入生成视频并可通过对话编辑,为视频创作提供了融合物理理解与世界知识的生成新路径。

来源:Google DeepMind · deepmind.google