跳到正文
原文
Google DeepMind:Blog(RSS)·· 2026-05-18精选AI 评分80

Google DeepMind 发布 Gemini Omni Flash,支持多模态输入生成与对话式编辑视频

Introducing Gemini Omni

AI 导读

Google DeepMind 发布 Gemini 家族首个模型 Gemini Omni Flash,可将图像、音频、视频和文本组合作为输入,生成高质量视频,并支持通过自然语言多轮编辑视频、保持角色和场景一致。

推荐理由

原文介绍了 Gemini Omni Flash 的多模态输入、对话式视频编辑能力和开放范围,读者可以判断它对视频创作流程的影响。

来源:Google DeepMind:Blog(RSS) · deepmind.google