← 返回资讯
大模型 @Google

Google Gemini Omni实现对话式视频编辑

Google Gemini Omni让视频编辑变得如对话般简单,用户可通过自然语言请求直接重塑视频中的动作场景。

查看原文
TL;DR · 产品解读

Google在Gemini Omni中集成对话式视频编辑功能,用户可直接用自然语言修改视频动作场景。这标志着AI视频编辑从「生成式」向「交互式」演进,普通人也能做专业剪辑了。

深度解读

Google在Gemini Omni中正式推出对话式视频编辑能力,这是继文本生成图片、文本生成视频之后,AI视频领域的下一个关键节点——交互式视频修改

产品是什么?

Gemini Omni的对话式视频编辑允许用户通过自然语言指令,直接对视频中的动作场景进行重塑。比如你可以说「让这个角色跳过障碍物」或「把背景换成城市夜景」,系统会理解语义并修改对应帧的内容。这意味着:

解决什么问题?

传统AI视频工具(Runway、Pika)本质是「生成」,用户得到的是全新片段。而Gemini Omni解决的是「修改」问题——你有一段素材,想改某个动作/物体/场景,不需要重新生成整段视频。这对内容创作者、品牌营销、教育视频场景价值巨大。

目标用户是谁
未登录访客
SMARTFLOW PRO

继续阅读深度解读 + 编辑加注

下方还有 3-5 段深度分析 + Vincent 编辑加注 + 可点击信源,仅 Pro 会员可见

加入机智流 PRO →

¥99 / 季 · 每周 1 篇深度研报 · 飞书+微信群双通道

已是 Pro 但仍被提示?联系反馈

参考来源
  1. Google Gemini Omni实现对话式视频编辑 · 2026-06-01
  2. Runway Gen-3产品页 · 2024
  3. Pika 1.5发布公告 · 2024
本解读由 AI 自动生成 · 模板:产品解读 · 仅供参考,请以原文为准。