当前页面
Original Omni Flash
- 场景延续上下文
- 仅参考最后 1 秒
- 累计延长时长
- 初始工作流较短
- 首尾帧控制
- 发布时未重点支持
- 草稿分辨率
- 标准生成流程
- 最终分辨率
- 较早期的输出选项
- 视频参考
- 参考工作流较受限
- 适用场景
- 标准 AI 视频生成
上传用于引导人物、视觉风格、动作和节奏的图片、视频片段、Logo 或音频。
使用日常语言说明想要的场景。编辑现有视频时,每次描述一个明确改动,帮助 Gemini Omni 保留无关细节。
生成视频并检查动作、光线、文字和音频,然后继续通过对话完善具体部分,满意后下载。
在一个创作请求中组合文字、图片、音频和视频参考。Gemini Omni 会共同理解这些素材,构建统一场景,而不是把每种输入当成彼此独立的步骤。
使用自然语言指令更换背景、镜头角度、物体或视觉风格。多轮编辑可逐项完善细节,同时维持整个片段的连贯性。
让动作、声音与屏幕文字协调呈现,适合制作更清晰的讲解视频、品牌片段、社交视频和视觉故事,无需分别处理每一种元素。
| 对比项 | 当前页面Original Omni Flash | 新版本Gemini Omni 1.1 Flash |
|---|---|---|
| 场景延续上下文 | 仅参考最后 1 秒 | 最长 10 秒 |
| 累计延长时长 | 初始工作流较短 | 累计最长 40 秒 |
| 首尾帧控制 | 发布时未重点支持 | 支持 |
| 草稿分辨率 | 标准生成流程 | 360p 快速预览 |
| 最终分辨率 | 较早期的输出选项 | 1080p 或 4K 放大 |
| 视频参考 | 参考工作流较受限 | 最长 3 秒 |
| 适用场景 | 标准 AI 视频生成 | 可控制作与快速迭代 |
| 使用 Gemini Omni 创作 | 查看 1.1 Flash |
将简单创意快速变成插画、社交图片和热门风格作品。还可以通过自然语言编辑个人照片,无需复杂的修图软件。
制作风格统一的商品图、AI 虚拟人物、广告素材和信息图。通过多种 AI 模型比较效果、优化版式,并保持营销视觉的一致性。
通过多轮创作完善角色、场景和视觉概念。保持人物面容、服装与艺术方向一致,适用于漫画、故事板、短片及其他创意项目。