原生多模态
同时理解文字、图片和视频等不同输入,将角色、场景、动作与创作要求放在同一个上下文中处理,让参考素材真正共同影响最终画面。
Gemini Omni 1.1 Flash 在多模态视频生成基础上进一步升级,新增场景延展、首尾帧控制、360p 快速预览和 4K 输出,让镜头衔接更连贯,创作过程更快、更可控。
Gemini Omni 1.1 Flash 将多模态理解、世界知识与可控视频生成结合在一起,并进一步支持场景延展、首尾帧控制和高分辨率输出,让参考素材、镜头设计与最终成片衔接得更自然。
同时理解文字、图片和视频等不同输入,将角色、场景、动作与创作要求放在同一个上下文中处理,让参考素材真正共同影响最终画面。
基于已有视频继续修改角色、环境、镜头或画面细节,无需每次重新生成完整内容,同时尽量保留已经满意的部分。
结合对现实世界、空间关系和物理规律的理解,更准确地处理人物动作、物体运动与环境互动,让复杂场景更加自然可信。
从已有片段继续生成后续画面,在延长视频的同时保持人物、动作与场景的连贯性,让一个镜头或故事自然向后发展。
分别指定视频的起始画面与结束画面,再通过提示词控制中间的运动和变化,让镜头路径、场景转场与最终落点更加明确。
先以 360p 快速验证构图、动作和镜头方向,确认效果后再生成更高分辨率版本,最高支持 4K,让快速试错与最终交付衔接得更顺畅。
Gemini Omni 1.1 Flash 延续了上一代的多模态生成与对话式编辑能力,并进一步加入视频延展、首尾帧控制和更灵活的分辨率选择:可以先用 360p 快速验证创意,再将满意的结果输出至最高 4K。
| 升级能力 | Gemini Omni Flash | Gemini Omni 1.1 Flash |
|---|---|---|
| 视频延展 | - | 从已有视频继续生成后续场景,最长可延展至 40 秒 |
| 首尾帧控制 | - | 指定起始帧和结束帧,生成中间连续的运动与转场 |
| 分辨率控制 | 标准视频输出 | 360p 快速预览,并支持 720p、1080p 和最高 4K |
如果说 Gemini Omni Flash 更侧重用多模态方式生成和编辑视频,那么 Gemini Omni 1.1 Flash 则更进一步,让创作者不仅能生成内容,还能基于已有结果持续控制、调整,并逐步完成最终成片。
从多参考素材组合、局部视频编辑,到首尾帧特效镜头和高质量成片,Gemini Omni 1.1 Flash 可以适应不同的视频创作方式,让素材、提示词和镜头控制真正参与最终结果。
分别用人物图和环境图确定角色、服装与场景氛围,再通过提示词把不同参考信息组合成一个连贯的电影感镜头。
角色参考
场景参考提示词
使用角色参考中的女性,将她置于雨夜公路加油站。她缓慢走向摩托车、戴上头盔,并看向雨中的空旷公路。保持人物外观、服装与环境一致,使用缓慢的电影感运镜。
输入一段已有视频,只用一句指令替换或调整其中的指定内容,同时尽量保持原有构图、光线、动作和镜头不变。
提示词
只将花瓶改成带细腻开片纹理的深钴蓝釉陶瓷花瓶。保持人物、姿势、工作室、光线、机位和动作不变。
分别指定视频的起始画面和结束画面,再通过提示词控制中间的镜头运动、场景变化与特效过程,让复杂视觉效果按照预设方向自然完成。
起始帧
结束帧提示词
从黄昏时平静的城市高架开始,以巨型怪兽出现在楼宇之间的指定结束帧收尾。使用一个连续镜头逐步推进,让交通停下、远处震动并升起烟雾,最终完整揭示怪兽。
先用 360p 快速测试构图、动作和镜头方向,确认效果后再生成高分辨率版本,把更多时间和成本留给真正满意的镜头。
提示词
保持视频内容不变,将画面放大至 4K。
从输入创意和添加参考素材,到调整生成参数并完成最终视频,只需几个步骤即可开始使用 Gemini Omni 1.1 Flash。
描述你想生成的视频,也可以上传图片、视频或首尾帧,为角色、场景、动作和镜头方向提供更多参考。
根据创作需求选择画幅、时长和分辨率等参数,并决定使用普通生成、参考素材或首尾帧等生成方式。
开始生成视频,查看结果后继续修改提示词或参考素材;需要最终成片时,再选择更高分辨率完成输出。
选择月付、年付或一次性积分,用于 Gemini Omni AI 视频生成、产品视频、广告创意、社交媒体短片和图生视频工作流。
$251.88 / 年
每年省 $106.92
适合入门,满足日常创作需求。
$419.88 / 年
每年省 $178.92
适合稳定创作、内容发布与商业使用。
$839.88 / 年
每年省 $358.92
适合团队、企业及高频创作场景。
所有价格均以美元计价。年付套餐按年收费,积分按月发放。实际积分消耗会根据模型、分辨率、时长和音频设置而有所不同。
常见问题
了解这个模型适合做什么、如何使用,以及不同生成方式之间的区别。
Gemini Omni 1.1 Flash 是 Google 推出的多模态 AI 视频生成与编辑模型,能够结合文字、图片和视频理解创作要求,并生成带音频的视频。除了从零创作,它还支持基于已有结果继续编辑、延展和调整镜头。
加入你的图片、参考视频和创作想法,控制角色、动作与镜头变化,从快速尝试到高质量成片,在同一个创作流程中完成。
免费使用 Gemini Omni 1.1 Flash。