文本生成视频
描述场景、镜头列表、时间安排、对白与声音。Gemini的世界知识能让生成的动作在视觉和叙事上更加合理。
- 3–10秒片段,带原生音频
- 16:9 landscape or 9:16 portrait
创作。修改。继续。
从文本或图像生成,连接首尾帧,用文字编辑片段并延续故事——从快速360P草稿到4K成片,全程带原生音频。
3,482,705+ happy users
先以360P探索构图与动作,再转至原生默认的720P,最后为交付选择升采样的1080P或4K输出。创意方向与最终成片规格可以分开决定。
Omni 1.1不只是生成器。它可从不同媒体开始,在编辑过程中保留上下文,并从镜头结尾继续生成。
描述场景、镜头列表、时间安排、对白与声音。Gemini的世界知识能让生成的动作在视觉和叙事上更加合理。
让照片、产品图、插画或草图动起来,并指导主体动作、镜头运动与环境声音。
精确设置开场和结束图像,再描述二者之间的连续运动,用于转场、环绕、揭示与循环。
上传短片并描述修改。无需重写完整提示词,即可替换物体、重塑场景风格、调整光线或细化结果。
使用最多10秒的前序素材作为上下文,从镜头结尾继续生成新的动作、运镜、对白与声音。
以下片段均来自Google官方发布的Omni 1.1。请打开声音播放,了解控制能力、连贯性与原生音频如何协同工作。
查看Google官方发布文章 ↗镜头跟随对话从地下墓穴后退至悬浮图书馆,同时保持故事与声音连贯
同一源镜头可延展为推拉变焦、快速变焦和环绕凝固时空等不同运镜
关键帧可变成连贯的甩镜转场和无缝循环运镜
通过轻量预览测试微观构图,再进行更高分辨率渲染
鱼、花栗鼠与秋叶展示从草稿到最终交付的分辨率阶梯
三个角色设计分别继承短参考片段中的不同舞蹈动作
上传片段,说明需要修改的内容以及必须保持不变的内容。当新物体、角色或风格需要精确依据时,请添加视觉参考。
上传首帧和尾帧,再描述二者之间的过程。Omni会对完整运动进行推理,而不会把终点当成事后附加的要求。
Omni 1.1会在生成续篇前读取最多10秒的前序素材,为下一段提供角色、动作、镜头、对白、环境声与音乐的上下文。
打开“延展视频”工具 →可从文本、单帧、两个关键帧、参考图、现有片段或“延展视频”工具开始。
不仅描述开场图像,还要指导主体动作、运镜、光线、对白、音乐与定时事件。
使用360P快速探索,以720P作为原生默认值,或选择升采样至1080P或4K的成片。
Use a generated clip as the next source: change one detail conversationally or continue the story from its ending.
说明编辑或延展时哪些内容必须保持不变。一句简短的保留指令即可为修改划定清晰边界。
“将红色汽车替换为银色双门轿跑。驾驶员、运镜、街道、光线和配乐保持不变。”
Omni默认可能会组合多个镜头。当运镜连贯性很重要时,请明确要求连续、不中断且无剪切的场景。
“一个连续手持镜头。蒸汽弥漫厨房时,镜头环绕厨师移动。不要剪切。保持房间布局一致。”
配乐为原生生成,因此请指定对白、环境声、音乐,以及每种声音开始或停止的时间。
“全程有远处车流声与轻柔雨声。第5秒,她说“我找到了”。门打开后音乐才开始。”
当多个动作或视觉变化必须按特定顺序发生时,将片段划分为简单段落。
“[0–3秒] 跟随弹珠。[3–6秒] 弹珠触发杠杆。[6–10秒] 镜头后拉,展现整台机器。”
生成按输出秒数计费。使用草稿档位探索方向,将更高分辨率档位留给已确认的方案。
先生成低成本360P草稿,比较动作与构图,再将最佳方向提升至更高分辨率档位。
通过可控镜头路径连接两个关键帧,或在首尾使用同一图像来设计循环。
修改一个物体、表面、环境或一行可见文字,同时要求模型保留片段其余部分。
从现有结尾继续动作、对白、音乐与运镜,无需从头重建场景。

Jeff Wilson
By far the best compilation AI utility
By far the best compilation AI utility out there. Period. We have tried multiple platforms that would work for us - a small business - and it was a bit overwhelming two years ago. Easy-Peasy has been a godsend. So many freaking tools and no fewer than 10 (of the 200) are ones we use at least on a weekly basis. Ironically, their human support is one of the most appreciated elements.

Cody Crabb
Great service, Best AI tool

Easy-Peasy AI
Blanca Marin
I really liked the easy-peasy AI service. It's a great tool, but I also had to ask them for a refund because I chose the wrong plan, and they were very quick to respond to my request. They looked into my case and I got my money back without any problems. Of course, I will continue to use it for my projects.

Easy-Peasy AI
关于Gemini Omni 1.1 Flash,您需要了解的一切
Gemini Omni 1.1 Flash是Google于2026年8月27日发布、可用于生产的多模态视频生成与编辑模型。它将Gemini的推理能力与世界知识,同文本生成视频、图像生成视频、关键帧插值、对话式编辑、参考、延展和原生音频结合起来。
Easy-Peasy.AI上的新生成可在3–10秒之间按整秒设置。“延展视频”工具可为支持的源片段再增加3–10秒。
不是。Google将720P列为原生默认分辨率,并将1080P和4K描述为升采样输出。360P档位用于在最终分辨率渲染前,更快速、低成本地制作草稿。
会。每个输出都包含原生立体声音频。请将对白、音效、音乐、环境声与时间安排作为场景的一部分写入提示词。当前API没有无声生成开关。
选择Gemini Omni Flash 1.1 Reference,上传4–10秒的源片段,并用自然语言描述修改。如果新角色、物体或风格需要视觉依据,可添加最多5张参考图。
可以。选择Gemini Omni Flash 1.1 First-Last Frame,上传两个关键帧,并描述连接二者的运动。它适用于揭示镜头、相机环绕、匹配转场和无缝循环。
Generation pricing scales with duration and resolution: 0.9 credits per second at 360P, 3 at 720P, 4.5 at 1080P, and 9 at 4K. Totals are rounded to whole credits. Video extension also bills the source duration because the complete clip is rendered again.
每个Gemini Omni生成的视频都包含Google用于来源证明、肉眼不可察觉的SynthID水印。它不是可见徽标或角落标记。
可以。在遵守Easy-Peasy.AI使用条款、Google模型政策,并拥有所上传源素材相关权利的前提下,您可将输出用于广告、社交媒体帖子、产品页面、客户项目及其他商业项目。
