自然语言指令
在一段提示词中描述场景、动作、镜头、风格、光线和需要执行的转换。
Gemini Omni 多模态视频生成
根据提示词和视觉参考创建视频,或用自然语言修改现有片段。选择输出规格后,在线跟踪异步生成结果。
输出
视频会显示在这里
填写提示词、添加可选参考素材并提交 Gemini Omni 任务。
模型介绍
Gemini Omni 是一款多模态 AI 视频生成器,可以同时理解文字提示词、参考图片和可选的源视频。
你可以用文字和图片创建新视频,也可以修改已有片段,并明确说明哪些内容需要变化、哪些需要保持一致。
页面会通过 Kie 异步提交和跟踪任务,并把完成的视频保存到私有存储,供登录用户预览和下载。
多模态视频指导
结合自然语言和视觉上下文,再为发布渠道选择合适的输出设置。
在一段提示词中描述场景、动作、镜头、风格、光线和需要执行的转换。
添加图片提供视觉指导,也可以上传一个源视频进行转换或编辑。
支持横屏或竖屏、720p、1080p 或 4K;未添加源视频时还可选择时长。
跟踪 Kie 任务,并通过私有预览和下载链接获取完成的视频。
三个关键步骤
给出清晰指令,只添加真正需要的视觉上下文,然后查看完成结果。
定义主体、动作、视觉效果和镜头行为;编辑时还要说明必须保持一致的内容。
上传参考图片或可选源视频,再选择可用的画面比例、分辨率和时长。
提交多模态任务、跟踪状态,并预览或下载私有保存的输出。
有选择地使用视觉参考,并明确写出每一项需要发生的变化。
常见问题
它可以根据提示词和参考图生成视频,也可以根据自然语言指令转换一个上传的视频。
页面支持最多 7 个素材单位。每张图片占 1 个单位,可选源视频占 2 个,因此添加视频后还能加入最多 5 张图片。
没有源视频时可选 4、6、8 或 10 秒;添加源视频后,Gemini Omni 会自动决定输出时长。
Kie 任务成功后,FramePack 会私有保存结果,并提供需要登录访问的预览和下载链接。
组合提示词与用途明确的视觉参考,使用 Gemini Omni 创建下一条视频。
使用 Gemini Omni 创建