Gemini Omni · 视频 + 角色 + 音频

Gemini Omni AI 视频工作室

在 SoraVideo 的同一工作区中创建 Gemini Omni 视频、可复用角色和自定义音频配置。用文本、图片、源视频、角色 ID 和音频 ID 进行创作,并共享同一个积分余额。

Gemini Omni AI 视频生成器 - SoraVideo 上的 Google 下一代 Omni 模型

需要输入提示词才能生成 Gemini Omni 视频。

Gemini Omni图片 0/7视频 0/1角色 0/3音频 0/1
60

Gemini Omni 实战演示

SoraVideo 上的 Gemini Omni 工作流现在把视频生成、可复用角色创建和自定义音频配置合到同一页面,并对应 Kie Gemini Omni API 的模型系列。

Gemini Omni 文生视频电影级 4K 输出示例
文生视频 · 8 秒 · 4K

电影级 4K 文本提示词

提示词 '黄昏时分被雪覆盖的东京街道,电影感变形宽银幕镜头,水坑里的霓虹倒影,缓慢向前推镜。' 不使用参考图,由 Gemini Omni 级流程纯文生视频生成。
Gemini Omni 图生视频动画 - 细腻人像动态对比
图生视频 · 6 秒 · 1080P

细腻人像动态

输入 窗边女性静态人像。提示词 '头发轻轻摆动,头部稍微向右转,自然柔光。' Gemini Omni 图生视频流程会保持人物身份稳定。

什么是 Gemini Omni?

Gemini Omni 是 Google 面向视频优先生成的多模态创作模型系列。Kie Gemini Omni API 提供三个实用模块:Gemini Omni Video 用于多模态视频生成与编辑,Gemini Omni Character 用于可复用身份,Gemini Omni Audio 用于可复用声音配置。

Video 模型支持自然语言提示词、参考图片、一个源视频、一个音频 ID,以及最多三个角色 ID。Character 模型可通过图片和描述创建稳定身份素材。Audio 模型可通过名称、声音描述和可选示例台词创建可复用的声音元数据。

在 SoraVideo.art,这三个模块现在整合进一个带 Tab 的 Gemini Omni 工作室。先创建角色,再创建声音,然后在 Video Tab 中直接引用这两个 ID,无需在多个落地页之间跳转。

Gemini Omni 图生视频动画 - 细腻人像动态对比

为什么选择 Gemini Omni 模型

Gemini Omni 在 Google 视频模型中突出的优势是电影级 4K 输出、Gemini 原生多模态能力,以及 SoraVideo 上按量付费的价格。

电影级 4K Gemini Omni 输出

在没有源视频时,可生成 720P、1080P 或 4K 视频,并选择 4、6、8 或 10 秒。使用源视频时,Gemini Omni 会让模型自动决定输出时长。

真正多模态的 Gemini Omni

文本提示词、参考图片、源视频、音频 ID 和角色 ID 都会进入同一个 Gemini Omni Video 任务。这符合 Kie API 的结构,而不是把每种创作输入拆成单独流程。

基于 Google Gemini 构建

继承 Google Gemini 系列的世界知识和提示词理解能力,包括 Gemini 3 和 Gemini 2.5 Omni 研究路线。提示词可以引用真实概念、品牌和物理现象,并保持你期待的 Google 级精确度。

视频、角色与音频 Tab

Video 用于最终视频,Character 用于可复用视觉身份,Audio 用于可复用声音配置。三个模块共享同一套 SoraVideo 积分和登录流程。

约 60 秒快速生成

SoraVideo 的预览流程在 1080P 下约 60 秒返回 6 秒短片,4K 档约 90 秒,足够用于快速分镜迭代和提示词微调。

毛利安全的按量付费价格

零售积分按 Kie 成本倒推,并以 70% 以上毛利为目标。视频最低 45 积分即可生成 4 秒 720P/1080P 短片,角色和音频素材按固定单次价格创建。
Gemini Omni 文生视频电影级 4K 输出示例

你可以用 Gemini Omni 创作什么

从电影短片到 TikTok 循环视频,再到 Gemini Omni 数字人,SoraVideo 创作者用 Gemini Omni 预览流程更快发布视频内容。

Gemini Omni 电影短片用例 - 黑色电影小巷场景

电影短片

擅长情绪化黑色电影光影、戏剧化镜头运动和氛围场景搭建,适合电影短片、音乐视频和分镜预览。
Gemini Omni TikTok 和 Reels 竖屏视频用例示例

TikTok、Reels 与 YouTube Shorts

竖屏 9:16 视频适配移动端信息流。把提示词和热门音频结合,不用拍摄即可每天发布短视频内容。
Gemini Omni 产品营销视频 - 高端护肤品广告示例

产品营销与广告

用图生视频把静态产品图转成旋转展示,非常适合电商商品页、广告素材和 AI 驱动的新品发布。
Gemini Omni 数字人生成 - AI 角色动画特写

Gemini Omni 数字人与角色

数字人模式可在画面间保持脸部、发型和服装一致,适合叙事场景、口播讲解和系列内容中的固定角色。
Gemini Omni 自然 B-roll 素材 - 雾中山间日出

B-roll 与素材镜头

按需生成电影感 B-roll:山景延时、城市天际线、海浪画面。不用外拍,不用素材授权,只需一个提示词。
Gemini Omni 叙事动画 - 吉卜力风格森林灯笼场景

叙事与动画

同样适合绘画感吉卜力风格场景和写实光影,可用于动画叙事、儿童内容和插画讲解视频。

如何使用 Gemini Omni 工作室

用一个页面完成完整 Gemini Omni 工作流:角色、声音,然后生成最终视频。

1

第 1 步 - 创建可复用素材

打开 Character Tab,用人像生成可复用角色 ID;或打开 Audio Tab,根据声音描述生成可复用声音 ID。
2

第 2 步 - 编写视频提示词

打开 Video Tab,写好场景提示词,再按需加入参考图片、一个源视频、角色 ID 和一个音频 ID。
3

第 3 步 - 选择输出设置并生成

选择分辨率、画面比例和时长。如果上传了源视频,时长会切换为自动,因为 Kie 会根据输入视频决定。
如何用 3 个简单步骤使用 Gemini Omni - 描述、定制、生成

Gemini Omni 价格 - 720P、1080P 与 4K

SoraVideo 上 Gemini Omni 按量付费。零售价根据 Kie 成本设定,以保持 70% 以上毛利;更高档 Kie 充值约可让上游成本降低 10%。

文生视频与图生视频

不含视频输入 - 文本提示词、参考图片、角色和可选音频 ID

分辨率4 s6 s8 s10 s
720P / 1080P45 积分60 积分75 积分90 积分
4K105 积分120 积分135 积分150 积分

视频转视频

含视频输入 - 用 Gemini Omni 编辑和重塑已有素材

分辨率每次生成
720P / 1080P每次生成 120 积分
4K每次生成 180 积分
角色每个可复用角色 20 积分
音频每个可复用声音配置 15 积分

已计入 Kie 成本基准

Kie 公示的不含视频输入成本为 $0.15 到 $0.50,含视频输入成本为 $0.40 到 $0.60。SoraVideo 零售积分约按 Kie 标价 3 倍定价,即使计入 Kie 充值折扣,仍能保留 70% 以上毛利。
Gemini Omni 视频、角色和音频生成积分价格

Gemini Omni 对比 Veo 3、Sora 2 与 Hailuo 2.3

基于 Gemini Omni 相关发布信息和公开基准,对比 Gemini Omni 模型与 Google Veo 3、OpenAI Sora 2、MiniMax Hailuo 2.3。

功能Gemini OmniVeo 3Sora 2Hailuo 2.3
最高分辨率4K1080P1080P1080P
最长时长10 秒8 秒20 秒10 秒
文生视频
图生视频
视频转视频
原生音频预期支持
数字人模式
6 秒 1080P 价格60 积分$0.30$0.50+$0.15
生成速度约 60 秒约 75 秒约 90 秒约 30 秒

Gemini Omni 规格基于 Google 发布信息整理,仍属暂定,可能在 Gemini Omni 正式发布时变化。

Gemini Omni 对比 Veo 3、Sora 2 与 Hailuo 2.3 的电影质量

Gemini Omni 常见问题

了解 Google Gemini Omni AI 视频模型,以及如何在 SoraVideo 上使用 Gemini Omni。

什么是 Gemini Omni?

Gemini Omni 是 Google 备受期待的下一代多模态 AI 视频模型,基于 Gemini 前沿模型系列构建。它预计会在统一端点中提供电影级 4K 视频、文生视频、图生视频、视频转视频和数字人生成能力。Google 已通过内部演示和预告透露该模型,正式发布时间仍待公布。

如何使用 Gemini Omni?

使用上方的 Tab。先在 Character Tab 从图片创建角色 ID,再在 Audio Tab 创建声音 ID,然后把这些 ID 连同提示词、图片或源视频一起粘贴到 Video Tab。

如何访问 Gemini Omni?

直接访问目前仅限 Google 私测用户,但你今天就可以在 SoraVideo 预览同类生成体验。我们把端点接入统一积分系统,一旦 Google 向公众开放正式 API,本页所有提示词都会在不改变 UI 的情况下切换到真实模型。

Gemini Omni 免费吗?

Gemini Omni 生成需要付费积分。目前零售价从 4 秒 720P/1080P 视频 45 积分起,可复用角色每个 20 积分,可复用音频配置每个 15 积分。$9.99 首次创作包包含 500 积分且无需订阅。

Gemini Omni 什么时候发布?

该模型已在 Google 发布信息和测试者演示中出现,但官方尚未公布发布日期。SoraVideo 预览版让你现在就能用相同提示词和分镜先做实验,等待官方 API 上线。

这个 gemini omni 模型基于什么?

当前预览流程会把提示词路由到我们的 Sora 2 Pro 和 Hailuo 2.3 视频模型,方便你现在就迭代分镜。Google 正式模型上线后,SoraVideo 的同一套 UI 会切换到真实端点,不改变你的工作流。

Gemini Omni 有 API 吗?

有。SoraVideo 已接入 Kie.ai Gemini Omni API:gemini-omni-video、gemini-omni-character 和 gemini-omni-audio。视频任务通过我们的服务端路由支持 prompt、image_urls、audio_ids、video_list、character_ids、duration、aspect_ratio、resolution 和 seed。

Gemini Omni 能生成 4K 视频吗?

可以。Video Tab 支持 4K 输出。无视频输入时,4 秒 105 积分、6 秒 120 积分、8 秒 135 积分、10 秒 150 积分。含视频输入时,4K 每次生成 180 积分。

我可以生成多少个 Gemini Omni 视频?

可生成的视频数量没有硬性上限,每次渲染只会从你的积分余额中扣除。一次充值即可按需生成数百个视频。高档充值还会额外获得 10% 奖励积分。

Gemini Omni 和 Veo 3 哪个更好?

Gemini Omni 被定位为 Veo 3 的多模态后继者,同属 Google Gemini 系列,但加入 4K 电影级输出、视频转视频编辑、数字人和统一端点,整合视觉、音频与运动。Veo 3 在当前一代仍领先于原生音频,而新模型预计会在音频上追平 Veo 3,并在分辨率和多模态能力上超过它。

Gemini Omni 可以创建数字人吗?

可以,数字人模式是最受期待的功能之一。数字人由参考图片加脚本驱动,可生成身份、发型和服装在每一帧都一致的稳定口播视频,非常适合讲解视频、课程开场和系列角色。

Reddit 上有人讨论 Gemini Omni 吗?

讨论主要集中在 r/Bard、r/singularity 和 r/aivideo,创作者会分享泄露信息、演示、提示词指南和发布时间猜测。SoraVideo 会持续整理出现的优质样片和基准结果。

相关 AI 视频与图片工具

在官方 Gemini Omni 端点逐步开放期间,你也可以探索 SoraVideo 上的其他 AI 视频模型,所有工具共享同一积分和类似 Gemini Omni 的工作流。

开始使用 Gemini Omni 生成

创建可复用角色,生成自定义声音 ID,然后在同一页面完成最终 Gemini Omni 视频。

Gemini Omni 是 Google 的产品名称。SoraVideo.art 是独立聚合平台,与 Google 无隶属关系。本页面的 Gemini Omni API 访问通过 Kie.ai 服务端端点路由,如果上游模型参数变化,接入方式也可能调整。