草稿速度
快 60%
官方口径:360p 预览比 720p 快最多 60%,成本约 ⅓
Gemini Omni Flash 1.1 是 Google 面向高并发场景的轻量视频生成与编辑预览模型。它把文本、图片与视频转化为带原生同步音频的短片,支持首尾帧插值与场景续写,从 360p 快速草稿一路覆盖到 4K 成片。
Gemini Omni Flash 1.1 是 Google 面向高并发场景的轻量视频生成预览模型。文生视频通过 prompt 直接生成带原生同步音频的短片,分辨率最高 4K,成本约为标准档的三分之一。
Gemini Omni Flash 1.1 图生视频支持传入首帧和可选尾帧,严格指定视频的首尾画面,输出带原生同步音频,分辨率最高 4K。
Gemini Omni Flash 1.1 参考生视频支持传入 1-7 张参考图,保持人物与风格跨镜头一致,输出带原生同步音频,分辨率最高 4K。
Gemini Omni Flash 1.1 视频续写从源视频的前 10 秒继续生成,可附带最多 5 张参考图与 prompt 引导续写方向。
Google · Gemini Omni Flash 1.1
Google 面向高并发的轻量视频模型 —— 用 360p 的速度打草稿,用 4K 收尾。
Gemini Omni Flash 1.1 把文本、图片与视频变成带原生同步音频的短片:以约三分之一的成本快速起草,钉住首尾帧精确控制运镜,用 10 秒上下文窗口续写场景。一个统一 API,四种任务模式。
草稿速度
快 60%
官方口径:360p 预览比 720p 快最多 60%,成本约 ⅓
场景续写
10 秒上下文
续写时读取源视频前 10 秒保证衔接一致
任务模式
4 种
文生视频、首尾帧、参考生视频与视频续写
APIPod 价格
$0.45 起
按成品视频计价,360p 下 4-10 秒任意时长
来自 Gemini Omni 模型家族的演示片段。演示素材与标准版系列共享 —— 同一模型血统、同一原生音频管线。
两档都跑在 APIPod 统一 API 上。Flash 1.1 是更新的模型世代,为迭代量而生;标准版 Omni 仍是低成本灵活剪辑的性价比之选。
同一家族、同一统一 API —— 在速度、控制力与价格之间做不同取舍。
| 规格 | Omni Flash 1.1 | Omni 标准版 |
|---|---|---|
| 模型世代 | 1.1(最新,2026 年 8 月 GA) | 1.0 |
| 时长 | 4 / 6 / 8 / 10 秒 | 1-30 秒任意值 |
| 分辨率 | 360p / 720p / 1080p / 4K(默认 720p) | 720p / 1080p |
| 画幅 | 16:9、9:16 | 16:9、9:16、1:1 |
| 参考图 | 最多 7 张 | 最多 5 张 |
| 视频续写 | 从源视频前 10 秒继续 | 从最后一帧继续 |
| 音频 | 原生同步音频 | 原生同步音频 |
| APIPod 价格 | 按分辨率 $0.45 - $4.50 / 条 | 一口价 $0.25 / 条 |
两档走同一个 /v1/videos/generations 端点加任务轮询 —— 切换模型只需改一行 model 字段。
价格透明
一条成品一个价。4-10 秒区间内时长免费 —— 同分辨率下 4 秒草稿和 10 秒成片同价。
| 分辨率 | 每条价格 |
|---|---|
| 360p —— 草稿档 | $0.45 |
| 720p —— 默认档 | $1.35 |
| 1080p | $2.25 |
| 4K | $4.50 |
参考工作流:整段分镜先用 360p 每条 $0.45 打样,只把选中的镜头重生成 4K。
对比参考:Google 官方 API 刊例价为 360p / 720p / 1080p / 4K 每秒 $0.03 / $0.10 / $0.15 / $0.30。APIPod 定价锚定 10 秒最坏成本,短视频不吃亏。
所有模式都是 POST /v1/videos/generations 上的异步任务 —— 提交、轮询、取回视频地址。
gemini-omni-flash-1.1-t2v
仅凭 prompt 生成带原生同步音频的短片。4-10 秒时长,360p 到 4K 任意分辨率。
输入:prompt
gemini-omni-flash-1.1-i2v
关键帧插值:提供首帧与可选尾帧,模型在两帧之间生成平滑过渡 —— 循环、环绕、推拉运镜都可以。
输入:prompt + 1-2 张首尾帧图
gemini-omni-flash-1.1-r2v
最多 7 张参考图,让角色、服装与美术风格在整组镜头里保持一致。
输入:prompt + 1-7 张参考图
gemini-omni-flash-1.1-extend
从源视频前 10 秒继续生成 —— 模型读取完整上下文窗口保证运动与衔接一致,可另附参考图引导方向。
输入:prompt + 源视频 + 可选参考图
提示词案例
一组发挥 Flash 1.1 特长的提示词范式 —— 原生音频、物理表现、首尾帧控制与角色一致性。可直接复制进 API 或控制台试玩。
一条 prompt 同时描述场景、运镜与声音设计 —— 模型带原生环境音直接成片。
提示词
A cinematic tracking shot through a rain-soaked neon street at night, reflections shimmering on wet asphalt, the camera gliding past storefronts, ambient rain and distant traffic sound.
首帧钉一张日出照片、尾帧钉一张星空渲染图 —— Flash 1.1 在两帧之间插值出连续的昼夜过渡。
提示词
Smooth transition from the first frame to the last frame: the sunrise over the mountain ridge gradually becomes a starry night, clouds drifting, the camera slowly orbiting to the right.
同一参考角色在三座不同城市间保持一致 —— 服装、步伐不变,光照随场景适配。
提示词
Using the reference images, the same character walks through three cities — Tokyo, Paris and New York — keeping her outfit and stride consistent, documentary style with ambient street audio.
把生成的定场镜头作为源视频回灌:10 秒上下文窗口让运动与光照在剪辑点上保持连续。
提示词
Continue the scene: the explorer steps through the doorway into the hidden temple, torchlight flickering across the stone walls, suspenseful score swelling.
演示素材与 Gemini Omni 标准版系列共享(同一模型家族的官方演示片段)。
快速上手
四种模式共用一个异步端点:提交任务、轮询状态、取回视频地址 —— 无需 SDK。
完整参数说明(时长 / 分辨率 / 参考图上限)见各模式文档。
import os, requests
payload = {
"model": "gemini-omni-flash-1.1-t2v", # 或 -i2v / -r2v / -extend
"prompt": "A cinematic tracking shot through a rain-soaked neon street...",
"duration": 8, # 4 / 6 / 8 / 10
"resolution": "1080p", # 360p / 720p / 1080p / 4k
"aspect_ratio": "16:9" # 或 9:16
}
resp = requests.post(
"https://api.apipod.ai/v1/videos/generations",
json=payload,
headers={"Authorization": f"Bearer {os.environ['APIPOD_API_KEY']}"},
)
task_id = resp.json()["data"]["task_id"]
# 轮询 GET /v1/videos/status/{task_id} 直到 status == "completed"Flash 1.1 是 Google 面向高并发场景的轻量预览档视频生成与编辑模型,2026 年 8 月起在 Gemini API 正式可用。它生成带原生同步音频的短片,支持首尾帧插值,分辨率覆盖 360p 到 4K。在 APIPod 上通过与其他模型相同的统一异步视频 API 提供。
Flash 1.1 是更新的模型世代:新增 10 秒上下文场景续写、4K 输出、最多 7 张参考图和廉价的 360p 草稿。标准版 Omni 保持最低一口价(每条 $0.25)和灵活的 1-30 秒时长。常见做法是用 Flash 360p 打样分镜,只需便宜直出片段时用标准版。
Flash 1.1 支持 4、6、8、10 秒四种时长,360p、720p(默认)、1080p、4K 四档分辨率,画幅 16:9 或 9:16。按分辨率每条计价 —— 同分辨率下 4-10 秒任意时长同价。
使用 gemini-omni-flash-1.1-extend 模型传入源视频。模型读取源视频前 10 秒作为上下文(而不是只看最后一帧),生成保持运动、光照与音频一致的续写片段。最多可另附 5 张参考图和一条 prompt 引导续写方向。
带。Flash 1.1 在生成画面的同时输出原生同步音频 —— 对白、环境音与配乐。按 Google 官方口径音频属实验特性,个别输出可能无音轨。
按成品视频与分辨率计价:360p 每条 $0.45、720p $1.35、1080p $2.25、4K $4.50。4-10 秒区间内时长免费。生成失败不计费。
POST https://api.apipod.ai/v1/videos/generations,model 填 gemini-omni-flash-1.1-t2v / -i2v / -r2v / -extend。端点返回 task_id,轮询 GET /v1/videos/status/{task_id} 直到 completed 后从 result 取视频地址。完整请求/响应说明见 APIPod 文档。