输出档位
1K · 1.5K · 2K
也可自定义宽×高,总像素 921,600–4,624,220;1.5K 按 1K 价格计费。
Seedream 5.0 Flash 是字节研发的一款兼顾速度与成本效率的快速图像创作模型,支持精准编辑、图层拆分、透明背景图输出,适合高频、规模化图片生产和快速交互场景。
Seedream 5.0 Flash 是字节跳动 Seedream 5 系列的极速档位,提示词遵循与文字渲染能力与 Pro 一致、生成更快。每次生成 1 张 1K、1.5K 或 2K 图片,支持 PNG / JPEG,适合对时延敏感的业务。
Seedream 5.0 Flash Edit 是 Seedream 5.0 Flash 的参考图编辑模式,支持 1-10 张源图片的多图融合、基于标记或 / 坐标的交互式编辑,以及对单张透明 PNG 的透明背景编辑。
Seedream 5.0 Flash 图层拆分是更快速的图层拆分模式:输入 1 张设计图,输出一张底图和最多 16 个透明 PNG 图层,每张都附带 z_index、位置框、名称和描述,按次计费。
ByteDance Seed · Seedream 5.0 Flash
Pro 级编辑与图层能力,Flash 级速度与成本。
Seedream 5.0 Flash(doubao-seedream-5-0-flash-260915)是字节跳动 Seedream 5.0 家族中速度更快、价格更低的一档。它保留了 Seedream 5.0 的招牌能力——指哪改哪的交互编辑、拆分为透明 PNG 的图层能力、原生多语种文字——同时生图更快、成本更低。APIPod 将其拆分为文生图、编辑、图层拆分三个 API 模型,一个 Key 即可调用。
带草图标记的输入图
输出提示词
根据手绘草图对图像进行编辑。在左下角标记区域添加一叠真实的杂志或艺术画册,并在右侧标记区域添加一个带杯碟的陶瓷杯咖啡。移除所有草图线条。保持构图不变。让新添加的物体自然融入原有场景中。
输出档位
1K · 1.5K · 2K
也可自定义宽×高,总像素 921,600–4,624,220;1.5K 按 1K 价格计费。
参考图
最多 10 张
多图融合、主体放置、材质与服装替换。
图层拆分
底图 + 16 层
透明 PNG 图层,附带 z_index、bounding_box、名称与描述。
原生文字语种
新增 14 种
包括日语、韩语、阿拉伯语、泰语、越南语、俄语、西班牙语、法语、德语等。
字节跳动将 Flash 定位于对时延与成本敏感的场景。它与 Seedream 5.0 Pro 能力一致,选型取决于吞吐与预算,而不是功能取舍。
批量生成商品图、广告变体与社媒素材。更快的出图速度与更低价的 Flash 档位,让大规模批处理和创意 A/B 测试真正可行。
把用户在你画布里的点击和拖框直接转换为 <point> / <bbox> 坐标。更快的响应让“点哪改哪”的工具保持流畅手感。
把海报、封面、Banner 拆成干净的底图与透明图层,再用程序替换文案、商品或配色,沉淀为可复用模板。
在画面中原生渲染十余种语言的文字,一套主视觉即可输出到各个市场,无需逐张人工修图。
交互编辑
Seedream 5.0 Flash 能理解提示词中的位置信息。标出一个点、一个框或一段手绘草图,模型只修改对应区域,并让结果自然融入原有画面。
| 适用场景 | 提示词写法 |
|---|---|
| 编辑指定点附近的对象 | 把图 1 <point>520 460</point> 位置换成皇冠 |
| 编辑指定区域内的内容 | 把图 1 <bbox>120 180 640 760</bbox> 区域替换成花园 |
| 跨图片移动主体 | 将图 1 <bbox>179 283 796 986</bbox> 的主体放到图 2 <bbox>118 331 933 871</bbox> 位置 |
| 保护某个区域不被修改 | 把图 1 <bbox>120 180 640 760</bbox> 区域替换成花园,图 1 <bbox>700 120 920 360</bbox> 区域保持不变 |
坐标相对图片归一化:左上角为 0,0,右下角为 999,999,与真实像素尺寸无关。点击位置换算公式为 x = round(x_px / 宽 × 1000)、y = round(y_px / 高 × 1000)。
点击 → 归一化 <point>
// 把在展示图片上的点击转换为 Seedream 的 <point> 标记
function toPoint(event, img) {
const rect = img.getBoundingClientRect();
const x = Math.round(((event.clientX - rect.left) / rect.width) * 1000);
const y = Math.round(((event.clientY - rect.top) / rect.height) * 1000);
const clamp = (v) => Math.min(999, Math.max(0, v));
return `<point>${clamp(x)} ${clamp(y)}</point>`;
}当框选区域内有多个主体时,用文字补充目标对象,例如“左侧的人”“戴帽子的猫”,帮助模型稳定选中正确的编辑对象。
图层拆分
向 seedream-5.0-flash-layer 发送 1 张图片,即可得到 1 张底图和最多 16 个透明 PNG 图层。可以让模型自动识别主要元素,也可以用文字描述要拆的内容,或用 <bbox> 坐标精确指定区域。
输入图(不传提示词)
底图
图层 1
图层 2
图层 3使用通用指令,模型自动识别主体、文字、背景与装饰元素并逐一拆分。
用自然语言说明需要什么,例如“拆出人物、标题文字和右下角装饰图标”。
为每个需要单独成层的元素传入 <bbox>x1 y1 x2 y2</bbox>(0–999 归一化坐标)。
每个图层都附带 z_index 与归一化 bounding_box。在宽 W、高 H 的画布上,放置位置为 x = left / 1000 × W、y = top / 1000 × H,尺寸缩放为 (right − left) / 1000 × W 乘 (bottom − top) / 1000 × H。
图层拆分按请求次数计费,与返回的图层数量无关。
三者均对应同一个上游模型 doubao-seedream-5-0-flash-260915,通过 APIPod 异步图片 API 调用。
能力相同,取舍不同。官方描述中 Pro 生图质量更高,Flash 生图速度更快、价格更低。
| 规格 | Seedream 5.0 Flash | Seedream 5.0 Pro |
|---|---|---|
| 上游模型 | doubao-seedream-5-0-flash-260915 | doubao-seedream-5-0-pro-260628 |
| 适用场景 | 对时延与成本敏感的业务 | 对画质要求更高的场景 |
| 提示词优化模式 | 标准模式 | 标准模式、极速模式 |
| 输出档位 | 1K / 1.5K / 2K,支持自定义宽×高 | 1K / 1.5K / 2K,支持自定义宽×高 |
| 交互编辑 | 点选、框选、箭头、手绘草图 | 点选、框选、箭头、手绘草图 |
| 图层拆分 | seedream-5.0-flash-layer | seedream-5.0-pro-layer |
| 参考图 | 最多 10 张 | 最多 10 张 |
两款模型均不支持组图生成、联网搜索与流式输出——如需这些能力请使用 Seedream 5.0 Lite。
了解 Seedream 5.0 Pro API价格
字节跳动将 Flash 定价为低于 Pro 的高性价比档位。APIPod 上每个模型的实时价格展示在模型卡片与价格页。
按输出图片张数计费,1.5K 与 1K 同价。
按输出图片张数计费。首张输入图免费,每多一张参考图加收少量费用。
每次请求固定价格,与返回的图层数量无关。
任务失败自动退款,价格以美元计。
查看完整价格官方示例
以下前后对比示例来自官方《Seedream 5.0 pro / flash 教程》。两款模型共享这些能力,相同提示词可直接用于 Flash 模型 ID。
输入
输出提示词
将图 1 <bbox>179 283 796 986</bbox> 的主体放到图 2 <bbox>118 331 933 871</bbox> 位置。
输入
输出提示词
将图片中的鹦鹉改为孔雀

Seedream 5.0 pro / flash 新增 14 种语言的原生文字生成能力:俄语、阿拉伯语、菲律宾语、泰语、土耳其语、韩语、马来语、西班牙语、葡萄牙语、印尼语、法语、德语、越南语与日语。
图片与提示词来源:火山方舟 / BytePlus ModelArk《Seedream 5.0 pro / flash 教程》。
快速开始
提交任务、轮询状态、读取结果。切换文生图、编辑与图层拆分只需修改模型 ID。
使用 seedream-5.0-flash-layer 时,结果中还会包含 images 数组,逐层给出 z_index、bounding_box、name 与 description。完整参数见 Seedream 5.0 Flash 文档。
import os, time, requests
headers = {"Authorization": f"Bearer {os.environ['APIPOD_API_KEY']}"}
payload = {
"model": "seedream-5.0-flash-edit", # 或 seedream-5.0-flash / seedream-5.0-flash-layer
"prompt": "把图 1 <bbox>120 180 640 760</bbox> 区域替换成花园",
"image_urls": ["https://example.com/room.png"],
"quality": "2K", # 1K / 1.5K / 2K
"aspect_ratio": "16:9",
}
resp = requests.post("https://api.apipod.ai/v1/images/generations", json=payload, headers=headers)
task_id = resp.json()["data"]["task_id"]
while True:
data = requests.get(f"https://api.apipod.ai/v1/images/status/{task_id}", headers=headers).json()["data"]
if data["status"] in ("completed", "failed"):
print(data["status"], data.get("result"))
break
time.sleep(2)Seedream 5.0 Flash 是字节跳动 Seed 团队 Seedream 5.0 图像家族中速度更快、价格更低的一档(上游模型 doubao-seedream-5-0-flash-260915)。它支持文生图、单图 / 多图编辑、坐标交互编辑、图层拆分与原生多语种文字,面向对时延与成本敏感的业务场景。
创建 APIPod API Key 后,向 /v1/images/generations 发送请求,model 设为 seedream-5.0-flash、seedream-5.0-flash-edit 或 seedream-5.0-flash-layer。任务为异步模式:轮询 /v1/images/status/{task_id},或传入 callback_url 接收结果。
两者功能一致——文生图、多图编辑、交互编辑、图层拆分、透明背景与多语种文字均支持。Pro 生图质量更高,并额外提供极速提示词优化模式;Flash 生图更快、价格更低,使用标准提示词模式。
在 seedream-5.0-flash-edit 的提示词中加入 <point>x y</point> 或 <bbox>x1 y1 x2 y2</bbox> 标记。坐标按每张参考图归一化,左上角为 0,0、右下角为 999,999,可以直接由前端的点击或拖框换算得到。直接在图上手绘的标记同样可以被识别。
向 seedream-5.0-flash-layer 发送恰好 1 张图片,模型返回 1 张底图和最多 16 个透明 PNG 图层;每项包含 z_index(0 为底图)、像素与归一化两种 bounding_box、name 与 description。尺寸可选 auto、1K、1.5K 或 2K,auto 按原图中各图层的尺寸输出。
可选 1K、1.5K、2K,宽高比支持 1:1、4:3、3:4、16:9、9:16、3:2、2:3、21:9;也可传入总像素在 921,600 到 4,624,220 之间的自定义尺寸。输出格式为 PNG 或 JPEG,每次请求生成 1 张。
可以。使用 seedream-5.0-flash-edit 时将 background 设为 transparent,并且只传入 1 张本身带透明通道的图片,结果为 PNG。seedream-5.0-flash-layer 拆出的图层始终是透明 PNG。
APIPod 对 Seedream 5.0 Flash 按输出张数计费、无需订阅,1.5K 与 1K 同价。图像编辑首张输入图免费,额外参考图加收少量费用;图层拆分按次固定计费。实时价格见各模型卡片与价格页,任务失败自动退款。
一个 API Key 即可调用 Seedream 5.0 Flash、Pro 以及数百个图像、视频和语言模型——按量付费,任务失败自动退款。