wan3.0-t2v
文生视频
从提示词开始,用自然语言描述主体、镜头、运动、光线和场景节奏。
1080P
输出分辨率
2–30s
生成时长
5 ratios
画面比例
Async
执行模式
01 / 选择输入
根据你的素材选择公开模型 ID。APIPod 将供应商命名和路由隐藏在统一的生成契约之后。
wan3.0-t2v
从提示词开始,用自然语言描述主体、镜头、运动、光线和场景节奏。
wan3.0-i2v
让首帧动起来,也可以用首帧和尾帧共同定义更明确的镜头过渡。
wan3.0-r2v
组合参考图、参考视频和参考音频,将人物、物体、风格和声音带入新场景。
02 / 为可控而生
Wan 3.0 面向真实的创意迭代:先展开想法,再锁定视觉锚点,最后请求产品真正需要的输出。
从纯文本创意切换到参考素材驱动的序列,无需更换供应商或请求规范。三个 APIPod 模型 ID 分别对应 Wan 3.0 的不同工作流。
参考生视频每次请求最多可使用 10 张图片、5 个视频和 5 个音频文件,帮助锁定人物、构图、运动和氛围。
可选 480P、720P 或 1080P,设置 2-30 秒时长,并使用自适应或五种标准画面比例适配目标渠道。
IMAGE 1
IMAGE 2
REF 3
REF 403 / 带上参考素材
参考生视频让提示词与源素材协同工作,用团队已有的素材拼出一致的视觉世界。
图片
最多 10 张参考图片
视频
最多 5 个参考视频
音频
最多 5 个参考音频文件
04 / 默认异步
每次请求都是异步任务。让产品保持响应,同时等待供应商渲染,再从同一任务生命周期中取回成片。
根据已有输入,选择 wan3.0-t2v、wan3.0-i2v 或 wan3.0-r2v。
提交提示词、首尾帧或参考素材,并设置镜头需要的时长、分辨率和画面比例。
Wan 3.0 适配器提交异步生成时,APIPod 会先返回任务 ID。
轮询任务直到完成,再将最终视频 URL 交给应用、编辑器或交付流程。
# Wan 3.0 文生视频请求 POST https://api.apipod.ai/v1/videos/generations Authorization: Bearer $API_KEY { "model": "wan3.0-t2v", "prompt": "蓝调时刻,骑行者穿过被雨水照亮的城市,手持摄影机,柏油路面映出霓虹倒影", "duration": 10, "resolution": "1080P", "aspect_ratio": "adaptive" }
05 / 请求契约
分辨率
480P / 720P / 1080P
默认输出分辨率为 1080P。
视频时长
2-30 秒
使用 -1 可让模型智能决定生成时长。
画面比例
自适应 + 5 种比例
支持 16:9、4:3、1:1、3:4 和 9:16。
参考媒体
10 张图片 / 5 个视频
参考生视频最多接受 10 张图片和 5 个视频。
参考音频
最多 5 个文件
可以添加最多 5 个音频参考来引导场景。
执行方式
异步任务
创建任务、轮询状态,并取回完成的视频。
06 / 常见问题
Wan 3.0 Video 是阿里云 wan3.0-video 模型在 APIPod 上的统一接入,支持文生视频、首帧/首尾帧图生视频,以及参考生视频工作流。
纯文本提示词使用 wan3.0-t2v;有首帧或首尾帧时使用 wan3.0-i2v;需要用参考图、视频或音频指导生成时使用 wan3.0-r2v。
参考生视频每次最多接受 10 张图片、5 个视频和 5 个音频文件。图生视频需要首帧,也可以额外提供尾帧。
当前契约支持 2-30 秒,也可以使用 -1 让模型智能选择时长。分辨率支持 480P、720P 和 1080P,默认使用 1080P。
可以。Wan 3.0 参考生视频支持音频参考,最多可与图片、视频和提示词一起提交 5 个音频文件。
完整请求结构、参数约束和异步任务生命周期请查看阿里云官方 Wan 3.0 Video API 参考文档:https://help.aliyun.com/zh/model-studio/wan3-video-generation-api-reference
创作简报已就绪
从一个提示词开始,在镜头需要时加入参考素材,其余生产流程都交给同一套 API。