视频生成
模型试验场支持使用 MiniMax、Doubao、Doubao 扩展协议和阿里云视频模型生成异步视频任务。选择模型后,页面会自动切换对应协议、可用参数和预估费用。
开始生成
- 打开 模型试验场,进入 视频。
- 选择可用的视频模型和 API 密钥。
- 输入提示词,可选上传参考图片;Doubao 的
multi_ref_vid模式还可上传 MP4/MOV 参考视频。 - 设置时长、比例、分辨率和随机种子。
- 查看预估费用,点击 创建。
MiniMax、Doubao 和阿里云提示词最多 7000 个字符,Doubao 扩展协议最多 20000 个字符。Doubao 支持文生、首帧、首尾帧、参考图和图像/视频混合参考模式。任务提交后页面会显示任务状态,并在视频完成后提供预览和下载。
参数说明
| 参数 | MiniMax | Doubao | Doubao 扩展协议 | 阿里云 |
|---|---|---|---|---|
| 分辨率 | 768P | 按模型支持 480p、720p、1080p、4k | 768P | 480P、720P、1080P |
| 时长 | 4-15 秒 | 4-15 秒 | 4-15 秒 | 随模型变化,2-30 秒 |
| 无图片比例 | 16:9、4:3、1:1 | 16:9、4:3、3:4、9:16、1:1、21:9、adaptive | 16:9、9:16、1:1 | 16:9、9:16、3:4、4:3、4:5、5:4、1:1 |
| 图片和视频 | 最多 1 张图片 | 最多 4 张图片;multi_ref_vid 最多 4 个 MP4/MOV 视频 | 最多 4 张图片 | 文生、首帧或最多 10 张参考图,取决于模型 |
| 随机种子 | 默认 42,可调整 | 默认 42,可调整 | 默认 42,可调整 | 默认 42,可调整 |
| 音频 | 由模型能力决定 | 默认生成 | 始终生成原生音频 | 默认开启,metadata.generate_audio 可显式覆盖 |
Doubao 会展示当前模型支持的分辨率。Seedance mini 和 fast 默认使用 480p,标准模型默认使用 720p;若当前模型不支持所选分辨率,费用估算会在提交前提示错误。切换模型后页面会重新估算费用。
图片输入
图片格式支持 JPEG、PNG、WebP、HEIC 或 HEIF,每张不能超过 30 MB;Doubao 参考视频支持 MP4/MOV,每个不超过 64 MB。MiniMax 最多上传一张,Doubao 和 Doubao 扩展协议最多上传四张;阿里云支持文生、首帧和由模型决定的参考图模式。媒体会随视频请求发送到对应协议,原始文件不会作为公开地址保存。
费用和余额
费用按所选协议的计费单位和平台价格配置计算。原生 Doubao Seedance 会预扣估算 Token 金额,完成后按实际输出 Token 多退少补;其他视频协议目前按时长预扣。余额不足时任务不会创建。
视频生成失败或被取消后,平台会按结算状态执行退款处理。使用记录可能会在任务完成后的异步同步过程中出现短暂延迟。
任务状态
| 状态 | 含义 |
|---|---|
| 排队中 | 请求已提交,等待上游处理 |
| 生成中 | 上游正在生成视频 |
| 成功 | 视频已转存到平台,可以预览或下载 |
| 失败 | 上游或结果转存失败,可在详情中查看错误信息 |
| 已取消 | 任务已取消,按结算规则处理余额 |
视频生成是异步任务。上游完成后还需要进行结果转存,因此上游已经完成但页面仍显示“生成中”时,通常是在等待平台保存视频文件。
协议区别
四种协议在试验场使用相同的创建流程,但参数限制不同。Board 会根据所选模型自动选择对应协议,用户不需要手动填写 /minimax、/doubao、/marslab 或 /aliyun 路径。试验场提供普通调用参数;Doubao 扩展协议的 vela 高阶参数需要通过视频 API 调用。
如果某个模型没有出现在选择列表中,通常表示该模型当前未启用视频能力、产品未对当前组织开放,或上游暂不可用。