Vidu首尾帧生视频API
更新时间 2026-10-10 18:30:22
最近更新时间: 2026-10-10 18:30:22
本文介绍Vidu Q3系列首尾帧生视频API。
支持的模型
| 模型 | 说明 |
|---|---|
| viduq3‑turbo | 极致生成速度,对比 viduq3‑pro 生成速度更快,兼顾可用画面效果,成本更优;适合大批量、快速预览、原型生产场景,支持音视频直出,最长支持 16 秒输出。 |
| viduq3‑pro | 高效生成高质量音视频,画面生动立体,细节表现力强,画面质感、光影、人物物体一致性表现优秀,支持音画同步直出,适合对视频画质、细节、音视频效果要求高的生产场景;支持最长 16 秒视频输出。 |
| viduq3‑pro‑fast | viduq3‑pro 高速版本,在保留 viduq3‑pro 画质能力基础上,优化推理速度,任务生成耗时更低,画质略低于标准版 pro,适合时效优先、同时对画质有较高要求的业务。 |
调用流程
接口采用异步任务模式,分两步执行:
step1:调用创建任务接口,成功返回task_id
step2:调用查询任务接口查询对应task_id,直到state值为success,获取生成视频url
创建任务接口详情
http调用
请求方式:POST
请求路径:https://ai.ctaigw.cn/v1/start-end2video
请求头
| 参数 | 必填 | 说明 |
|---|---|---|
| Content‑Type | 是 | 固定application/json |
| Authorization | 是 | Token ${YOUR_APP_KEY} |
请求参数
| 参数名称 | 类型 | 必填 | 参数描述 |
|---|---|---|---|
| model | string | 是 | 模型调用名称或模型ID |
| images | array | 是 | 图像 支持输入两张图,上传的第一张图片视作首帧图,第二张图片视作尾帧图,模型将以此参数中传入的图片来生成视频 注1: 首尾帧两张输入图的分辨率需相近,首帧图的分辨率/尾帧图的分辨率要在0.8~1.25之间。且图片比例需要小于1:4或者4:1; 注2: 支持传入图片 Base64 编码或图片URL(确保可访问); 注3: 图片支持 png、jpeg、jpg、webp格式; 注4: 图片大小不超过50M; 注5: 请注意,http请求的post body不超过20MB,且编码必须包含适当的内容类型字符串,示例: data:image/png;base64,{base64_encode} |
| prompt | string | 否 | 视频生成文本描述,最大 5000 字符; 开启is_rec后本参数失效 |
| duration | integer | 否 | 视频时长;Q3 系列默认 5;取值范围 1‑16 |
| seed | integer | 否 | 随机种子; 不传 / 传 0 使用随机种子; 指定 seed 可复现生成效果 |
| resolution | string | 否 | 输出分辨率;默认 720p; 取值范围:540p/720p/1080p |
| audio | bool | 否 | 是否使用音视频直出能力,默认为true,枚举值为: - false:不需要音视频直出,输出静音视频 - true:需要音画同步,输出声音的视频(包括台词和音效) |
| payload | string | 否 | 透传参数 不做任何处理,仅数据传输 注:最多 1048576个字符 |
| watermark | bool | 否 | 是否添加水印; true 添加,false 不添加;默认 false |
| wm_position | integer | 否 | 水印位置;默认 3 取值范围:1 左上、2 右上、3 右下、4 左下; |
| wm_url | string | 否 | 自定义水印图片 URL; 不传使用平台默认水印 |
| meta_data | string | 否 | JSON 字符串格式元数据透传,业务自定义标签 |
响应参数
| 参数 | 类型 | 说明 |
|---|---|---|
| task_id | string | 任务唯一 ID,用于轮询 / 回调查询结果 |
| state | string | 处理状态 取值范围: created 创建成功 queueing 任务排队中 processing 任务处理中 success 任务成功 failed 任务失败 |
| model | string | 调用模型名称 |
| prompt | string | 请求传入提示词 |
| images | array | 请求传入首尾帧图片 |
| duration | integer | 视频时长 |
| seed | integer | 随机种子 |
| resolution | string | 输出分辨率 |
| payload | string | 透传参数 |
| watermark | bool | 是否开启水印 |
| created_at | string | 任务创建时间戳 |
请求/响应示例
请求
curl -X POST https://ai.ctaigw.cn/v1/start-end2video \
-H "Content-Type: application/json" \
-H "Authorization: Token ${YOUR_APP_KEY}" \
-d '{
"model": "viduq3-pro",
"images": [
"https://aaaa.ctyun.cn/start-subject.jpg",
"https://aaaa.ctyun.cn/end-subject.jpg"
],
"prompt": "人物缓慢抬手,肢体动作自然流畅,光影保持一致,镜头轻微缓慢推进",
"duration": 6,
"seed": 12345,
"resolution": "1080p",
"audio": true,
"off_peak": false
}'响应
{
"task_id": "t-xxxxxx",
"state": "created",
"model": "viduq3-pro",
"images": [
"https://aaaa.ctyun.cn/start-subject.jpg",
"https://aaaa.ctyun.cn/end-subject.jpg"
],
"prompt": "人物缓慢抬手,肢体动作自然流畅,光影保持一致,镜头轻微缓慢推进",
"duration": 6,
"seed": 12345,
"resolution": "1080p",
"audio": true,
"payload": "",
"created_at": "2026-09-06T02:10:00.123Z"
}