创建视频生成任务
视频生成 V2 接口,通过多模态 content 数组输入(文本 / 图片 / 视频 / 音频),支持文生视频、图生视频(首尾帧)、多模态参考生视频。
请求方式
POST
请求地址
https://pixstag.com/api/v2/video_generation
请求体
必填
可选值:
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
27
28
29
30
生成视频的宽高比,默认 adaptive(自动,由输入自适应选择最合适的宽高比,实际比例可在查询接口的 ratio 字段获取)。
必填
可选值:
adaptive
21:9
16:9
4:3
1:1
3:4
9:16
视频分辨率。 目前支持 720P, 768P, 1080P, 2K。
必填
任务状态变更的回调通知地址。
注意,最多通知3次,通知的信息是 application/json 格式,内容与你主动查询是一致的。
收到通知后,请直接返回 SUCCESS
是否在生成视频中添加 AIGC 标识水印,默认 false。
是否启用 Context-IR 提示词优化,默认 false。 新手同学,强烈建议开启此项,视频质量会有大幅提升,生成时间稍微增加。
是否同步返回尾帧,可选true/false, 默认 false。
content
[]common.ContentStruct
多模态输入内容数组,描述用于生成视频的信息。 图片,音频最大3M,视频最大5M。 图片格式: jpg,png 音频格式: mp3,wav 视频格式: mp4
必填
可选值:
text
image_url
audio_url
video_url
文本提示词(prompt),必填:所有场景都需包含一个非空 text,描述期望生成的视频。按字符数计算长度,单个 text 最多 5000 个字符。
image_url
common.RefStruct
当 type=image_url 时的图片对象(格式 / 大小 / 尺寸 / 数量限制见上方 content 说明)。
图片,音频,视频对象的url地址或base64信息。
audio_url
common.RefStruct
当 type=audio_url 时的音频对象(参考音频,仅多模态参考场景;格式 / 大小 / 时长限制见上方 content 说明)。
图片,音频,视频对象的url地址或base64信息。
video_url
common.RefStruct
当 type=video_url 时的视频对象(参考视频,仅多模态参考场景;格式 / 大小 / 时长限制见上方 content 说明)。
图片,音频,视频对象的url地址或base64信息。
内容的位置或用途,条件必填。
first_frame:首帧图片(图生视频;仅一张图且不填 role 时默认按 first_frame 处理)。
last_frame:尾帧图片(图生视频-首尾帧,需与 first_frame 成对)。
reference_image:参考图片(多模态参考生视频)。
reference_video:参考视频(多模态参考生视频)。
reference_audio:参考音频(多模态参考生视频)。
响应