character_orientation 为必填项,并决定输出时长。image— 无论duration为何,输出固定为 5 秒。video— 输出与参考视频的长度一致 (3–30 秒)。VibeToken playground 会探测参考片段并 预填duration;直接调用 API 的用户应发送与其想要计费时长 相匹配的duration。
Endpoint
{id, status: "pending"};轮询
GET /v1/videos/generations/{id},直到状态为 success 或 failed。
Parameters
"image" | "video"
默认值:"\"image\""
必填
驱动模式选择。
image:5 秒固定时长输出。video:输出时长跟随参考视频(3–30 秒)。
string[]
必填
恰好一个主体图像 URL(HTTPS,PNG / JPEG)—— 即要制作动画的角色。
string[]
必填
恰好一个提供动作的参考视频 URL(HTTPS,MP4)。
string
可选的文本提示词,用于引导生成。最多 2500 个字符。
integer
默认值:"5"
生成片段的长度(秒)。取值范围
[3, 30]。在 image
模式下此项被忽略(输出固定为 5 秒)。在 video 模式下,该值
应与参考视频的长度一致 —— 用于计费。boolean
默认值:"true"
是否在输出中保留参考视频的音轨。
string
引导模型避开的内容。最多 2500 个字符。