跳转到主要内容
Vidu Q3是vidu新一代模型,支持原生音频+视频一体生成,支持自然的多角色对话,音频与画面同步输出,对话、旁白、音效、音乐四类音轨同步生成,单次生成即可获得完整 16 秒视频,表达更充分、叙事更连贯——减少拼接、避免节奏断裂,让故事自然推进, 从运镜到节奏,你可以精确指挥每一个叙事节点;逐帧级控制帮助你落准关键时刻的时机、重音与情绪节拍。支持英语、日语、中文的视频输出,面向漫剧、电影、短剧等专业叙事场景设计。

模型参数

不支持视频公共 API 中的以下参数:
  • size
  • quality
  • fps
附:ViduQ3 官方 API 文档
aspect_ratio 参数支持以下取值:
  • 1:1
  • 16:9
  • 9:16
  • 4:3
  • 3:4
resolution 分辨率参数,可选:540p、720p、1080p duration 默认为 5s,可选值:1-16s 支持通过 extra_body 传递官方额外可选参数,同Vidu Q2的示例。

模型价格

vidu q3系列 的价格按照生成视频的分辨率、时长来计算,以下是价格速算表: 使用极客智坊提供的低价代理渠道调用时,不同参数对应价格按照价格表x对应的折扣值即可:以高可用速度优先渠道为例,折扣值是 0.8,那么生成 5 秒 720p 有声标准视频价格是 0.9375 x 5 x 0.8 = 3.75 元,其他参数依次类推。

文生视频

通过文字描述来生成对应视频:
响应是一个 JSON 对象,包含生成视频的 URL:
下面的图生视频等响应结果同上,不在列举。

图生视频

首尾帧

异步任务

如果想要异步创建视频获取生成结果请参考ViduQ2示例,流程完全一样。