Skip to main content
Seedance 2.5 是豆包大模型团队推出的新一代多模态视频创作模型,已迈入「长叙事 × 多素材 × 强编辑 × 多语言」的工业级新阶段。

模型参数

不支持视频 API 中的以下参数:
  • negative_prompt
  • with_audio(Seedance 2.0 生成的视频默认带音频)
  • size
  • quality
  • fps
Seedance 2.5 模型支持的 aspect_ratio 宽高比如下:
  • 16:9:横屏(默认值)
  • 9:16:竖屏
  • 3:4:竖屏
  • 4:3:横屏
  • 1:1:方形
  • 21:9:超宽屏
  • adaptive:自适应(根据输入图像自动选择合适的宽高比)
如果传入了首尾帧/参考图/视频,模型会根据用户提示词意图判断,如果是首帧生视频/编辑视频/延长视频,以该图片/视频为准选择最接近的宽高比;否则,以传入的第一个媒体文件为准(优先级:视频>图片)选择最接近的宽高比。此时,传入的 aspect_ratio 参数会可能被忽略,这一点需要注意。
Seedance 2.5 模型支持的 duration 视频时长为 4-30 秒,默认值为 5 秒,输入参考视频支持时长为 2-15 秒。 Seedance 2.5 支持的 resolution 分辨率为 480p720p,默认值为 720p Seedance 2.5 最大支持 50 个素材,包含 30 张参考图 + 10 个参考视频 + 10 个参考音频。

模型价格

Seedance 2.5 模型的价格按照生成视频的分辨率和时长来计算,以下是价格速算表: 当传入参考视频时(含视频编辑),计费会按照参考视频+生成视频时长总和来计算,不过此时计费单价也有所降低,不同分辨率单价系数不同,如上面表格所示,此时计费逻辑稍微有点复杂,具体计算方式如下: 当参数包含参考视频时,计费秒数取 [参考视频时长 + 生成视频时长] 与 [最低计费时长] 中的较大值,也就是说,如果[参考视频时长+生成视频时长]小于[最低计费时长],则按[最低计费时长]计费;否则,按[参考视频时长+生成视频时长]计费。[最低计费时长]会根据生成视频时长变化,具体可以参照下面这个对照表: 以 Seedance 2.5 生成 720p 视频时长 5 秒为例,系统最低计费时长为 9 秒,因此如果参考视频时长为 3 秒,则计费秒数为 max(3+5, 9) = 9 秒,对应计费金额为 9 x 1.512 = 13.608 元,如果参考视频时长为 7 秒,则计费秒数为 max(7+5, 9) = 12 秒,对应计费金额为 12 x 1.512 = 18.144 元。

文生视频

通过文字描述来生成对应视频:
响应是一个包含生成视频的任务 ID 的 JSON 对象,你可以通过 视频查询接口 轮询视频生成状态,当状态值为 succeed 时,表示视频生成成功,响应中会返回视频 URL:

图生视频

首帧 通过 image 传入单图即可实现基于首帧生成视频:
首尾帧 通过 image + image_tail 传入首尾两张图即可实现基于首尾帧生成视频:

真人模式

极客智坊已支持通过真人模式开关一键开启真人模式,无需手动调用素材接口对含真人的图片/视频/音频进行转白,只需通过传入 extra_body.real_person_mode 参数并将其值设置为 true 即可开启真人模式支持:
如果你想要调用独立的素材接口对真人进行转白处理,请参考Seedance 2.0 真人模式文档

参考生视频

Seedance 2.5 支持基于参考图+视频+音频生成视频,且最大支持 50 个参考素材,包含 30 张参考图 + 10 个参考视频 + 10 个参考音频。 参考图 通过 images 传入一张或多张图即可实现基于多张参考图生成视频:
多模态参考 你可以同时传入参考图、参考视频和参考音频来生成视频,实现多模态参考:
参考视频包含真人也需要通过 extra_body.real_person_mode 参数开启真人模式,否则会报错。另外,多模态传入参数图片、视频、音频时,支持以下组合:
  • 文本
  • 文本(可选)+ 图片
  • 文本(可选)+ 视频
  • 文本(可选)+ 图片 + 音频
  • 文本(可选)+ 图片 + 视频
  • 文本(可选)+ 视频 + 音频
  • 文本(可选)+ 图片 + 视频 + 音频
不能仅传入音频不带图片或视频,否则会报错。

视频编辑

你可以通过 video 参数上传参考视频来引导视频生成,生成的视频会在参考视频的基础上进行编辑: