Skip to main content
可灵视频 2.6 模型,首次推出音画同出功能:单次生成即可同步产出视频画面与完整音频,涵盖语音、音效及环境音等内容,在节奏、情绪与叙事表达上实现高度协调,真正达成“所见即所闻”的视听体验。 重点强化了:语音节奏、环境音与画面动作紧密呼应,避免“画面一套、声音一套”的割裂感;支持人声、音效、环境声等多类型声音生成,音质更干净、层次更丰富,更接近真实混音效果;对多种场景下的文本描述、口语表达和复杂剧情有较强的语义理解能力,能更准确地把握创作者意图,输出更贴合需求的音画内容。

模型参数

  • 模型ID:kling-video-v2-6
  • 模型价格:你可以在模型广场查看最新价格信息
  • 调用入口:https://geekai.co/api/v1/videos/generations
  • 模型参数:参考视频 API 手册
  • API认证:获取 API KEY
不支持视频 API 中的以下参数:
  • size
  • fps
附:可灵视频 v2.6 Turbo 官方 API 文档只有文生视频才支持aspect_ratio参数。 支持传入图片 Base64 编码,在对应的image、image_tail参数中传入即可。
aspect_ratio 参数支持以下取值:
  • 1:1
  • 16:9
  • 9:16
可灵视频 v2.6 的 duration 参数支持生成 5s和10s 的视频,默认值是 5s 支持通过 quality 参数替代官方的 mode 参数来控制生成视频的分辨率,quality 的取值范围是 std(对应 720p) 和 pro(对应 1080p),默认值是 std,不同质量的视频生成时间和成本不同。 支持通过 with_audio 参数替代官方的 sound 参数来控制是否生成带有音频的视频,with_audio 的取值范围是 truefalse,默认值是 false,生成带有音频的视频会增加生成时间和成本。 支持通过 watermark 参数替代官方的 watermark_info 参数来控制生成视频是否带有水印,watermark 的取值范围是 truefalse,默认值是 false 支持通过 extra_body 传递额外参数来设置视频分镜、参考主体和音色等信息:
  • multi_shot: 控制是否开启分镜,取值范围是 truefalse,默认值是 false,开启多镜头模式后,可以通过 shot_type 参数来指定分镜类型。
  • shot_type: 指定分镜类型,取值范围是 customizeintelligence,分别代表自定义分镜和智能分镜, 当 multi_shottrue 时本参数必填。
  • multi_prompt: 描述每个分镜的信息,如提示词、时长等,当 multi_shottrueshot_typecustomize 时,本参数必填。
  • element_list: 参考主体列表,基于主体库中主体的 ID 配置,最多支持3个。
  • voice_list: 生成视频时所引用的音色的列表,基于定制音色ID进行设置,最多支持2个,element_listvoice_list 互斥,不能共存。
  • camera_control: 控制相机运动的条款(如不指定,模型将根据输入的文本/图片智能匹配)。
  • static_mask: 静态笔刷涂抹区域(用户通过运动笔刷涂抹的 mask 图片)。
  • dynamic_masks: 动态笔刷配置列表。

文生视频

通过文字描述来生成对应视频:
响应是一个 JSON 对象,包含生成视频的 URL:
文生视频标准版模式std下,只支持无声视频
图生视频生成响应结构是一样的,不再列举。

图生视频

单图
首尾帧
单图标准模式std下生成无声视频,专家模式pro下生成有声视频 首尾帧不支持标准版std下生成视频,首尾帧生成视频下只支持无声视频
如果想要异步创建视频获取生成结果请参考可灵视频3.0示例,流程完全一样