All models

kling-v2-5-turbo

KuaishouVideo
2.1–7 Credits
Get your API key
kling-v2-5-turbo

面向短镜头创作的文字与首尾帧视频模型

kling-v2-5-turbo 是快手可灵 V2.5 Turbo 视频模型,适合把文字构想或静态图片变成短镜头。它提供文生视频与图生视频两种主要创作方式,并可在 pro 模式下使用首尾帧安排起止画面。对于商品展示、人物动态和分镜试作,可围绕明确的动作与画面目标组织生成任务。

Kuaishou模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
文生视频 text2video;图生视频 image2video
生成时长
本平台支持5秒或10秒
画幅比例
16:9、9:16、1:1
模式与参考帧
std、pro;首帧引导图生视频,pro可配合尾帧
提示词控制
cfg_scale范围0–1;negative_prompt最多200字符
交付形式
视频URL、视频ID、任务ID及状态;支持异步与回调
照片说话工作流
图片与已有音频输入;支持5秒或10秒,组合完成动画化与对口型

以上时长与控制范围对应本平台调用入口;照片说话是组合创作流程,不代表模型原生生成伴音。

核心能力

了解 kling-v2-5-turbo 能为你的工作带来什么。

用文字组织一个完整短镜头

通过 text2video 描述主体、场景、动作与光线,把镜头构想转化为视频。创作时可将重点放在一个主要事件,例如人物转身或商品进入画面,再用反向提示词排除不想出现的元素,便于比较不同描述形成的视觉方案。

以首尾画面安排视觉变化

图生视频以首帧作为视觉起点,适合已有商品图、角色图或分镜画面的项目。pro 模式还可加入尾帧,让创作同时具有起点和结束目标。首尾帧用于引导生成,并不等于逐帧编辑,中间动作仍需通过提示词清楚表达。

让人物照片配合已有台词

在照片说话流程中,提交人物图片和已准备好的音频即可制作动态口播视频。V2.5 Turbo 负责照片动画化,随后按音频完成对口型;提示词可描述动画阶段的动作与表情,结果同时包含最终成片和中间动画视频链接。

适用场景

从具体任务出发,找到模型发挥作用的位置。

商品短片与展示素材

输入商品首帧图片,描述希望呈现的动作、环境与光线,生成用于商品页或宣传剪辑的短镜头。需要指定结束构图时,可选择 pro 并加入尾帧;先确定横屏、竖屏或方形用途,再组织素材,减少后期裁切造成的构图损失。

分镜试作与创意比较

将脚本中的单个镜头拆成主体、动作和场景描述,以文字生成不同视觉版本;已有分镜图时则用首帧启动。交付物是可查看和剪辑的视频片段,适合比较镜头方向与画面氛围,而不是把整段多场景叙事集中在一次生成中。

照片口播与角色介绍

准备清晰单人正脸照片及录制好的台词音频,通过 /kling/talking-photo 生成角色介绍或短口播。音频长度建议不超过所选视频时长,动作提示以表情和轻量动作描述为主;完成后可获取对口型成片及未对口型的动画片段。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

需要首尾帧时选择 pro

如果目标是从一张图片出发制作短镜头,可按任务选择 std 或 pro;当结束画面也必须参与引导时,应选择 pro。与 kling-v2-1-master 相比,V2.5 Turbo 的 pro 提供首尾帧创作方式,因此更适合已经准备起止分镜的任务,但不意味着中间过程能够被精确逐帧锁定。

按音频、时长与编辑需求选版本

选择 V2.5 Turbo 的重点是文字或图片驱动的短视频创作。需要同步生成伴音,可考虑 kling-v2-6 的 pro;需要3至15秒时长或4K模式,可考虑 kling-v3。若任务是多图参考或直接编辑已有视频,应选择 kling-o1 或 kling-v3-omni,而不是给本型号加入这些素材字段。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 本型号的普通视频生成不支持 generate_audio,也不支持原生4K模式。需要台词时,可以使用已有音频制作照片说话视频,或在后期配音;照片说话与普通视频生成是不同工作流,不能用开启伴音参数替代。
  • 本型号不支持 camera_control 专用运镜控制。可在提示词中描述镜头意图,但不要将其视为可精确执行的相机轨迹。首尾帧也只在 pro 图生视频中配合使用,尾帧不能单独提交。
  • 图生视频需提供首帧图片链接;照片说话需提供可访问的图片与音频链接。驱动音频支持 mp3、wav、m4a、aac,大小不超过5MB;人物照片建议清晰单人正脸,音频长度应与5秒或10秒成片安排相匹配。

常见问题

解答使用 kling-v2-5-turbo 时的常见疑问。

调用时怎样确保使用 V2.5 Turbo?

在 /kling/videos 或 /kling/talking-photo 请求中明确填写 model=kling-v2-5-turbo,不要依赖默认模型。视频创作同时选择 text2video 或 image2video;图生视频需要首帧,照片说话则需要图片与音频。

std 和 pro 在首尾帧上有什么区别?

V2.5 Turbo 的 std 不支持尾帧,pro 支持首尾帧引导。需要指定结束画面时,选择 image2video 和 pro,同时提交 start_image_url 与 end_image_url;只提交尾帧不成立,也不能用尾帧代替首帧。

V2.5 Turbo 能直接生成带声音的视频吗?

普通视频生成不支持 generate_audio。若已有配音,可使用照片说话入口,把人物图片与音频组合成对口型视频;这不是模型自行创作声音。需要同步生成伴音的视频任务,可选择支持该能力的可灵版本。

能用多张参考图或参考视频编辑画面吗?

本型号适合文字、首帧以及 pro 首尾帧创作,不应按 Omni 工作流提交多图或参考视频。需要参考多个主体、借用视频特征或修改已有视频时,应选择 kling-o1 或 kling-v3-omni,按对应素材规则组织任务。

怎样接收生成完成的视频?

完成结果提供 video_url、video_id、task_id 和状态信息。批量或后台任务可使用 async=true 获取任务ID,再查询结果,也可配置 callback_url 接收完成通知;照片说话结果另外提供中间动画的 source_video_url。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 kling-v2-5-turbo 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。