All models

kling-v2-master

KuaishouVideo
14–28 Credits
Get your API key
kling-v2-master

面向短镜头创作的可灵二代视频模型

kling-v2-master 是快手可灵系列的 V2 Master 视频模型,面向以文字构思或首帧图片为起点的短镜头创作,定位于画面质量与使用体验的均衡。它适合制作商品展示、概念分镜和照片动态素材,也可在会说话照片流程中承担动画化任务。选择时应重点关注单镜头表达,而非多素材编辑或原生声画生成。

Kuaishou模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
文生视频、首帧图生视频
视频时长
本平台视频生成:5秒或10秒
画幅选项
16:9、9:16、1:1
型号控制范围
单一模式;不支持尾帧与camera_control
音频工作流
视频生成不支持同步伴音;会说话照片使用外部音频
照片配音输入
照片URL与音频URL;音频支持mp3/wav/m4a/aac,≤5MB
结果与任务
返回视频链接、任务ID及状态;支持异步与回调

以上时长、画幅及素材要求对应本平台的调用范围,会说话照片是组合创作流程,不等同于模型原生伴音。

核心能力

了解 kling-v2-master 能为你的工作带来什么。

从文字构思到短镜头

文生视频适合把场景描述转成可观看的镜头草案。创作时可围绕主体、动作、环境和光线组织提示词,将一段内容集中在一个明确事件上。V2 Master 的均衡定位适合比较不同创意表达,再把选中的结果用于分镜讨论或后续剪辑。

用首帧建立视觉起点

图生视频以已有图片作为开场基础,再通过提示词描述希望发生的动作。相比完全从文字开始,这种方式能让商品图、人物照或场景稿直接参与创作。它强调从指定起点展开画面,不提供尾帧锁定,因此更适合允许结尾自由发展的短镜头。

照片动画与配音衔接

会说话照片流程接收人物照片和已有音频,先完成照片动画化,再按音频进行口型处理。指定 V2 Master 后,它承担其中的动画生成部分。该流程适合已有配音的角色介绍或简短口播,不需要把台词误写成视频模型自动生成声音的指令。

适用场景

从具体任务出发,找到模型发挥作用的位置。

商品静图制作动态素材

输入商品展示图,并描述轻微旋转、背景氛围或展示动作,生成用于短视频剪辑的动态片段。可按投放位置选择横屏、竖屏或方形画幅,再由剪辑环节添加卖点字幕与音乐。建议一次突出一个展示重点,而不是在同一镜头安排整套广告情节。

概念分镜与镜头预演

将脚本中的单个场景整理为主体、动作和环境描述,用文生视频制作镜头草案;已有美术设定时,也可从场景图开始。交付物是便于团队讨论的短片段,适合比较情绪、构图与动作表达,再决定哪些内容进入正式制作或人工精修。

已有配音的人物短片

准备清晰的单人正脸照片和一段配音,通过会说话照片入口制作人物介绍、角色问候或简短讲解。音频应控制在所选视频时长内,提示词主要描述表情与动作。完成后获取最终视频链接,接入现有内容发布或剪辑流程。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

与 V2.1 Master 如何取舍

V2 Master 适合文字或首帧驱动的短镜头任务;V2.1 Master 的定位更强调质量与一致性。两者在这里都采用单一模式,时长为5或10秒,也都不提供尾帧、伴音和结构化运镜。若任务重视画面一致性,可用相同素材对比结果,而不是把版本号直接当作效果保证。

何时选择其他可灵版本

若任务必须锁定结尾画面,可考虑支持尾帧的 V2.5 Turbo pro;需要同步伴音时,可选择 V2.6 pro 或 V3。多图、参考视频及已有视频编辑更适合 O1 或 V3 Omni。V2 Master 的选择价值在于清晰的文字与首帧创作流程,不在于覆盖这些不同的控制需求。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • V2 Master 不支持 end_image_url 尾帧约束和 camera_control 运镜参数。提示词可以表达希望呈现的动作或镜头感觉,但这不等于结构化控制,也不能据此保证最终画面停在指定构图。
  • 视频生成不支持 generate_audio 同步伴音,也不支持4K模式。会说话照片需要另行提供音频,其声音来自输入素材;如需对白、环境音与画面一起生成,应选择具备相应能力的型号。
  • 不要把 image_list、video_list 当作本型号的多素材创作能力。参考视频编辑和 Omni 多图参考属于其他型号;V2 Master 的图生视频以首帧图片为起点,复杂素材组合应拆分制作或改选模型。

常见问题

解答使用 kling-v2-master 时的常见疑问。

调用时应该填写哪个模型名称?

在 /kling/videos 或 /kling/talking-photo 中显式填写 model=kling-v2-master。这样可以明确选择 V2 Master,而不是依赖入口默认值。kling-v2-1-master 是另一个型号,不应当作同一模型的替代写法。

图生视频需要哪些核心输入?

使用 /kling/videos,将 action 设为 image2video,提供 start_image_url,并用 prompt 描述动作与场景变化。时长选择5或10秒即可。本型号不支持尾帧控制,创作时应把首帧视为起点,而不是同时约束起点与终点。

能让照片直接说出提示词里的台词吗?

不能把视频提示词当作语音生成输入。制作会说话照片时,需要向 /kling/talking-photo 提供 image_url 和 audio_url;prompt 用于照片动画化阶段的动作或表情。建议先准备配音,再让照片按这段音频完成口型处理。

可以生成任意长度的视频吗?

该型号的视频生成时长为5或10秒,会说话照片也提供这两个时长选项。更长内容可以按镜头拆分,再进行剪辑;若需要更灵活的单次时长,可考虑 V3,而不是给 V2 Master 传入任意秒数。

如何把生成任务接入应用?

可使用 async=true 获取 task_id,再查询任务结果;也可设置 callback_url 接收完成通知。应用应将任务ID与创作记录关联,完成后读取 state 和 video_url。任务提交成功与视频生成完成是不同阶段,不宜混为同一状态。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 kling-v2-master 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。