All models

kling-v1

KuaishouVideo
1.4–9.8 Credits
Get your API key
kling-v1

面向短镜头创作的可灵首代视频模型

kling-v1 是快手可灵第一代视频生成模型,适合把文字构想或静态图片转成短镜头,并继续扩展已生成的视频。它的实用特点是支持五秒首尾帧与运镜控制,便于安排画面起止和镜头方向。对于不需要原生伴音、4K或多素材编辑的创作,可从这一型号搭建简洁的视频工作流。

Kuaishou模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
文生视频、图生视频、已有视频扩展
生成时长
5秒或10秒,默认5秒
模式与画幅
std / pro;16:9、9:16、1:1
首尾帧控制
5秒图生视频可使用首帧与尾帧;尾帧必须配合首帧
运镜控制
仅5秒任务;支持camera_control
提示词控制
cfg_scale:0–1;negative_prompt:最多200字符;扩展任务不支持两者
交付与照片口型
返回视频链接与任务信息;照片口型功能输入图片和已有音频,支持5秒或10秒

以上为本平台中kling-v1的调用规格;照片口型同步是组合创作功能,不代表模型原生生成伴音。

核心能力

了解 kling-v1 能为你的工作带来什么。

从文字或图片开始一个镜头

没有现成画面时,可用文字描述主体、动作和环境进行文生视频;已有商品图或场景图时,可把图片作为首帧进行图生视频。两种方式分别适合构思探索和基于既定画面的动画化,输出视频链接,便于继续剪辑。

用首尾帧安排短镜头

五秒图生视频可同时指定首帧和尾帧,为镜头提供明确的起点与终点;五秒任务还可设置运镜控制。实际创作时,可以先确定构图,再描述中间动作,把镜头方向作为单独控制项,而不是仅靠一段笼统提示词。

生成之后继续扩展

得到满意片段后,可保存返回的video_id,使用extend并补充下一段提示词继续生成。扩展围绕已有生成视频展开,不等同于任意视频编辑。应用可用task_id跟踪任务,以异步查询或回调方式接收视频结果。

适用场景

从具体任务出发,找到模型发挥作用的位置。

商品静图转展示片段

输入商品首帧图片,描述背景氛围和希望出现的动作,制作短展示镜头。需要控制收尾时,可采用五秒首尾帧方案;需要运镜时同样选择五秒任务。交付的视频可作为广告剪辑素材,字幕和配乐在后续制作中添加。

分镜构想转动态草案

把分镜中的主体、场景与动作写成提示词,生成五秒或十秒片段,用于观察构想的动态呈现。横屏、竖屏和方形画幅可对应不同版式需求。已有满意镜头时再尝试扩展,逐段组织素材,而不是一次要求完整长片。

人物照片配音口型

提供清晰单人正脸照片和预先录制的音频,通过会说话的照片功能制作短口播视频。调用时明确选择kling-v1,提示词用于描述动画化阶段的动作或表情。结果包含最终口型视频,也可获得中间的照片动画视频。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

需要五秒运镜时,保留v1的选择价值

如果任务重点是静图动画化,并需要五秒首尾帧或运镜控制,kling-v1具有明确的功能组合。kling-v1-6虽然属于后续版本,但不支持运镜,不能仅因版本较新就直接替换。选择时应围绕镜头控制需求,而不是把版本号当作全部判断依据。

伴音、4K与素材编辑选择其他型号

需要生成视频同时产生伴音时,可考虑kling-v2-6的pro模式或kling-v3;需要4K及更灵活时长时,可考虑kling-v3。多图参考或已有视频编辑则应选择kling-o1或kling-v3-omni。v1更适合文字、首帧和短镜头控制组成的基础创作。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 十秒生成不能沿用五秒的全部控制:kling-v1的首尾帧与运镜仅适用于五秒任务。尾帧只能用于图生视频,并必须同时提供首帧;如果镜头必须落到指定结束画面,应先按五秒方案设计。
  • kling-v1不支持原生伴音或4K模式,也不支持Omni多图参考与参考视频编辑。会说话的照片需要提供已有音频,通过照片动画化与口型同步完成,不能代替音乐、对白或环境声生成。
  • 扩展任务不支持negative_prompt与cfg_scale,不能把初次生成的全部控制参数原样复用。照片口型任务建议使用清晰单人正脸;音频时长不宜超过所选视频时长,避免素材与交付长度不匹配。

常见问题

解答使用 kling-v1 时的常见疑问。

kling-v1的五秒与十秒任务如何选择?

需要首尾帧或运镜控制时选五秒,这是本型号的明确功能边界。十秒适合不依赖这两项控制的生成任务。时长应按镜头内容决定;若需要继续展开已有片段,可以使用视频扩展,而不是直接假定支持任意长度。

图生视频可以只提供尾帧吗?

不可以。图生视频需要start_image_url,尾帧end_image_url只是可选的结束参考,必须与首帧一起使用。kling-v1使用首尾帧时还要选择五秒任务;只有首帧时,可围绕这张图片描述希望出现的动作。

怎样让生成内容更贴近提示词?

初次生成可通过cfg_scale调整提示词相关性,范围为0至1,值越大越贴合提示词;negative_prompt可表达不希望出现的内容,最多200字符。两者都不适用于extend,续写时应把重点放在下一段动作描述上。

怎样让照片开口说话?

使用/kling/talking-photo,提交image_url和audio_url,并显式设置model为kling-v1。音频支持mp3、wav、m4a、aac,大小不超过5MB;视频可选五秒或十秒。它使用已有音频同步口型,不会自行创作对白。

生成结果如何交给应用继续处理?

视频任务返回video_url、video_id、task_id和状态等信息:视频链接用于获取成片,视频ID用于后续扩展,任务ID用于关联处理进度。设置async=true可先取得任务ID,再查询结果;也可以配置回调地址接收完成信息。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 kling-v1 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。