All models

kling-v3

KuaishouVideo
0.84–4.2 Credits
Get your API key
kling-v3

兼顾首尾帧控制与同步伴音的短片生成模型

kling-v3 是快手可灵 3.0 的标准视频生成型号,适合从文字构思或静态图片制作短片。它支持灵活的整数秒时长、首尾帧引导、同步伴音和多种画幅,既能用于广告镜头与社交内容,也适合预演画面运动。需要直接编辑已有视频或组合多份参考素材时,应选择不同的 Omni 型号。

Kuaishou模型品牌
视频模型类型
视频任务能力

规格与接口特性

在选型前明确容量、输入输出与调用方式。

创作方式
文生视频、图生视频;输出视频链接
视频时长
3–15 秒,整数秒
生成模式
std / pro / 4k;4k 与运镜控制互斥
画幅
16:9、9:16、1:1
图像引导
首帧图片链接;可搭配尾帧图片链接
音频
可同步生成,generate_audio 默认 false
创作控制
std/pro 支持 camera_control;cfg_scale 为 0–1,可配反向提示词

以上为本平台中 kling-v3 的调用规格,原生创作能力与各模式可用参数需分别理解。

核心能力

了解 kling-v3 能为你的工作带来什么。

让文字构思变成动态镜头

文生视频适合从零设计场景:用提示词交代主体、动作、环境、光线与镜头意图,再选择时长和画幅。相关性强度与反向提示词可帮助表达创作约束,适合逐次调整同一镜头,而不是把整段复杂剧情塞进一个短片。

用首尾画面引导变化

图生视频以首帧图片建立视觉起点,可再加入尾帧指定结束画面。对于产品展示、人物动作或场景过渡,这种方式能把静态设计转成动态素材。提示词应重点描述两幅画面之间如何运动,避免与图片中的主体和构图互相矛盾。

伴音与运镜按任务取舍

需要有声短片时,可开启同步音频生成;需要更明确的相机运动时,可在 std 或 pro 模式使用运镜控制。4k 模式适合重视输出清晰度的任务,但不能同时加入 camera_control,因此画质档位和镜头控制应在创作前做取舍。

适用场景

从具体任务出发,找到模型发挥作用的位置。

产品展示与广告素材

输入产品静态图,描述展示动作、背景氛围和相机变化,生成可用于后续剪辑的商品镜头。若已有明确的结束构图,可同时提供尾帧。建议把展示主体与核心动作写清楚,先完成单个镜头,再组装成完整广告。

竖屏内容与活动短片

以活动主题、场景和主体动作作为文字输入,选择 9:16 画幅与合适的整数秒时长,制作竖屏短片素材。需要声音时开启 generate_audio;已有品牌海报或视觉稿时,则用图生视频让设计进入动态表达。

分镜预演与创意比选

将分镜描述或关键帧转成短片,用于讨论动作节奏、场景氛围与镜头方向。保持主体和场景描述稳定,每轮只调整一个关键因素,便于比较不同方案。交付物是视频素材,适合继续剪辑,而非一次完成全部后期制作。

如何选择这个模型

结合任务复杂度、输入材料与预期结果选择。

常规生成选标准版,素材编辑选 Omni

如果任务是“根据一段文字生成镜头”或“让一张图片动起来”,kling-v3 的工作流更直接,也提供首尾帧与运镜选项。若要把多张素材作为独立参考,或对已有视频增删元素、修改风格,应选择 kling-v3-omni 或 kling-o1;标准版的首尾帧引导不等同于视频编辑。

比旧版更适合灵活时长与有声创作

相较于多数仅接受 5 秒或 10 秒的旧型号,kling-v3 可在 3–15 秒之间按整数秒安排镜头,更方便贴合短片节奏。它支持同步伴音,而 kling-v2-6 的伴音限于 pro。已有旧版流程可以继续保留;需要灵活时长、4K 或运镜与伴音组合时,再优先考虑此型号。

开始使用

从一次小规模任务到正式接入。

01

准备任务与材料

明确目标、必要输入与输出要求,使用真实业务样例作为起点。

02

在 API 调试区试用

打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。

03

按 API 文档接入

保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。

使用边界

在正式使用前,了解输出质量与能力范围。

  • 4k 模式不能与 camera_control 同时使用。若任务重点是显式控制推拉、转向等相机运动,应选择 std 或 pro;若重点是 4K 输出,则需放弃该运镜参数,不要把两种配置叠加提交。
  • 图生视频必须提供 start_image_url,end_image_url 只能作为配套尾帧,不能单独使用。首尾帧用于引导画面起点和终点,并不等于逐帧指定中间过程,复杂变化宜拆成较明确的镜头任务。
  • kling-v3 不应使用 Omni 的多图参考或参考视频编辑流程。image_list、video_list 属于其他型号的创作方式;开启伴音也不等于完成配音、混音与字幕制作,有声成片仍需检查并按交付要求后期处理。

常见问题

解答使用 kling-v3 时的常见疑问。

kling-v3 怎么开始生成视频?

向 POST /kling/videos 提交请求,显式设置 model 为 kling-v3。文字创作使用 action=text2video 并填写 prompt;图片创作使用 image2video 并提供 start_image_url,再按需要选择时长、画幅和音频。

可以生成哪些时长和画幅?

支持 3–15 秒的整数时长,以及 16:9、9:16、1:1 三种画幅。可以按广告镜头、竖屏短片或方形内容安排构图;时长应与主体动作匹配,不宜在较短片段内安排过多连续事件。

怎样使用首尾帧?

选择 image2video,先提供首帧 start_image_url,需要指定结束画面时再加入 end_image_url。尾帧不能脱离首帧提交。提示词可描述主体如何从起始状态过渡到结束状态,让画面引导与动作要求保持一致。

4K 视频能同时控制运镜和生成声音吗?

4k 模式支持 generate_audio,但不支持 camera_control。需要声音可显式开启音频生成;需要参数化运镜则改用 std 或 pro。音频默认关闭,因此仅选择 4k 并不会自动得到有声视频。

生成结果如何获取,能异步处理吗?

可以设置 async=true,先取得 task_id,再查询任务进度与结果;也可以配置 callback_url 接收完成通知。完成结果包含 video_url、video_id 和 state 等信息,应在确认成功后获取视频,而不是把任务提交成功当作成片完成。

模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。

把 kling-v3 用到你的下一项任务

从清晰的目标开始,在实际结果中判断它是否适合你的工作。