从文字或图片开始一个镜头
没有现成画面时,可用文字描述主体、动作和环境进行文生视频;已有商品图或场景图时,可把图片作为首帧进行图生视频。两种方式分别适合构思探索和基于既定画面的动画化,输出视频链接,便于继续剪辑。
在选型前明确容量、输入输出与调用方式。
以上为本平台中kling-v1的调用规格;照片口型同步是组合创作功能,不代表模型原生生成伴音。
了解 kling-v1 能为你的工作带来什么。
没有现成画面时,可用文字描述主体、动作和环境进行文生视频;已有商品图或场景图时,可把图片作为首帧进行图生视频。两种方式分别适合构思探索和基于既定画面的动画化,输出视频链接,便于继续剪辑。
五秒图生视频可同时指定首帧和尾帧,为镜头提供明确的起点与终点;五秒任务还可设置运镜控制。实际创作时,可以先确定构图,再描述中间动作,把镜头方向作为单独控制项,而不是仅靠一段笼统提示词。
得到满意片段后,可保存返回的video_id,使用extend并补充下一段提示词继续生成。扩展围绕已有生成视频展开,不等同于任意视频编辑。应用可用task_id跟踪任务,以异步查询或回调方式接收视频结果。
从具体任务出发,找到模型发挥作用的位置。
输入商品首帧图片,描述背景氛围和希望出现的动作,制作短展示镜头。需要控制收尾时,可采用五秒首尾帧方案;需要运镜时同样选择五秒任务。交付的视频可作为广告剪辑素材,字幕和配乐在后续制作中添加。
把分镜中的主体、场景与动作写成提示词,生成五秒或十秒片段,用于观察构想的动态呈现。横屏、竖屏和方形画幅可对应不同版式需求。已有满意镜头时再尝试扩展,逐段组织素材,而不是一次要求完整长片。
提供清晰单人正脸照片和预先录制的音频,通过会说话的照片功能制作短口播视频。调用时明确选择kling-v1,提示词用于描述动画化阶段的动作或表情。结果包含最终口型视频,也可获得中间的照片动画视频。
结合任务复杂度、输入材料与预期结果选择。
如果任务重点是静图动画化,并需要五秒首尾帧或运镜控制,kling-v1具有明确的功能组合。kling-v1-6虽然属于后续版本,但不支持运镜,不能仅因版本较新就直接替换。选择时应围绕镜头控制需求,而不是把版本号当作全部判断依据。
需要生成视频同时产生伴音时,可考虑kling-v2-6的pro模式或kling-v3;需要4K及更灵活时长时,可考虑kling-v3。多图参考或已有视频编辑则应选择kling-o1或kling-v3-omni。v1更适合文字、首帧和短镜头控制组成的基础创作。
从一次小规模任务到正式接入。
明确目标、必要输入与输出要求,使用真实业务样例作为起点。
打开试用页,确认此入口支持的参数,再提交小规模任务查看结果。
保留完整模型 ID,使用文档规定的请求格式,并在 Pricing 页确认计费规则。
在正式使用前,了解输出质量与能力范围。
解答使用 kling-v1 时的常见疑问。
需要首尾帧或运镜控制时选五秒,这是本型号的明确功能边界。十秒适合不依赖这两项控制的生成任务。时长应按镜头内容决定;若需要继续展开已有片段,可以使用视频扩展,而不是直接假定支持任意长度。
不可以。图生视频需要start_image_url,尾帧end_image_url只是可选的结束参考,必须与首帧一起使用。kling-v1使用首尾帧时还要选择五秒任务;只有首帧时,可围绕这张图片描述希望出现的动作。
初次生成可通过cfg_scale调整提示词相关性,范围为0至1,值越大越贴合提示词;negative_prompt可表达不希望出现的内容,最多200字符。两者都不适用于extend,续写时应把重点放在下一段动作描述上。
使用/kling/talking-photo,提交image_url和audio_url,并显式设置model为kling-v1。音频支持mp3、wav、m4a、aac,大小不超过5MB;视频可选五秒或十秒。它使用已有音频同步口型,不会自行创作对白。
视频任务返回video_url、video_id、task_id和状态等信息:视频链接用于获取成片,视频ID用于后续扩展,任务ID用于关联处理进度。设置async=true可先取得任务ID,再查询结果;也可以配置回调地址接收完成信息。
模型资料 · 更新日期:2026-10-01。调用参数与计费规则请查看 API 和定价栏目。