
参考动作,你的角色
上传一张角色图片和一段动作参考视频,Kling 便会把动作——舞蹈、手势、动作戏——迁移到你的角色身上,同时保持面部身份与表情不变。刷屏社交平台的舞蹈迁移和换角色玩法,靠的正是它。
Kling 3.0 Motion Control 不自己编动作——它把你上传的参考视频里的动作取出来,用你的角色重演一遍。
Kling 3.0 Motion Control 是这里唯一一个不自己编动作的模型。站上其他每一个视频模型都从一段描述开始;它从你手上已经有的一段表演开始。给它一张角色图和一段参考视频,它就用你的角色把那段视频里的动作重演一遍。提示词可写可不写,而且它左右不了动作。
限制是这个设计带来的。要是你手上还没有一段你想要的动作的素材,这个模型就无从下手——那就换生成式的模型。计费按参考片的秒数算,不是按你自己挑的输出时长算,所以参考片一长,你还什么都没看到,账单就已经很大了。它调的是写实的人体动作;风格化很重的二维动画迁移过去不太靠得住。它的速度我们没有跑过基准测试。
快手的动作迁移模型,将参考视频中的运动映射到你的角色图片上——以社区公认「可用数学衡量般可靠」的物理表现,保留面部、表情与身份。

上传一张角色图片和一段动作参考视频,Kling 便会把动作——舞蹈、手势、动作戏——迁移到你的角色身上,同时保持面部身份与表情不变。刷屏社交平台的舞蹈迁移和换角色玩法,靠的正是它。

全身追踪,手部与手指关节精准——评测者特别指出连每个指节都清晰可辨,而旧版本常把手画成一团模糊。编舞与手语级别的手势创作由此变得可行。

打斗、拥抱、物体互动——高难度的接触物理被渲染得连贯一致,用户形容其稳定得近乎可用数学预测。让其他模型崩坏的复杂动作,正是它的主场。

以 720p 或 1080p 生成,按秒计费、价格预先透明。在适合广播的分辨率下,身份稳定、物理真实的运动表现,使其成为规模化创作者内容的实用工具。
2026 年 8 月 15 日在这里生成,一次成片。原始照片和参考视频本身也是本站模型的产出——没有用任何素材库片段。
The subject performs the same head and shoulder movement as the reference, natural and unforced.
Transfer the performance timing from the reference clip while keeping the framing and identity of the source photo.
当你已经有了动作、只是需要换个人来演时,就该用它。
舞蹈镜头、手势套路、你用手机拍的一段走路循环 —— 把片段和角色图交上去,角色就会把它演出来。刷屏短视频里那些舞蹈迁移和换角色的帖子,用的就是这套机制。
因为动作被固定在参考视频里,变的只有角色图,所以拿同一段片段配不同的图去跑,得到的变体是真的能互相对上的。提示词驱动的模型每次都给你一次新的诠释,而这正好和这类活儿要的相反。
打斗、拥抱、把东西拿起来 —— 这些交互一旦让模型自己编就容易垮掉,在这里则是从真实素材继承下来的。手和手指的关节动作能挺过迁移,手势类的活儿才用得上。
Keep Original Sound 默认开启,于是决定原镜头节奏的那段音乐或对白会一起留在输出里,不用再回剪辑软件重新对轨。
如果你手上没有那段动作的视频,这个模型就没有东西可迁移,你要的是 Kling 3.0、Kling 3.0 Turbo 或 Seedance。它也没有画面比例控制、没有 4K 档、不做场景生成 —— 它换的是谁在演,不是场景是什么。高度风格化的 2D 动画是最弱的一类:它是按写实的人体动作调的。
最要紧的是第一行:这里只有它的动作来自素材,而不是来自提示词。
| Kling 3.0 Motion Control | Kling 3.0 | Kling 3.0 Turbo | Seedance 2.5 | |
|---|---|---|---|---|
| 动作由什么驱动 | 你提供的一段参考视频 | 你的文字提示词 | 你的文字提示词 | 你的文字提示词 |
| 必需输入 | 一张角色图和一段参考视频 —— 两者都必填 | 一段提示词,可选再加一张首帧 | 一段提示词,可选再加一张首帧 | 一段提示词;图片、视频和音频可选 |
| 是否接受参考视频 | 接受 —— 这就是这个模型的意义所在 | 无 | 无 | 接受,作为场景参考,按输入加输出的秒数计费 |
| 分辨率 | 720p · 1080p | 720p · 1080p · 4K | 720p · 1080p | 480p · 720p |
| 片段时长 | 由参考片段决定 —— 朝向来自图片时最长 10 秒,来自视频时最长 30 秒 | 3–15 秒,任意整秒 | 3–15 秒,任意整秒 | 4–30 秒 |
| 画面比例控制 | 没有 —— 输出跟随你的输入 | 16:9 · 9:16 · 1:1 | 16:9 · 9:16 · 1:1 | 自适应,外加六个固定比例 |
| 声音 | 带上参考视频自身的音频,默认开启 | 可选开关,默认关闭 | 始终开启,没有开关 | 原生同步音频,默认开启 |
| 每秒积分,720p | 83 | 无声 45 · 带声音 60 | 55 | 230 |
| 每秒积分,1080p | 110 | 无声 60 · 带声音 85 | 70 | 没有这一档——720p 是天花板 |
| 每秒积分,4K | 没有这一档 | 200,含声音,不额外收费 | 没有这一档 | 没有这一档 |
| 单条片子的积分,从最低到最高 | 249–3,300 | 135–3,000 | 165–1,050 | 440–6,900 |
| 我们自己测的速度 | 未实测 | 未实测 | 平均每段 54 秒,最快 29 秒(6 段片子,2026 年 7 月) | 4 秒/480p 约 2 分 38 秒,8 秒/720p 约 5 分 13 秒(7 段片子,2026 年 8 月) |
本表中的分辨率、片段时长和每一个积分数字,均取自我们自己的模型注册表,日期为 2026 年 8 月 20 日 —— 就是给你的生成定价的那几张每秒费率表,不是厂商的营销页面。有一处差别值得看两遍:另外三个模型上,你付钱的秒数就是你要的秒数,而在这里是你上传的那段参考片段的长度。速度数字是我们在本平台上自己计时跑出来的,凡是我们没测过的格子都会写明,而不是从别处借一个数字。
将 Kling 3.0 Motion Control 与其他视频模型对比——同一工作区,一键切换。
| 模型 | kling-v3-motion-control,来自快手 Kling |
|---|---|
| 它做什么 | 动作迁移 —— 它用你图里的角色,把参考视频里的动作重新演一遍。它不会从一段描述生成动作。 |
| 必需输入 | 两项,都是必填:一张角色图和一段参考视频。文字提示词可选,且不驱动动作。 |
| 角色朝向 | 来自图片 —— 保留你照片的构图,参考片段最长 10 秒。来自视频 —— 跟随参考片段的朝向,最长 30 秒。 |
| 分辨率 | 720p 或 1080p |
| 时长 | 由参考视频决定,不单独选择。最短 3 秒;上限是 10 秒还是 30 秒,取决于朝向设置。 |
| 画面比例 | 没有选择器 —— 输出画幅跟随你的输入 |
| 声音 | Keep Original Sound 把参考视频自身的音频带进输出,默认开启 |
| 积分 | 720p 每秒 83,1080p 每秒 110,按参考视频的长度计 |
| 单条片子的积分区间 | 3 秒 720p 的迁移是 249,30 秒 1080p 的最高到 3,300 |
| 实测速度 | 未做基准测试 —— 上面两段片子分别在 144 秒和 166 秒返回,这是两个数据点,不是测量 |
从空白提示词框到一段成片,只要三步。
打开模型选择器,选择 Kling 3.0 Motion Control。在你花掉任何积分之前,面板就会显示它的积分费用、分辨率选项与时长上限。
写清主体、动作,以及镜头怎么运动。想让片子从某张图开始,就附上首帧。
下载成片、延长它,或送去进一步编辑。提示词、模型与设置都会一同保存在你的历史记录里。
一个账户,打通图像与视频生成全流程。
用免费额度的每日积分运行 Kling 3.0 Motion Control,或升级以获得高级模型、更快生成与 4K 输出。
按年计费 · $240/year
它将参考视频中的动作迁移到你的角色图片上——在角色完成参考动作的同时,保留其面部、表情与身份。
至少需要一张角色图与一段动作参考视频。你可以选择让角色朝向跟随图像还是视频。
按 720p 或 1080p 的每秒出片费率计费,生成前显示。生成失败自动退还积分。
舞蹈与表演动作迁移、角色替换、AI 网红内容,以及涉及复杂接触物理的动作镜头。
可以——有一个选项可在输出中保留参考视频的原声。
它针对写实运动进行了调校;高度风格化的 2D 动画迁移则一致性较弱。若需无动作参考的电影级场景生成,请使用 Seedance 或 Veo。
生成前后的活儿都有一键工具——修饰、换风格、直接分享。