可灵AI图生视频实操教程:一张图动起来,3.0智能分镜全流程
2026 年 AI 视频圈的主流工作流早已不是「一句话抽卡」,而是先 AI 生图、再让图动起来:画面在生图阶段就锁定,视频阶段只管运动——每一步都可控,出片率高得多。这篇教程带你用可灵 AI 3.0走完这条工作流:一张静态图变成一条能用的视频,再到智能分镜一次出多镜头,全程可照抄。
可灵 AI 是快手的视频生成平台(网页版 klingai.com,也有 App),2026 年 2 月上线的 3.0 系列支持最长 15 秒连续生成、4K 画质、智能分镜和「全能参考」主体锁定,是目前国产视频模型的第一梯队。新用户有免费积分,每日登录还会补充额度。
第一步:准备一张「首帧图」
图生视频的质量上限,在生图阶段就决定了。首帧图建议用即梦、Midjourney 或可灵自带的生图功能制作,要点:主体清晰、构图简单、光线明确。给一个可照抄的生图提示词:
写实摄影,一只橘猫蹲在飘雪的木窗台上,望向窗外,柔和的室内暖光与冷色雪景对比,浅景深,电影感构图
注意:生图阶段就把比例定好(16:9 或 9:16),视频阶段不再改构图。
第二步:上传图片,选图生视频
打开可灵,选择视频生成 → 图生视频,把首帧图拖进上传框。参数建议:模型选 3.0 系列档位,先做 5 秒练手;「创意度/相关性」这类滑块保持默认,等熟了再调。此时画面已经被图片锁定,提示词只需要写两件事:主体动作 + 镜头运动。
第三步:写运动提示词(模板)
图生视频的提示词公式比文生视频简单:
主体做什么 + 镜头怎么动
对着刚才的橘猫图,可以直接照抄:
橘猫轻轻甩了甩尾巴,转头看向镜头,窗外雪花缓缓飘落,镜头缓慢推近
要点:动作写「轻」「缓缓」这类小幅词,别写剧烈动作;镜头运动一次只写一种。
第四步:运镜提示词对照表
镜头语言是 AI 视频拉开差距的地方,这张表直接查用:
| 想要的效果 | 提示词写法 |
|---|---|
| 突出细节、增强张力 | 镜头缓慢推近 / push in |
| 交代环境、收尾 | 镜头缓慢拉远 / pull back |
| 展示全景扫过 | 镜头从左向右平移 |
| 跟随主体运动 | 镜头跟随(主体)移动,跟拍 |
| 大片感环绕 | 镜头环绕主体旋转一周 |
| 稳定画面 | 固定镜头(不写镜头词即为默认) |
一个实用技巧:写「镜头缓慢推近」通常比只写「推近」更稳——AI 对「缓慢」的执行远好于急速运动。
第五步:首尾帧——两张图锁定起止
可灵支持上传首帧和尾帧两张图,AI 只生成中间过渡。这是做「变身」「转场」「产品旋转」类视频的利器:起止画面你说了算,AI 只负责把过程变得自然。首尾帧的万能提示词结构:
(主体)从(首帧状态)自然过渡到(尾帧状态),(主要变化过程一句话),镜头(运镜词)
例如产品展示:产品从正面视角自然过渡到侧面视角,平稳旋转,镜头固定。注意两张图的主体、光线、风格要一致,否则过渡会跳变。
第六步:3.0 新能力——智能分镜与全能参考
智能分镜:3.0 支持最长 15 秒多镜头叙事,你写一段分镜脚本(分几镜、每镜几秒、各镜拍什么),AI 自动调度景别与机位,一次生成多镜头连贯片段,不再需要逐条拼接。适合做 15 秒带货短片、剧情向内容。也可以用「自定义分镜」手动规定每个镜头的时长与内容。
全能参考:上传 3~8 秒的角色视频或多张图片,AI 会精准锁定主体形象——同一角色在多个镜头里不变脸、不变装。做系列短剧、IP 内容时,先把角色参考建好,再批量生成各镜头,一致性远高于纯文字描述。
第七步:剪映收尾
生成的片段下载后进剪映:排列镜头、加转场与调色、配乐字幕,成片导出。和即梦教程里一样,「生成器 + 剪映」两件套就是这个时代最低成本的完整视频生产线。
避坑清单
- 图不动或动太猛:动作词改小幅度(轻轻/缓缓),或删掉多余动作只留一个;
- 首尾帧跳变:检查两张图的光线、角度、风格是否一致;
- 长视频崩坏:15 秒虽好,先用 5~10 秒把单镜头做稳;
- 人物变脸:跨镜头必须用全能参考或同一张参考图,不要靠文字描述;
- 生成等待:高峰期排队较久,参考素材多时等待几分钟属正常,别重复提交。
练手作业
用第一步的生图模板做一张你自己的首帧图,先出一条 5 秒「推近」视频;再用首尾帧功能做一条「从白天到黄昏」的转场;最后用智能分镜写三镜脚本(全景—中景—特写)出一条 10 秒短片。三条做完,可灵的核心玩法你就全掌握了。
可灵工具详情与最新动态见:可灵AI - 奇链产品库。
本文由奇链编辑部原创整理,转载请注明出处。