可灵AI短剧全流程实操:剧本六要素、分镜表模板到成片导出,七步走通
AI 短剧看着像团队工程,拆开其实是七件事:写剧本、拆分镜、锁角色、生成视频、配音、剪辑、复用提示词。这篇把七件事串成一条能照着走的流水线——剧本环节用什么对话 AI 都行,视频生成以可灵为主力(人物动作自然、支持较长视频、国内直接访问),每一步都附原文提供的提示词模板和参数表,复制就能开工。本文属于站内《可灵 AI 视频实战》手册的第 6 章,可灵的产品页在此;流程与配图整理自公众号教程《从零做AI短剧,保姆级实操教程,普通人也能上手》。
开工前的准备清单
可灵官网是 klingai.kuaishou.com,手机号注册就能用,不需要梯子。按原文引用的官方口径,可灵 2024 年 6 月上线,全球累计生成视频已超过 2 亿条;平台提供每日免费额度,一集短剧镜头数量不少,额度省着花——先用单个镜头把提示词试定型,再批量铺开。剧本和文案环节任选一个顺手的大模型(GPT-4o、Claude 3.5、豆包都行);配音剪辑推荐剪映专业版,零基础够用。素材准备阶段不用装一堆软件,这套流程最少两个工具就能跑通:一个对话 AI 写本子,可灵出画面。下面每个环节开头配的教学卡都来自原文,建议对照着看——卡片上是公式和参数速查,正文里是把这些公式放进具体场景的走法。
第一步:剧本,先把骨架搭出来
好故事的核心是制造冲突。原文给出剧情六要素,构思时挨个回答一遍:
1. 角色:主角是谁
2. 目标:主角想要得到什么
3. 冲突:阻碍主角的困难是什么
4. 行动:主角怎么克服难题
5. 结果:故事最终成功还是失败
6. 主题:这个故事想传递什么道理
把六要素填进提示词公式【角色身份】+【核心冲突】+【场景设定】+【预期动作】+【情绪基调】+【详细指令】,再丢给大模型。原文的大纲模板长这样,方括号里换成你的设定即可:
请帮我写一个【题材类型】短剧的大纲,主角是【年龄】岁的【身份/性别】,故事发生在【时间+地点】。主线的冲突主要是【核心矛盾】,整体风格偏【甜宠/悬疑/热血/治愈】,希望结尾带有【反转/留白/高燃】效果,时长控制在【X分钟】左右。请输出:人物设定、剧情梗概、分幕结构、关键台词。
指令只写一句「帮我写个故事」,AI 给的剧情往往没有张力——人物、场景、矛盾都要在指令里交代清楚,这是原文反复强调的第一坑。剧本是一切短片的起点,这步不牢后面全晃。

原文第一步教学卡:左侧是六要素表格(含穿越宅斗示例),下方粉色框内为可直接复制的大纲提示词模板
分镜:把剧本拆成 AI 看得懂的画面
分镜的公式一句话:景别 + 主体 + 环境 + 光影。三种常用景别各管一段——远景交代整体环境,中景展示人物动作,特写放大情绪细节。拍摄角度跟着情绪走:平视代入感强,仰视凸显人物气场,俯视营造压抑、渺小的感觉。构图优先用三分法,把人物主体放在视觉重点位置,画面层次自然好看。
拆完镜头落成表格,原文的古风短剧分镜示例长这样:
镜号 景别 画面描述 运镜 时长
01 远景 清晨古风庭院,主人公背身走向大门, 缓慢推进 3秒
绿植摇曳,阳光洒落
02 中景 男主蹲下观察地上小花,神情专注 轻微摇镜 4秒
03 特写 男主手指轻触花瓣,阳光穿过枝叶, 静止镜头 2秒
画面柔和唯美
原文对分镜的定位值得抄下来:分镜不是束缚,是帮你理清思路——把脑海里的画面拆成一帧一帧的镜头,AI 才能精准生成。

原文第二步教学卡:上部是同一场景的 6 个分镜示例画面,下部汇总景别/角度/构图要点与三行分镜示例表
锁角色:三个办法防「变脸」
AI 短剧翻车重灾区是人物前后长相不一致。原文给了三个递进的解决办法:
最推荐的是垫图:准备一张人物高清正面参考图,相当于给 AI 一张模特照片,后续所有画面都以这张图为基准生成。条件允许就再备一套多视角参考——正面、45° 侧面、侧面、背面各一张,AI 对人物的理解会准确得多。
其次是固定参数:锁定 Seed 种子值、固定角色描述,保证画风和五官稳定不容易跑偏;用 Midjourney 出图的可以挂角色参考参数 --cref 图片url --cw 100。后期换脸是兜底方案:先生成完整画面,最后统一换脸修图,拯救个别崩掉的镜头。

原文第三步教学卡:垫图、固定 Seed、后期换脸三条路线,底部是同一角色的四视图参考示例
图生视频:可灵把画面带活
静态图变视频,不是让图片平移,而是做出情绪流动。原文把可灵列为图生视频的主力国产工具,理由是人物动作自然、支持较长视频;Runway Gen2/Gen3 适合宏大场景,Luma 出片快适合试错。
操作路径:把上一环节的参考图上传到可灵的图生视频入口,提示词栏里补充动作、镜头、氛围感。原文的示例提示词可以直接抄:
slow zoom in, hair blowing gently in wind(缓慢推进,微风拂发)
真正的坑在动作幅度上:动作一大画面就崩。原文的实操要点是控制动作幅度、分段生成,单段 3-5 秒 稳定性最高。一条 8 秒的镜头,在生成环节按 3-5 秒切开跑,再把两段接起来,比一次生成 8 秒稳得多。

原文第四步教学卡:三个图生视频工具的定位对比,右下为「分段生成、单段 3-5 秒」实操要点与示例提示词
配音与剪辑:声音决定代入感
原文的说法很直接:画质差点观众能忍,音质差,观众直接划走。这一环节分三块。
AI 配音用剪映专业版或 ElevenLabs。小技巧是用标点符号控制停顿,跟着剧情调整语气——激动段落语速加快,悲伤段落放缓。环境音是沉浸感的来源:雨声、脚步声、街道嘈杂声,快速让场景变真实。音频分三层叠加:背景音乐 BGM + 人物对白 + 环境音效,层次感立刻出来。
不同场景的声线参数,原文给了一张参考表:
场景 推荐声线 语速 每句后停顿 音量 情绪 内心独白 温柔女声/沉稳男声 0.9 0.3秒 75% 低沉思考 日常对话 自然中性声线 1.0 0.2秒 80% 平和生活化
剪辑把控节奏用卡点:画面跟着音乐情绪切换,高潮段落加快镜头切换,安静的段落放慢,观众更容易入戏。
三块工作有个先后依赖:环境音和对白贴着画面走,先铺对白再垫环境音,BGM 最后进——顺序反了容易把人声压住,来回调音量很费时间。字幕在这一步顺手带上:对白轨定了,字幕跟轨生成,不用逐句手打。

原文第五步教学卡:配音工具与标点控停顿技巧、BGM/对白/环境音三层结构,底部是两种场景的声线参数表
工具箱:选一套顺手的深耕
不用装一大堆软件。原文按环节归了五类工具:文本脚本用 GPT-4o、Claude 3.5、豆包写故事润文案;图像生成用 Midjourney、Flux、Stable Diffusion 产剧照场景图;视频生成用 Runway Gen3、可灵、Luma;音频配音用 ElevenLabs、剪映专业版、Suno 出背景音乐;效率整合用 Coze、Dify、ReActor。选一套顺手的组合用熟,比每样都碰一下效率高得多——工具只是帮手,创意才是短剧的灵魂。

原文第六步教学卡:按文本/图像/视频/音频/整合五类整理的工具速查表,底部附 15 个工具图标一览
提示词模板:定调、光影、音频三件套
原文最后给了一套可以直接复制的成片级提示词,按「画质定调 → 光影氛围 → 声音设计 → 分镜脚本」四层展开。全局定调层负责画质:
8K超高清电影级画质,ARRI Alexa 65质感,50mm中焦定焦,f/2.8浅景深,柯达5219胶片颗粒,24fps,2.39:1宽银幕,8秒固定时长。全程无超帧、无畸变、无穿帮,台词与唇型1:1同步。无AI失真脸,皮肤保留毛孔,呈现真实自然的电影感。
全局光影层管氛围,示例是雨夜离别戏:
夜晚室内/室外,煤油灯暖黄侧光 + 雨幕环境冷调,色温2600K,光线聚焦人物面部与手部,整体营造沉重又不舍的离别氛围,背景带有雨夜的湿润质感和氛围感。
全局音频层把声音也写进提示词:
持续雨声(-12dB),2秒处加入信封撕开的清脆音效(-6dB),背景音乐为低沉钢琴独奏(-18dB),无杂音,人声清晰突出。
分镜脚本层按时间段落写镜头:0-2 秒固定机位中景,男主站在雨中低头看信,雨水打湿头发,焦点锁定信件;2-5 秒缓慢向前推进,从全景推至特写,男主缓缓抬头,眼神从迷茫转为坚定,背景逐渐虚化;5-8 秒缓慢向后拉开,男主转身走进雨幕,身影变小,最终消失在街道尽头。四层模板拼起来就是一条完整 8 秒镜头的生成指令——落到可灵时记得按上一节说的,切成 3-5 秒两段跑。

原文提示词大全卡:定调、光影、音频三个模板的完整文字与 0-8 秒三段式分镜脚本结构
串起来:一集短剧的完整走法
把七个环节按时间线排一遍,就是一集短剧的最短路径。第一天用六要素模板跟大模型磨剧本,出人物设定、分幕结构和关键台词;剧本定稿的同时把主角的正面参考图和多视角参考图备好。第二天按「景别+主体+环境+光影」公式拆分镜表,每个镜头 3-5 秒,逐条把参考图投进可灵图生视频,用定调/光影/音频三层模板组装每条镜头的提示词,跑不通的镜头回分镜表改描述而不是反复重抽。第三天进剪映专业版:AI 配音按场景套声线参数表,音频按 BGM、对白、环境音三层铺轨,卡点剪辑收尾。一集做完,提示词、分镜表、角色参考图都留档——下一集换剧本不换骨架,直接在上一集的模板上改,出片速度会明显快过第一集。原文给的提醒放在最后正合适:工具只是帮手,创意才是短剧的灵魂。
本文流程与全部提示词模板整理自微信公众号教程《从零做AI短剧,保姆级实操教程,普通人也能上手》,教学配图均为原文卡片,版权归原作者所有。