可灵 MCP 批量出片实战:Claude 里管素材、定规则、铺开整个菜单
同一个餐厅要做二十道菜的宣传片,一道一道写提示词、传素材、等结果,是大多数人放弃批量 AI 视频的原因。可灵官方博客 2026 年 8 月底连发三篇教程,把解法摆了出来:用 Kling MCP 把可灵的生成能力接进 Claude / Claude Code,创意规则写一次,验证一组镜头,然后像流水线一样铺开整个菜单。这篇教程把三篇官方文章合并成一条可照做的流程,覆盖连接配置、规则沉淀、单菜试产、批量铺开四个阶段,美食、电商服装、影视表演三类案例的官方提示词原文全部附上。
可灵 产品页在此,站内 AI 视频教程总纲在此。本篇属于可灵 AI 视频实战手册。
MCP 在这条流水线里管什么
先分清三个角色,后面每一步都在它们之间传递东西。Claude(或 Claude Code)是组织者:管项目文件、创意规则、分镜表和生成计划;Kling MCP 是连接件,把可灵支持的图片、视频生成动作暴露给 Claude 调用;可灵本身只负责出图出片。官方博客的原话把边界说得很清楚:MCP provides the connection; Claude Code organizes and invokes the work, while Kling AI performs the media generation——MCP 负责连接,Claude 组织并调用,可灵干活。
官方给的完整工作流只有四步,博客头图就是这四步的流程卡:

可灵官方博客头图:Connect to Kling MCP → Set Up Creative Skills → Generate Storyboard → Generate Video
开始前要接受的第一个事实:MCP 连接里能用哪些模型、哪些参数是动态的。官方教程反复强调 Available tools, models, inputs, and parameters can change——每篇文章动手前都先让 Claude 列一遍当前可用的动作,再围绕实际暴露的能力搭流程,不要照搬网页版的全部选项。
把 Kling MCP 接进 Claude
两条接入路径,按你用的客户端选。
用 Claude Code 的话,一条命令把可灵的远程 MCP 服务器注册到用户级,所有项目共用:
claude mcp add --transport http klingai --scope user https://kling.ai/mcp
想只在当前项目里共享,把 --scope user 换成 --scope project/mcp,走完可灵的授权登录,确认服务器已连接。
用网页版 Claude 的话走自定义连接器:Customize → Connectors → Add custom connector,地址填 https://kling.ai/mcp,然后按提示完成可灵账号授权,最后在要创作的对话里启用这个连接器。官方补充了一点:Team 或 Enterprise 账号的连接器是否可用取决于组织设置。
连上之后第一句话不是"帮我生成",而是先盘点家底。官方教程给的原话:
Confirm that Kling MCP is connected. Show me the Kling image and video tools currently available. Do not generate anything yet.
(确认 Kling MCP 已连接。列出当前可用的可灵图片和视频工具。先不要生成任何东西。)
阶段一:把参考资料变成可复用的规则
批量视频省时间的关键不在生成,而在生成之前。官方食品篇把项目文件夹结构直接开列出来,照抄即可:
Reference frames(参考帧):体现灯光、构图、食物造型和整体视觉方向的图。Dish assets(菜品素材):菜品、食材、备菜、摆盘、成品的高清照片。Brand notes(品牌备注):店名、受众、活动调性、优惠信息、后期要求。Output brief(产出简报):平台、画幅比例、目标时长、要几版。
在项目文件夹里启动 Claude Code,文件名起得清楚,Claude 才能分清每个素材的角色。如果灵感来自一条参考视频,官方的建议是抽代表帧,再配上文字说明帧里看不出来的东西——节奏、转场、运镜。原因在 FAQ 里写得直白:不要假设 Claude 能像理解图片一样直接理解本地视频文件的完整运动和剪辑,给帧加注释才是可靠做法。
素材归位后,让 Claude 把参考帧研究一遍,输出能跨菜品复用的生产规则。官方提示词原文:
Study the reference frames and campaign notes. Create reusable production rules for short restaurant promos, covering lighting, composition, food styling, shot types, camera direction, and pacing. Separate the rules worth keeping across the campaign from details that belong only to the reference. Do not generate media yet.
(研究参考帧和活动备注。为餐厅短片创建可复用的生产规则,覆盖灯光、构图、食物造型、镜头类型、运镜和节奏。把值得全活动保留的规则与只属于这条参考的细节分开。先不要生成。)
官方特意点名一个常见毛病:规则别停在 cinematic(电影感)、appetizing(令人有食欲)这种空标签上,要落成看得见的指令——侧逆光打在蒸汽上、贴紧的食物质感特写、快切的备菜镜头、慢一点的主角揭示、干净的俯拍摆盘。方向确认后,让它存成一个项目 Skill:
.claude/skills/food-promo/SKILL.md
官方对 Skill 的定位一句话:The same Skill can now guide the next menu item without locking every dish into exactly the same content——同一个 Skill 指导下一道菜,但不会把每道菜锁死成一模一样的内容。菜品专属的食材、做法、摆盘细节作为输入保留,不写死进规则。
阶段二:先给一道菜做分镜
铺开整个菜单之前,先用一道菜把流程跑通。官方示例的目标是 15 秒社交平台短片,文章同时说明 15 秒只是本例的简报目标,不是每条可灵工作流的固定要求。提示词原文:
Use the approved food promo Skill and the supplied dish assets to plan a 15-second social video. Build a concise sequence around the real dish, preparation, texture, hero presentation, and ending. Show the shot order, purpose, and approximate timing. Do not add ingredients, cooking methods, or presentation details that are not supported by the source assets. Wait for approval before generation.
(用已批准的食品推广 Skill 和给定菜品素材规划一条 15 秒社交视频。围绕真实菜品、备菜、质感、主角展示和收尾搭一个简洁序列。展示镜头顺序、目的和大致时长。不要添加源素材不支持的食材、做法或摆盘细节。生成前等待批准。)
官方给的典型结构四拍:快速开场让人认出这道菜、一个备菜或质感镜头、更强的人物展示镜头、干净的活动收尾。同时提醒:让素材决定节奏,别把每道菜硬塞进同一个公式。
提交生成任务前,官方要求对着真实餐厅素材过一遍分镜:菜品是否可辨认并与源素材一致;食材、做法、质感提示是否准确;主角镜头是否给足时长;运镜和收尾是否贴合活动。价格、促销文案这类品牌覆盖物留到后期剪辑再做,除非它们本来就是生成计划的一部分——目标是在烧积分之前先确认食物、镜头逻辑和运动都对。
阶段三:小批量试产,改共享规则
分镜批准后,先让 Claude 检查当前 MCP 连接暴露了哪些可灵工具,把分镜映射成生成计划。官方提示词:
Using the available Kling tools, map the approved storyboard to the appropriate generation workflow. Show which source asset, prompt, duration, aspect ratio, and other supported settings will be used for each task. Do not submit anything until I approve the plan.
(用可用的可灵工具,把批准的分镜映射到合适的生成工作流。展示每个任务用哪个源素材、提示词、时长、画幅和其他受支持的设置。我批准前不要提交任何任务。)
这一步的用意是把创意分镜和技术生成设置分开,避免假设网页版的每个选项都在 MCP 连接里可用。计划批准后小规模试产,官方示例:
Use Kling MCP to generate the approved test shots. Use the supplied dish assets as visual references and follow the approved shot directions. Do not introduce unsupported ingredients or preparation steps. Track the submitted tasks and retrieve the results as they complete.
(用 Kling MCP 生成批准的测试镜头。用给定菜品素材作视觉参考,遵循批准的镜头方向。不要引入不支持的食材或备菜步骤。跟踪已提交任务,完成后取回结果。)
审片按官方清单走:食物形状和摆盘、食材准确度、质感、运镜、灯光、节奏、主角镜头强度。关键的批量思维在这里:如果好几条结果有同一个毛病,改共享规则而不是逐条改提示词。官方举的两个例子——"所有食品片里主角镜头留长一点"、"全活动的质感镜头都用更紧的构图"——改一次,带着走后续每一批任务。
官方博客展示的 MCP 生成结果长这样:15 秒三镜头的美食宣传片,左侧三个分镜缩略图,右上角 MCP 标签。

可灵官方博客示例:MCP 生成的 15 秒美食宣传片,三个镜头分别对应叉起牛肉、现刨松露、餐厅全景
阶段四:把一道菜的成功复制成整个菜单
测试通过后,让 Claude 准备一张生产清单再批量提交。清单字段官方全列了:Dish(菜品)、Source assets(源素材)、Shot plan(镜头计划)、Hero detail(主角细节)、Intended format(目标格式)、Generation status(生成状态)。每道菜换上自己的素材和事实,餐厅层面的规则原样复用,只提交批准过的任务。
这里有个容易误解的点,官方专门用一段解释:可灵的生成是任务制的,一次"批量"不等于一个请求同时吐出所有视频。Claude 协调多个已批准的任务、跟踪进度、把结果收回流程里审——这才是 MCP 批量的真实形态。给保留的输出起清楚的版本名(角色图、提示词、对应视频),后面对比和返工才不会乱。
表演与服装:同一套打法的两个变体
官方同期发的另外两篇,把这套流水线换到两个行当,骨架完全一致,值得对照着看差异点。
影视表演系列:先出角色,再谈运动
表演篇的核心顺序是 Generate the Character Set Before Adding Motion——先按同一个方向生成一组角色概念图,审完再动。审角色图的官方问题清单:脸部是否清晰到能做细微表演;服装是否符合概念;灯光是否匹配批准的方向;构图是否适合计划的运动;每个角色是否有区分度又同属一个视觉世界。如果几张图有共同毛病(比如构图都太宽),改一次共享规则,别等视频生成完再返工。
表演提示词官方给了可复用的结构:Starting state + visible change + small action + camera movement + ending(起始状态 + 可见变化 + 小动作 + 运镜 + 结束)。示例原文:
Use the approved character image as the visual reference. Begin with a steady close-up and restrained breathing. Let the eyes gradually gather tears while the character tries to stay composed. Add one small glance away and a subtle camera push. Keep the character recognizable and preserve the approved lighting direction. End before the expression becomes exaggerated.
(用批准的角色图作视觉参考。以稳定的近景和克制的呼吸开始。让眼睛渐渐蓄泪,同时角色努力保持镇定。加一次短暂移开视线和一个轻微的推镜。保持角色可辨认,保持批准的灯光方向。在表情变夸张之前结束。)
同一段里官方还演示了怎么把"克制"写成看得见的东西:Damp eyes without heavy crying(含泪但不嚎哭)、A held breath(屏住的一次呼吸)、A slight jaw movement(下颌的轻微动作)、A delayed glance away(迟一拍的移开视线)。同一结构换情绪词就能铺开整批:Grief、Relief、Pride、Fear、Reunion。
下图是官方展示的多镜头表演生成结果——同一角色在爵士酒吧场景里的三个机位,15 秒三镜头:

官方博客示例:同一角色的三个镜头(钢琴弹奏、全景、侧拍特写),15 秒成片
电商服装:产品准确性优先于好看
服装篇与食品篇最大的差别在审核重心:衣服不能被生成过程改掉。官方在概念图阶段就警告:Reference images can guide the generation, but they do not guarantee that every seam, print, logo, or material detail will remain identical——参考图能引导生成,但不保证每条缝线、印花、logo、材质细节原样保留,所以电商内容必须在动起来之前先审产品。
它把参考分成两类并明确角色:Campaign reference frames 只管视觉方向(布景、灯光、构图、模特呈现),Product photos 才是服装本体参考,并且不许把 campaign 参考里的衣服抄进产品概念。给概念图命名的官方建议是 blue-dress-01-full、blue-dress-01-detail 这种"品名-编号-景别"格式,让 agent 后面能把参考图和视频指令一一配对。
三种可复用镜头模板官方全列了:Full-body 全身(展示整体轮廓后加一个轻微转身或匀步,展示衣物垂坠)、Half-body 半身(保持躯干、领口、袖子可见,模特动作克制)、Detail 细节(对准一个卖点,如纹理、缝线、纽扣、垂感)。示例提示词原文:
Use the approved full-body image as the visual reference. Begin with a steady full-body view, then add a subtle turn to show the garment's silhouette and drape. Keep the movement restrained and the camera controlled. Finish on a clean, product-focused pose.
(用批准的全身图作视觉参考。从稳定的全身景开始,加一个轻微转身展示服装轮廓和垂坠。动作保持克制,镜头保持受控。以干净的、聚焦产品的姿势收尾。)
官方还演示了多图参考的玩法:一张男孩照片加一张飞马图,一句 "A boy rides a Pegasus, soaring through the air in a magical way.",人物和动物两个主体被融合进同一个新场景。

官方示例:两张参考图(男孩肖像 + 白色飞马)+ 一句提示词,融合成一个新场景
翻车了修哪一层
三篇文章的排障表高度一致,核心原则是 Fix the Right Part of the Workflow——修造成问题的那一层,不推翻重来。食品版的分层:源文件用错了,指出确切文件名和它的角色;食物细节是编的,把食材和做法限制在给定素材与备注内;食物看起来 generic,把 delicious 这类词换成具体的质感、灯光、运动和构图;几条视频不一致,更新共享 Skill 或活动规则;只有一道菜失败,只改那条的分镜或提示词,不动其他批次;生成还在跑,先查已有任务,别重复提交。
表演篇补了表演特有的:表情做过头(Reduce facial movement across all performance prompts,全批表演提示词降低面部动作幅度)、镜头太活跃(Keep the camera push slower and shorter in every variation,每条变体把推镜放慢缩短)。服装篇补了产品特有的:衣服变了,回到静帧或产品参考,强化必须保持可辨认的细节;产品细节被挡,给它一个专属特写,把头发、手、配饰挪开。
这些分层修法的前提,是「共享问题改共享规则、单条问题只改单条」这个判断。官方在表演篇总结过一句:A shared problem needs a shared correction. A single-result problem does not. 值得贴在显示器上。
本文步骤、提示词与图片均整理自可灵 AI 官方博客(klingai.com/blog)2026-08-27 发布的三篇 MCP 教程,版权归原作者所有。