入门 约 20 分钟 2026-09-08 09:23:50 · 22 阅读

Higgsfield Genjutsu 实操:一段实拍视频,换角色换场景不重拍

同一段视频,三个现实

同一段两人缠斗的视频,在 Higgsfield 官方的演示里出现了三个版本:一个把整场打斗搬进了粉彩色的溪谷,一个把防守方换成了扎着辫子的女孩,第三个连人带景一起换掉。三个版本里,出拳的节奏、镜头的推拉、每一帧的时间点都没变——变的只是「谁在打」和「在哪打」。这就是 Genjutsu 做的事:不重拍、不逐帧修,把一段已经拍好的视频改成另一个现实。

这篇教程把 Genjutsu 的两种模式怎么选、素材怎么备、入口在哪里、三个官方示例的提示词原文逐一拆开,照着走就能把手里那段实拍换成想要的任意版本。本文可与站内 AI 视频制作总纲(从一句话到成片)搭配阅读,Higgsfield 的产品档案见 dbyun 产品页

一段视频,两种改法

Genjutsu 的官方定义是一句话:它让你用两种方式改造一段已有视频——把动作迁移进新的角色、地点或整体观感,或者只替换选中的元素、其余画面原样保留。前者叫 Motion Transfer(动作迁移),后者叫 Object Swap(定点替换)。

两者的分工,官方 FAQ 说得直白:

Motion Transfer keeps the motion, camera and timing while rebuilding the scene from your references. Object Swap changes a selected character, outfit, product, location or object while preserving the rest of the original shot.

翻译过来:Motion Transfer 保住动作、镜头和时间节拍,画面其余部分按你的参考图重建;Object Swap 只改动选中的角色、服装、产品、地点或物件,原片其他内容分毫不动。选择标准就看你想动多大——整条片子换世界观、换人设,走前者;视频大体满意、只有一件东西不对(外套颜色、背景招牌、对面那个人),走后者。

官网「What it's for」栏列了五个官方场景,正好对应这条分界线:音乐 MV 里换掉偶像或舞台,编舞和每个剪辑点照旧踩在节拍上;把一条已经跑出量的广告翻成几十个新变体,赶在观众看腻之前;视频整体不错、只换一处细节的局部修补;AI 网红用同一张脸量产不同服装、地点、剧情的内容;以及同一条广告配不同地区的本地面孔和街景,剪辑不动。前两条偏 Motion Transfer,后三条偏 Object Swap,边界并不严格——同一段素材两种模式各跑一遍,对比着选效率更高。

动手前把素材备齐

官方 FAQ 给出了三个硬性数字,直接决定你的素材能不能进得了生成器:

参考视频长度须在 3 到 30 秒之间,这个范围会显示在生成器界面上;参考图片(角色、产品、服装、道具都算)最多 40 张;计费走 Higgsfield 通用积分系统,每次生成前界面会显示本次要消耗的积分,看到数字再确认开跑,不存在「生成完才发现积分见底」的意外。账号方面,注册 Higgsfield 账号即可使用,官方 FAQ 明确写了「不需要任何视频剪辑经验」——上传视频和参考图、选模式、写描述、点生成,四件事完成。

参考图的质量官方示例给出了直观标准。示例里那张女孩角色参考是一张干净的正面单人照,场景参考是一张构图完整的粉彩溪谷风景照。参考图就是交给模型的「标准答案」:光线、角度、细节越接近你想要的结果,提示词就越不用费力去描述长相和配色,模型也不容易跑偏。

原视频的选择同理。官方三个示例共用同一段打斗素材——运动幅度大、镜头有明确运动,但两位主体始终在画面之内。反过来,主体频繁出画的晃动镜头、或者一帧里五六个人挤成一团的群像,替换边缘出破绽的概率会明显升高,这类素材宁可先剪出干净的一段再喂进去。

入口在哪里

Genjutsu 的介绍页是 higgsfield.ai/genjutsu,页面上的 Generate now 按钮直达生成器;也可以直接打开 higgsfield.ai/ai/video?model=genjutsu。登录后按官方流程走:上传视频和参考图,在 Motion Transfer 与 Object Swap 之间选一个,写下你想改什么,生成。生成器界面为动态加载,具体控件布局以实际打开的页面为准。

下面用官方页面的三个示例把这条流程走三遍。三段演示用的是同一段打斗原始素材,封面帧如下:

Genjutsu 官方示例共用的原始打斗视频封面帧

官方三个示例共用的原始素材:一段两人对打的实拍视频(封面帧)

案例一:整场打斗搬进粉彩溪谷

这是 Motion Transfer 的标准打法。输入只有两样东西:那段打斗的原始视频,外加一张场景参考图。

Genjutsu 官方示例一的场景参考图:粉彩色溪谷风景

示例一挂载的场景参考图:粉彩色溪谷,生成结果的观感由它定义

提示词原文只有一句:

Move the whole fight into this pastel valley by the turquoise stream

注意这句话从头到尾没提「打斗怎么打」——动作部分原视频自带,提示词只负责指路:把整体搬到这个由参考图定义的地方。输出画面里,招式、站位、镜头运动与原片逐帧对应,世界已经换成了粉彩溪谷。

Genjutsu 官方示例一输出:打斗发生在粉彩色溪谷旁

示例一的输出(视频封面帧):动作与镜头未变,场景整体重造为参考图中的溪谷

案例二:只换防守方,手表留在手腕上

换成 Object Swap 的场景:视频整体不动,只把两个人中的一个换成参考图里的女孩。参考区这次挂的是人物照片。

Genjutsu 官方示例二的角色参考图:女孩正面照

示例二挂载的角色参考图:女孩单人正面照

提示词原文:

Replace the defender with this girl, keeping her watch on her wrist

重点在后半句。keeping her watch on her wrist 是定点替换的关键写法:不只说要换谁,还要点名保留什么。手表、戒指、logo 这种小物件最容易在替换时被模型顺手重画掉,写明「留在手腕上」,模型才知道这是要守住的细节。输出的成片里,防守方变成了参考图中的女孩,进攻方、场地、镜头全部维持原片。

Genjutsu 官方示例二输出:防守方替换为参考女孩

示例二的输出(视频封面帧):仅防守方被替换,其余画面与原片一致

案例三:角色场景一起换

第三个示例把前两件事一次做完:参考区同时挂上角色参考图和场景参考图,提示词升级成——

Recast both fighters and restage the fight in the pastel valley — every move and camera stays

拆开看:recast both fighters 点名两位出场者都要换;restage the fight in the pastel valley 接管场景;破折号之后的 every move and camera stays 则把动作和镜头一并锁死。这是三条官方提示词里信息量最大的一条,也最适合当模板抄——一次替换多个元素时,把「换什么」和「保什么」写在同一句里,模型对任务边界的理解最稳。

Genjutsu 官方示例三输出:双方角色与场景同时替换

示例三的输出(视频封面帧):两位出场者与场景同时替换,动作和镜头与原片同步

三条官方提示词透露的写法

把三句原文并排看,Genjutsu 提示词的骨架就三条:动词开头,直接下指令——Move、Replace、Recast,不写「please」也不写背景铺垫;用 this / both 指明参考对象——this pastel valley 指向场景参考图,this girl 指向角色参考图,both fighters 指向原视频里的两个主体;结尾声明哪些不动——keeping her watch on her wrist、every move and camera stays。官方示例全是英文,照抄这个结构、换成自己的内容即可。

对应到中文思路,两种模式各有一套可套的句式。整体重造(Motion Transfer):把整段「某事件」搬进「参考图定义的场景」,动作和镜头保持原样。定点替换(Object Swap):把画面中的「某对象」换成「参考图对象」,保留「必须守住的细节」。真正提交生成时建议按官方示例的英文结构来写,中文描述可以先在草稿里想清楚再翻译过去,避免漏掉「保留」那一半。

落地页上还有两组官方演示

除三个示例外,Genjutsu 落地页还放了两段官方演示,对理解这套能力的边界很有帮助。一段叫 Keep your character in every video:用手机随手拍一段自己,Genjutsu 替你完成「制作」——服装、布景、调色全部重造,同一个人物依次出现在天台、梦境般的游乐园、公园三个完全不同的世界里,人还是那个人。另一段叫 Same take, two realities:页面提供一根可拖动的对比滑杆,左边原片、右边新版,拖过去再拖回来,能直观看到动作和剪辑点全程同步、只有场景被替换。这两段演示不提供提示词,但它们演示的正是前面两个案例的组合玩法——先定住一个人物,再批量换世界;以及替换前后逐帧对齐到什么程度。把自己的素材照这个思路跑一遍,比只看单案例更容易摸到模式的分界线。

四个容易踩的坑

视频超长。官方支持的上限就是 30 秒,再长的素材先在剪辑软件里切出要改的段落,别指望生成器替你截。低于 3 秒的极短片段同样不被接受,两端都卡着。

参考图堆量。上限 40 张不等于要用满——官方三个示例分别只挂 1 到 2 张参考图。指向越少,模型对「标准答案」的理解越集中;一次挂十几张角度相近的照片,反而容易在细节上互相打架。

跳过积分确认。FAQ 原文写着 each run shows its credit cost before you generate,点生成之前看一眼界面显示的消耗,多跑几个变体之前更要看。批量翻广告变体的场景尤其容易连续点下去,积分是按次扣的。

商用前不查条款。官方 FAQ 确认生成的结果可用于自然流量和付费渠道发布,但前提是遵守 Higgsfield 的 Terms of Use。接商单、出客户物料之前,把条款原文过一遍,模特肖像和参考图的版权也要自己兜底——这是官方条款划出的边界,不是走个流程。

本文步骤、提示词原文与配图均整理自 Higgsfield 官网 Genjutsu 页面(higgsfield.ai/genjutsu),版权归原作者所有。

评论 (0)