进阶 约 25 分钟 2026-09-11 09:24:54 · 1 阅读

Higgsfield 3D Jutsu 实操:一句提示词搭 3D 场景,浏览器里改完直接出片

3D Jutsu 是 Higgsfield 家的浏览器端 3D 工作区:一句提示词生成带物件、布局、灯光、相机和动画的可编辑 3D 场景,再从同一个对话里渲染成视频。这篇教程依据官方文档《Higgsfield 3D Jutsu: Build and Animate 3D Scenes from a Prompt》整理,把场景生成、参数、手动编辑、官方说唱歌手案例的四步流程和积分价格表全部展开成可照做的步骤。

Higgsfield 产品页在这里,站内更多 AI 视频教程见总纲

它解决的是哪一段工作

传统 3D 流程里有两个前置环节:blocking(布局)——摆物件、站位角色、架相机;previz(预演)——把粗糙场景跑成一条动态参考。这两步以前都在桌面 3D 软件里做,3D Jutsu 把它们搬进了浏览器。场景存在 Higgsfield 账号的 My Scenes 下面,不需要安装任何软件,官方 FAQ 原话是「3D Jutsu 不是 Blender 插件,是独立的浏览器工作区」。

值不值得用,官方给了三个典型场景:渲染前先比对几个机位和布光(灰盒阶段不烧积分);明天要交的提案(粗糙分镜带运镜就能讲清想法);规划多镜头序列(同一套几何体逐个取景,空间关系不穿帮)。

3D Jutsu 示例成片画面:地铁车厢中的说唱歌手

官方示例成片的最终画面:地铁车厢里的说唱歌手,机械臂式镜头环绕人物

开一个场景要设的参数

场景从一条文本提示词开始:描述要搭什么,有参考图就附上(自己的上传或 Higgsfield 历史生成都行),然后设三项参数。

Model:驱动智能体的 LLM,默认 Auto,免费。也可以换指定模型——GPT 6 Astra、Claude Fable 5.1、Claude Opus 5、GPT 5.6 Sol、GLM-5.3 Flash 等,按条计费,可以每个对话换着用。

Duration:场景时长 1 到 60 秒,默认 15 秒

Aspect ratio:16:9、9:16、1:1、4:3、3:4、21:9 六档。

Generate,智能体在交互式 3D 视口里把场景草稿搭出来。视口操作就是常规三件套:拖动旋转视角、滚轮缩放、右键拖动平移。

生成之后能改什么

智能体搭出的所有东西都以「可编辑场景数据」的形式落在视口里,改的是真实场景物件,不用整个重生成。编辑器覆盖的范围官方列了一张表:

场景生成(提示词或参考图变成完整场景:物件、布局、灯光都以可编辑几何体放置);添加物件(球、立方体、棱锥等基础体,太阳光/点光/聚光三种灯光,相机);资产库(精选 GLB 资产和 Mixamo 角色直接拖进当前场景);场景属性(侧栏改背景色、场景分辨率、灯光强度,完整物件层级可见);动画(带播放头的时间线,动画来源是相机轨迹、动画角色或自带动画的 GLB 文件);相机(预设和轨迹编辑取景,按 Esc 从相机视图退回自由视口);修订历史(每次编辑会话存为一个版本,可预览或作为新分支恢复);导出(成品场景渲染为动画 MP4、静帧或 GLB 文件,渲染前设置尺寸和文件大小)。

生成之后手动编辑照样可用:物件移动、旋转、缩放、复制,灯光替换,相机重新取景,每一步都有撤销、重做和修订历史兜底。自己的 GLB 文件可以导入且动画保留,成品也能导回 GLB。

对话式改场景:两种模式

工作区里的聊天面板吃自然语言指令,比如「把车挪到路灯旁边,街对面再加一个角色」。智能体有两种行为模式:generate without asking(不问直接干)和 ask before generating(每次生成前先确认)。另有一个单独的问答模式,只回答问题不动场景。

渲染也在同一个对话里发起:场景就绪后,直接在对话里请求出片。生成的场景有三条出路——对话内视频生成、导出 MP4/静帧/GLB、送进 Higgsfield 的 Blender 插件继续用(Scene Builder 在打开的 .blend 文件里组装布局,同一账号同一积分)。

官方案例:地铁说唱歌手,四步出片

官方文档用一条完整镜头演示全流程:夜里行进的地铁车厢里,一位说唱歌手站在车厢中央唱歌,机械臂相机绕他头部匀速环绕 360 度,他全程转头追着镜头看。整条片子 8 秒、16:9、一镜到底。

第一步,用提示词让智能体搭灰盒预演:车厢、人物、带构图与时序的相机路径都在这一步成型。官方的预演提示词值得原样抄走参考:

8 seconds, 16:9. A character stands in a subway car and raps. The character has NO arms and NO hands: none rendered, nothing at the shoulders.

FRAMING: medium close-up throughout: head, shoulders and upper torso only, no legs, no waist. An invisible camera target is placed separately from the head so the head is always in frame as the camera moves.

CAMERA = robo-arm. One continuous, perfectly smooth 360-degree orbit around the character's head and shoulders at chest height, with a slight upward angle: starting front-left, sweeping around behind, continuing around the far side and returning to the front. Constant unhurried speed, near-constant radius that closes slightly on the back half. The camera never stops, never reverses, never zooms, and stays inside the subway car. Nothing passes through the camera and the camera passes through nothing: no walls, no floor, no ceiling, no poles, no seats.

CHARACTER: keeps rapping the whole time, and his head continuously turns to follow the camera through the orbit, face toward the lens the whole way, including a look over the shoulder as the camera passes behind.

Clean sharp digital image, no motion blur smear, no film grain, no vignette, no lens flare, no readable text or logos in the car, no neon, no yellow cast.

几个细节能看出这篇提示词的功力:人物在预演阶段明确「没有手臂没有手」——省掉灰盒阶段最难做对手部;相机行为逐条立规矩(不停、不倒转、不变焦、不穿墙),后面正式生成时这些约束直接被继承。

说唱歌手角色参考图:全身与特写双联图

第三步生成的角色参考图:全身造型与面部特写双联,官方提示词要求整套叠穿与配饰逐项一致

第二步,按 Export 把相机时间线渲染成视频——灰盒预演变成了运镜和人物行为的参考片段。

第三步,生成两张参考图:角色来自 Soul 2.0(一张带身份和服装的人像),场景来自 Soul Cinema(空车厢内景)。都是普通的 Higgsfield 生成,做好就能拖进对话。

空地铁车厢场景参考图

第三步生成的场景参考图:空无一人的地铁车厢内景,浅蓝长椅与金属扶手构成成片的空间

第四步,把角色图、场景图和预演视频放进同一个 3D Jutsu 对话,一句话让智能体合并。预演提供相机路径、构图、人物行为的参考,灰盒材质换成真实场景、服装和表演。官方成片提示词同样完整成文,角色参考这样开头:

<<image_1>>: THE RAPPER. Early twenties, dark skin, striking light-hazel eyes, calm composed face, a small earring. Wardrobe exactly per the reference: an olive-khaki zip hoodie with the hood UP over a leopard-print turtleneck and a dark tee...(后接层次穿搭、配饰与「全程不换装、兜帽不摘」的锁定条款)

歌词四句也写进了提示词,逐句卡在 0–2s / 2–4s / 4–6s / 6–8s 的动作时序里,第一句是:

"Same train every night, but I don't ride the same."

相机约束直接引用预演视频(<<video_1>>):一圈匀速环绕、背后段半径略收、机械臂般平稳无手抖、全程不切镜头。预演阶段立好的规矩,最终成片原样兑现。

积分价目与限制

3D Jutsu 按消息计费,价格取决于驱动模型。官方价目表(每条约):Auto 免费;DeepSeek V4 Flash 约 0.4 积分;Seed 2.1 Turbo 约 1 积分;Gemini 3.5 Flash 约 2 积分;Gemini 3.1 Pro 约 3 积分;GPT 5.6 Sol 约 7 积分;Claude Opus 5 约 8 积分;Claude Fable 5.1 约 11 积分;GPT 6 Astra 约 17 积分。发送前会显示预估费用,对话越长消耗越多,用的是 Higgsfield 全平台同一份积分余额。

两条边界值得知道:一是免费只覆盖 Auto 档,换大模型每条消息都是真金白银,长对话用 GPT 6 Astra 跑几十条就是几百积分;二是它不是专业 3D 软件——手动编辑限于移动物件、加基础体和灯光、给相机取景,官方 FAQ 明说「懂 3D 软件有帮助,但不是必需」。

来源与延伸

本文步骤、参数、价目与案例提示词均整理自 Higgsfield 官方文档,配图转存自原文,版权归原作者所有。

评论 (0)