入门 约 20 分钟 2026-09-11 09:23:22 · 1 阅读

ChatGPT 里直接出 AI 视频:Higgsfield 插件从安装到两条官方成片案例

ChatGPT 自己不出视频,但接上 Higgsfield 插件后,它能在对话框里把一条想法变成成片:写提示词、挑模型、跑生成、回传视频,全程不用离开聊天窗口。这篇教程把插件安装、生成所需的四项输入、以及官方博客两个真实案例的完整做法整理成可照抄的流程。

本文依据 Higgsfield 官方博客《Generate AI Videos from ChatGPT with Higgsfield》整理,案例、积分消耗与功能边界均出自原文。Higgsfield 入口见产品页,更多 AI 视频教程收录在总纲

先弄清楚:插件到底做了什么

平时用 AI 做视频的流程是割裂的:在 ChatGPT 里写脚本、列分镜,再换到生成工具里重新交代一遍背景,手动配参数。Higgsfield 插件把这两步接起来了——连接一次之后,ChatGPT 可以直接调用 Higgsfield 全线模型:Seedance 2.5、Kling 3、Nano Banana Pro、GPT Image 2、Soul 2.0 等。你在对话里用大白话描述需求,ChatGPT 负责把需求扩写成正式的生成提示词,选模型,设定比例和时长,然后跑生成,成片直接出现在同一条对话里。

官方在试运行里只发了一句话,ChatGPT 自己写出了完整的生成提示词,涵盖身份保持、服装细节、镜头行为,然后挑模型、设参数、开工,成品视频直接回传到聊天框。生成结果同时存进 Higgsfield 账号的 Assets 里,可以下载、再编辑,或在套件其他功能里复用。

官方博客题图:电影感人像画面

官方博客题图,示例成片的画面基调:电影感布光的人物特写

一分钟连上插件

准备工作只需要两个账号:一个 ChatGPT,一个 Higgsfield。整个连接过程不需要 API Key。

1. 打开 ChatGPT 的 Plugins Directory(插件目录),搜索 Higgsfield;或者直接用 higgsfield.ai/mcp 页面上的添加按钮。

2. 点 Add,用 Higgsfield 账号登录授权。

3. 新开一个对话,在可用工具里选中 Higgsfield(或在消息里直接提到它),然后让 ChatGPT 生成图片或视频即可。

有个前置事实要知道:插件在 ChatGPT 里的可用性取决于你的套餐、地区和工作区设置,先在插件目录里确认能看到它再往下走。

一次生成要凑齐四样东西

视频生成需要四项输入,ChatGPT 会从对话里把它们凑齐。你可以自己点名,也可以让它替你补全。

参考图:视频所基于的人物、产品或场景照片。在 ChatGPT 里用消息框旁的回形针按钮附加,上限 20 MiB,ChatGPT 会把它上传到你的 Higgsfield 账号。上传后,这条对话里的每次生成都能复用同一张参考图。不想自己生成角色设定图的话,直接传真人照片也行,效果等同。

提示词:动作、场景、镜头、风格的描述。自己写,或者只说想法让 ChatGPT 扩写——官方两个案例的提示词都是它自己写的。

模型:指定一个,或者不指定,ChatGPT 会从 Higgsfield 模型目录里挑一个合适的。

格式:画幅比例和时长,在请求里直接说,比如「9:16、15 秒」。

案例一:30 秒电影感长镜头

官方第一个案例是一条 30 秒单镜头叙事片:客机上的年轻女性发现翼尖外有一头巨兽,扑咬、坠落、惊醒——原来是梦。整条片子一个镜头到底,手持纪录片式运镜,由 Seedance 2.5 生成,花费 540 积分

生成前先备好两张参考图。第一张是角色设定图(character sheet):同一人的正面特写加全身照,给视频模型足够的身份细节,保证人物在各镜头里长得一样。官方这张图用 Soul 2.0 生成,2K 分辨率,花了 0.5 积分。需要跨项目保持同一身份的话,Higgsfield 有专门的 Soul ID 角色一致性工作流;打算用真人照片的可以跳过这步。

角色设定图:同一人物的特写与全身照

案例一的角色设定图:左为面部特写、右为全身照,两图保证人物跨镜头一致

角色设定图的提示词值得整段抄下来看(以下是原文的意译摘录),这是官方写法里「给足身份细节」的范本:

浅色皮肤、暖橄榄色调的约 25 岁年轻女性,直视镜头。鹅蛋脸、高颧骨、窄直鼻、下颌线清晰。微肿的杏眼呈暖棕色,深棕色直眉有发丝细节。深栗色长发自然波浪、微偏中分、发尾毛躁有碎发。皮肤纹理细腻可见:毛孔、细纹、自然光泽、左下颌一颗小痣,无修饰、无美颜、无磨皮。右半为同一人正面全身照:白色罗纹棉背心外搭oversized中蓝水洗牛仔外套袖口挽起,高腰浅蓝阔腿牛仔裤,白色低帮皮面帆布鞋,细金圈耳环与简约金戒指。双图同一灰色无缝影棚背景、均匀柔光,服装、面部、发型、皮肤严格连续。

这张图的提示词原文(英文,可复制后翻译使用)在官方博客的 Use case 1 小节,逐项锁死了面部、服装、姿态与两图连续性——照着这个密度写,角色一致性才有保障。

第二张参考图是场景:一架空客机客舱的写实内景,提示词同样出自官方原文,开头是这样的:

Ultra-realistic interior of a narrow-body commercial airliner economy cabin, completely empty with no people, low-angle shot from the center aisle...(后接座椅材质、舷窗、顶灯、地面、光影、色调、镜头畸变等四十余项细节约束)

客机客舱内景参考图

案例一的场景参考图:空客机经济舱内景,深蓝座椅与暖黄顶灯构成片子的空间

两图备齐后,在对话里把片子要发生的事说清楚,ChatGPT 会展开成完整提示词。官方成片提示词是一份接近拍摄脚本的完整文本,分 SCENE CONTEXT(场景语境)、ACTIVE REFERENCES(活动参考)、FORMAT MODE(格式模式)、OPTICS(光学)、CAMERA(运镜)、ACTION TIMING(逐秒动作时序)等小节,动作精确到秒——比如 12.2s 巨兽咬穿机身后段、15.2s–25.2s 女主角自由落体、28.45s 画面切黑 0.15 秒后惊醒。开头一段是这样的:

SCENE CONTEXT
A young woman in a commercial airliner cabin notices a huge winged animal far off the left wingtip, holding formation with the aircraft. She breaks forward toward the cockpit, is restrained by cabin crew, and turns just in time to watch the dragon overtake the aircraft and bite the aft third of the cabin away in passing...

提示词写到这个密度,在 ChatGPT 里跑比在网页里手填更顺手的地方在于:你和模型在同一条线程里,改一句重跑一次,不用来回搬参数。

案例二:15 秒 UGC 产品广告

第二个案例换到带货场景:一条 15 秒竖屏 UGC 风广告,博主手持零食袋出镜口播,由 Seedance 2.5 在 1080p 生成,270 积分。它要的两张参考图分别是博主和产品:博主用 Soul 2.0 生成(2K,0.5 积分),产品图用 GPT Image 2 生成(4K,48 积分)。

博主参考图:三视角人物展示

案例二的博主参考图:全身、侧面、特写三视角,锁定发型、雀斑、服装等身份特征

产品包装参考图:Wisp Crisps 扁豆脆片

案例二的产品参考图:虚构品牌 Wisp Crisps 扁豆脆片包装,提示词要求包装文字零错字、不变形

这条提示词的关键在锁三样东西:博主是谁、包装上到底印了什么、以及手持手机拍摄的真实感。官方原文用 <<image_1>><<image_2>> 标记两张参考图,然后规定:博主每 2–3 秒眨一次眼、常有微表情,不允许“死盯镜头”;手机斜靠在桌面上歪了几度也不去扶正;笑的时候带一点鼻音。开头如下:

<<image_1>> = THE CREATOR: young woman, very long dark-brown wavy hair with thin face-framing braids...(中略)
<<image_2>> = THE PRODUCT: a pale-PINK matte film snack bag of lentil chips... "Wisp Crisps™" in large dark serif lettering... reproduce the bag and ALL its lettering EXACTLY, zero typos, crisp, no warping

成片分三段:0–2.2s 手持行走自拍,2.2–5.4s 举起产品袋口播,5.4–6.0s 手机放到桌面(藏一次剪辑点),6.8–11.2s 双手持袋展示,11.2s 跳切后凑近说出最后一句,15 秒收尾。官方原文连台词都写好了,比如 0–2.2s 这句:

“So… these are the lentil chips I keep talking about.”(喏……就是我老念叨的那款扁豆脆片。)

文案、机位、动作时序全在提示词里写死,成片就不会跑偏。

积分怎么花,边界在哪

费用是绕不开的一环。通过插件跑的每一次生成都消耗 Higgsfield 积分,价格随模型和分辨率变化。官方两个案例的实际消耗:15 秒 1080p UGC 视频 270 积分,30 秒电影感镜头 540 积分,外加角色设定图 0.5 积分。算下来一条成品广告的全部素材成本约 318.5 积分。

有一条限制官方写得明明白白:Unlimited 订阅的无限模型使用权只在 Higgsfield 网页端有效,ChatGPT 插件里的生成一律按标准积分费率计费。买了 Unlimited 的用户别指望在聊天框里无限跑。

控制开销有个官方给的办法:在对话开头就告诉 ChatGPT「生成任何东西之前,先报积分价格并等我确认」,随时也能在对话里查当前余额。成片不满意可以在同一线程里描述要改的动作、构图或风格,ChatGPT 会带着修改后的提示词重新生成,每次新生成照常计费。

再进一步:Skills 流水线

插件还带一组预置工作流,官方叫 Skills:一句“给这款保温杯做一套完整 UGC 流程,用附带的博主图,从概念、脚本到 9:16 成片”就能跑完整条产线。目前分五类:Marketing(广告营销)、UGC factory(博主带货)、Faceless content factory(无人出镜口播)、Utility(剪辑复用)、Motion & Design(动效设计)。完整目录在 higgsfield.ai/mcp。

顺带一提,Claude 走的是另一条路:Higgsfield 在那边以 MCP 连接器形式接入,官方有单独的指南。装法不同,能做的事类似。

来源与延伸

本文步骤、案例与积分数据均整理自 Higgsfield 官方博客《Generate AI Videos from ChatGPT with Higgsfield》,配图转存自原文,版权归原作者所有。产品收录页:Higgsfield

评论 (0)