搭配方案

共 5 条
Qwen + ComfyUI ComfyUI+ MiniMax H3 MiniMax H3+ llama.cpp llama.cpp+ Gemma Gemma + 12GB显存显卡

分块采样+导演模型,12GB显存直出无限时长1080p长视频

H3生成长视频显存不足,分块生成降低显存需求;导演模型规划镜头保持块间连贯;串行卸载释放显存

✓ 最低12GB显存即可运行✓ 可直出无限时长1080p视频 ✕ 生成30秒1080p约需2小时✕ Gemma4导演12GB显存无法使用
Qwen + DeepSeek R1

以DeepSeek R1为教师模型,蒸馏出32B推理模型

用R1的推理输出提升Qwen基座小模型的推理能力

✓ 得到轻量32B推理模型
Qwen + DeepSeek DeepSeek+ GLM GLM + ms-swift

封装LoRA、量化、分布式训练,一条命令完成微调和对齐

工具原生适配这些模型,微调流程像预制菜配调料包,降低二次开发门槛

✓ 一条命令完成微调✓ 降低二次开发门槛
Qwen + MinerU MinerU+ OpenAI GPT Latest OpenAI GPT Latest+ GLM GLM + Python+ PDF+ PowerPoint (.pptx)+ deepseek-v4-flash-vision-exp

双轨文档解析:文本轨道保留原生结构,视觉轨道用VLM整体理解复杂页面,统一为层级记忆模式

MinerU做文本轨道原始提取,视觉轨道渲染页面交VLM理解,两轨输出同一chunk与元数据模式,下游检索与格式无关

✓ 复杂脏PDF无需精确逐元素提取✓ 模型无关可换其他VLM供应商 ✕ 视觉轨道依赖前沿VLM能力✕ 推荐模型为实验性版本
Qwen + ChatGLM3 ChatGLM3+ LangChain LangChain+ Streamlit Streamlit + Agent+ 多个工具+ 在线API

让具备Agent能力的模型自动选择并调用多个工具

ChatGLM3、Qwen或在线API模型负责理解任务,Agent负责工具调用编排,用户可在WebUI中选择工具。

✓ 支持LLM自动工具调用✓ 支持手动工具调用 ✕ Agent能力依赖模型✕ 普通模型需手动填入参数