搭配方案

共 6 条
DeepSeek Harness + Google Gemini Pro Latest Google Gemini Pro Latest+ ComfyUI ComfyUI + Node.js ^22.19.0 或 >= 24.0.0+ pnpm+ BYOK API Key+ OpenAI Images+ ByteDance Seedream+ Aliyun DashScope

为 DeepSeek Harness 插件化补齐对话生图、批量创作、多模型对比与本地 ComfyUI 全流程

插件以 BYOK 模式聚合多家云端图像 Provider,并接入本地 ComfyUI,在 DSH 对话中统一完成生图与编辑

✓ 四种创作入口覆盖全流程✓ 生成结果按工作区隔离存储 ✕ ComfyUI 未接入 Studio 与✕ 智谱 GLM-Image 不支持图生图
DeepSeek Harness + Shell执行工具+ Web检索工具

Standard模式提供包含Shell执行和Web检索工具的完整智能体环境

通过模块化插件方式加载工具,形成完整的智能体运行环境

✓ 支持模型端点灵活切换✓ 支持执行历史回放与调试 ✕ 仍处于开发者预览阶段,可能出现破坏性变更
DeepSeek Harness + Skills+ 子Agent+ 工作流

围绕看图识梗等多步任务,编写要求、分工检索与检查并汇总

Skills规定任务处理要求,子Agent分别检索与检查,最终由工作流汇总结果

✓ 可灵活定制流程以适配不同任务 ✕ 配置调试工作量大,对普通用户门槛高
DeepSeek Harness + DeepSeek API凭证+ 网页抓取工具

通过搜索和抓取工具核实图片中无法直接看到的人物与梗信息

Harness调度搜索/抓取工具,API凭证提供搜索服务,处理需要外部查证的任务

✓ 默认即内置搜索工具,无需额外安装 ✕ 模型未必主动调用,存在猜测补答案风险
DeepSeek Harness + 表情包图片+ V4-Flash-Vision-Exp

接入视觉模型后处理图文任务,如理解表情包梗文化与人物身份

✓ 开源生态丰富,GitHub超20万Sta ✕ 看图理解存在猜测与编造,准确度不足
DeepSeek Harness + pi pi+ Codex Codex+ Claude Code Claude Code + Argus

在一个任务中同时启用不同harness,保证高度客制化

拆开上下文,各角色有独有上下文但共享工作区,避免单agent局部爬山,提高token效率

✓ 保证高度客制化✓ 提高token效率