← 文章 / AI技术
Tom's Hardware 6小时前 · 2026-10-01 19:30:28 · 4 阅读

企业租用四台 Nvidia H200 测试 DeepSeek “成本降低 80 倍”声明的真实性

Call Center Doctors 是一家呼叫中心咨询公司,专门为其他企业搭建和运营呼叫中心。根据其测试报告,该公司于 9 月 27 日租用了一台 4x H200 服务器,用 DeepSeek V4.1 Flash 替代 Opus 5.5 来驱动其 Claude Code 智能体。这篇报告面向所有听说过"DeepSeek 比 Claude 便宜 80 倍"的人。按照该公司真实的编程负载,整台机器的写入速度最高约为每秒 213 个 token,按需租用费用为每天 440.88 美元;而同样的工作量通过 DeepSeek 的 API 完成,每天只需 184 至 223 美元。最终,这家呼叫中心公司以比整机按需租金更低的价格换回了 Opus 5.5。

DeepSeek 的 API 定价为:非高峰时段每百万输入 token 0.15 美元(缓存命中仅 0.003 美元),每百万输出 token 0.60 美元,高峰时段价格翻倍。相比之下,Anthropic 的 Claude Opus 5.5 官方定价为每百万输入 token 4 美元、输出 token 20 美元,缓存读取 0.20 美元。不过该咨询公司是通过订阅而非 API 使用 Claude 的。

在测试中每次一分钟的全负载运行里,这台机器一次处理一种任务的性能还算不错。但编程智能体的工作方式主要是反复重发对话记录,根据该公司的日志,智能体发给模型的内容中 96% 都是旧文本。每写一个新 token,大约要重读 1000 个旧 token;重读虽然便宜,但数量太大,导致机器大部分时间都忙着重读,几乎没有余力去写新 token。

要让模型稳定运行,前后试了五次,每次加载耗时 10 到 15 分钟。而服务器不管忙不忙都在计费,这很不划算。按我们的计算,以每小时 18.37 美元的按需价格,一个标准月份大约要花 13200 美元,是该公司 9 月 Claude 账单的两倍多。此外,按该公司的估算,一台机器每天最多只能处理约 200 亿个 token,其中大部分还是重读,而其智能体在最繁忙的一天就消耗了 510 亿个 token。

企业租用四台 Nvidia H200 测试 DeepSeek “成本降低 80 倍”的声明

这次测试正是针对那些听信 DeepSeek 比 Claude “便宜 80 倍”这一说法的人。数据显示,9 月 1 日至 27 日运行的一台服务器上,模型共调用 203 万次,读取 3885 亿个 tokens,其中缓存 3742 亿个,写入 3.93 亿个,累计合并了 5610 处代码变更。这家咨询机构 9 月订阅 Claude Code 的费用约为 5500 美元。若使用相同的 token 量,通过 DeepSeek 的 API 则需花费 3500 至 7000 美元不等,具体取决于高峰期定价;若使用量在全周均匀分布,我们估算平均成本约为 4200 美元。

若按 Claude Opus 5.5 的目录价计算,处理相同数量的 token 约需 140,000 美元,是订阅成本的 25 倍以上。那“80 倍”的差价就体现在这种包月折扣上。该咨询机构还逐一核算了每处合并代码变更的成本:使用 Claude 约为 1 美元,而若由 DeepSeek 完成同等工作且消耗相同 token,则其 API 成本约为 0.63 美元。他们估算 DeepSeek 的实际成本在 1.15 至 4.90 美元之间,这一区间基于模型可能需要更多 token、成功率较低,以及需由 Claude 复查其工作的假设。

在测试中,DeepSeek 实际并未编写任何代码。咨询机构的审查员多次发现代理生成的代码可能逃逸出沙箱环境,例如通过共享临时文件夹中的配置文件的潜在风险,使代理代码可能以管理员权限运行。因此,负责编写代码的代理只能保持离线状态。DeepSeek 仅作为 48 至 64 个只读审查代理运行,扫描了 2377 个文件夹并提交了 32 份 bug 报告。该服务器按每小时 9.19 美元的现货价格租用,在最后一轮测试结束后几分钟内便被提供商收回。

原始来源: Tom's Hardware

评论 (0)