切换工具
大模型 API 成本计算器
输入调用量,对比各家大模型 API 的单次/每月花费
汇率 1 USD = CNY(结果统一按人民币展示,单价可直接在表中修改)· 每日总消耗约 2.5M tokens
| 参与 | 模型 | 厂商 | 输入单价 | 输出单价 | 币种 |
|---|---|---|---|---|---|
| GPT-5.2 | OpenAI | $/M | |||
| GPT-5-mini | OpenAI | $/M | |||
| Claude Sonnet 4.5 | Anthropic | $/M | |||
| Claude Haiku 4.5 | Anthropic | $/M | |||
| Gemini 3 Flash | $/M | ||||
| GLM-5 | 智谱 | ¥/M | |||
| GLM-5-Flash | 智谱 | ¥/M | |||
| DeepSeek-V4 | DeepSeek | ¥/M | |||
| DeepSeek-R2 | DeepSeek | ¥/M | |||
| Qwen3-Max | 阿里 | ¥/M | |||
| Kimi K2.5 | 月之暗面 | ¥/M | |||
| 自定义模型 | — | $/M |
内置价格为常见档位参考值(2026-09 整理),厂商常有阶梯折扣 / 缓存折扣 / Batch 半价,请按实际成交价修改后计算。
| 模型(按月费升序) | 单次请求 | 每日 | 每月(30 天) |
|---|---|---|---|
| GLM-5-Flash 最省 智谱 | ¥0.0000 | ¥0.0000 | ¥0.0000 |
| DeepSeek-V4 DeepSeek | ¥0.000770 | ¥0.7700 | ¥23.10 |
| GLM-5 智谱 | ¥0.002200 | ¥2.20 | ¥66.00 |
| DeepSeek-R2 DeepSeek | ¥0.002200 | ¥2.20 | ¥66.00 |
| Qwen3-Max 阿里 | ¥0.005400 | ¥5.40 | ¥162.00 |
| GPT-5-mini OpenAI | ¥0.0108 | ¥10.80 | ¥324.00 |
| Gemini 3 Flash Google | ¥0.0180 | ¥18.00 | ¥540.00 |
| Claude Haiku 4.5 Anthropic | ¥0.0324 | ¥32.40 | ¥972.00 |
| GPT-5.2 OpenAI | ¥0.0540 | ¥54.00 | ¥1,620 |
| Claude Sonnet 4.5 Anthropic | ¥0.0972 | ¥97.20 | ¥2,916 |
同样的调用量,最贵的方案每月需
¥2,916,最省的 GLM-5-Flash 每月只需 ¥0.0000,相差
2916000000000.0
倍。输出单价通常是输入的 3~8 倍,控制输出长度比压缩输入更省钱。
使用说明
选择模型(或手动改写单价),输入每次请求的平均输入/输出 Token 数与每日请求量,工具会实时算出:单次请求成本、每日成本、每月成本,并生成多模型横向对比,直观看出同一调用量在不同模型上的花费差距。
单价按官方 API 每百万 Token($/M tokens)计价,页面内置价格为常用档位的参考值,厂商常有阶梯折扣、批处理半价或缓存命中优惠,可在表格里直接改成你的实际成交价再计算。
典型用法:把"每天 1000 次客服对话、每次 2000 进 + 500 出"这类真实参数填进去,快速得到月度预算,或者对比"旗舰模型 + 精简提示词"与"轻量模型 + 完整上下文"两条路线哪个更省钱。
常见问题
常见原因有三:一是厂商对缓存命中的输入按 1~5 折计价,重复发送的固定系统提示词实际花费更低;二是批处理(Batch)接口普遍半价;三是账单按真实 Token 计数,与估算值存在偏差。建议把本工具结果当作预算上限,再结合厂商折扣下修 10%~30%。