← 文章 / 科技资讯
搜狗微信-AI 2小时前 · 2026-08-26 18:56:31 · 1 阅读

看看本周AI大模型token 调用量排行,神秘模型 Ox Alpha 登顶~

之前发了一个 AI 网站的排行:全球 AI 网站排名,用户到底在用谁?ChatGPT 还是第一,DeepSeek 第四~

很多人问有没 API 调用排行榜,今天看看第三方平台 openrouter 的 API 调用情况。

平时做开发基本也都是调用 API,本周 Ox Alpha 突然爆火,登顶 OpenRouter Token 调用榜。

这是 8 月 20 日左右上线 OpenRouter 的匿名 stealth 推理模型(ID:stealth/ox‑alpha),主打编码、长周期 Agent、生产场景, 1M token 上下文,支持文 / 图 / 视频输入、工具调用,目前免费预览。

早期代码测试表现强劲,社区讨论热烈,但至今没人站出来认领这个模型。

OpenRouter 是一个可以同时接入 300+ AI 模型的平台,每周处理超过几十万亿 token 的请求。

很多 AI 编程工具直接接入 OpenRouter 来调用模型。

很多人猜测 Ox Alpha 很可能是国内团队做的~如果真这样,现在前五大模型的token调用量排名都是国内的了~Ox Alpha、DeepSeek V4 Flash、小米 Mimo、腾讯 Hy3 、 占据了前四席,TOP 20 里国产模型拿下至少 10 席,这在两年前是不可想象的。数据来源:https://openrouter.ai/rankings2024 年 10 月,中国模型在 OpenRouter 的 token 调用里占比约 1.2%,几乎可以忽略不计。DeepSeek V3 发布之后,这个数字到 2025 年 3 月跨过了 10%。Kimi K2 和 MiniMax 加入之后,到 2025 年 Q3 超过 25%。到 2026 年 4 月,这个数字超过了 45%。不到两年,从 1.2% 到 45%。主要原因我们的模型还是性价比之王,同等能力下价格便宜太多,有的便宜 10-20 倍。开发者在生产环境里要算成本账,便宜且够用的优先级远高于贵但最强。看看花钱的排行榜, Claude 好是好,贵也是真贵:

TOP 1-10

      • Ox Alpha(Stealth):17.5T tokens,暂居第一,新模型一上线就冲到榜首,调用量非常夸张。
      • DeepSeek V4 Flash(DeepSeek):11.6T tokens,排名第二,环比 +3%。凭借低成本、高速度和百万 Token 上下文,已经成为高频 Agent、代码和自动化任务的重要选择。
      • MiMo-V2.5(小米):9.92T tokens,环比 +82%。增长非常猛,轻量化和低价格使其大量进入 Agent 自动化流程。
      • Hy3(腾讯):7.16T tokens,环比 -27%。2950 亿参数、单次激活约 210 亿,针对长文本和 Agent 场景进行了优化。
      • DeepSeek V4 Flash 0423:5.58T tokens,环比 +17%,说明 DeepSeek V4 Flash 系列仍然保持着非常高的实际使用量。
      • Nemotron 3 Ultra(NVIDIA):5.4T tokens,环比 +100%,增长速度仅次于部分新晋模型。
      • GPT-5.6 Luna(OpenAI):4.16T tokens,环比 -28%。
      • GLM 5.2(智谱):3.22T tokens,环比 -26%。
      • Gemini 3.7 Flash(Google):2.58T tokens,环比暴涨 +210%,是榜单中增速最惊人的模型之一。
      • DeepSeek V4 Pro 0423:1.84T tokens,环比 -29%。
      TOP 11-20
      • MiniMax M3:1.57T tokens,环比 -6%。采用 MSA 稀疏注意力,百万上下文下的算力开销大幅降低,并支持多模态能力。
      • Laguna S 2.1(Poolside):1.53T tokens,环比 -8%。
      • Claude Opus 5(Anthropic):1.51T tokens,但环比下降 84%,旗舰模型的调用量明显受到成本因素影响。
      • GPT-5.6 Sol(OpenAI):1.510T tokens,环比 +84%,增长非常明显。
      • Kimi K3(月之暗面):1.42T tokens,环比 +8%,基本持平。
      • Claude Sonnet 5:1.12T tokens,环比 +3%。
      • Nemotron 3.5 Lightning(NVIDIA):1.07T tokens,环比 +28%。
      • DeepSeek V4 Pro 0813:1.01T tokens,环比 +7%。
      • Gemini 3 Flash Preview:830B tokens,环比 +1%。
      • GLM 5.3:803 tokens,环比 +999%,暴涨,估计刚出来大家刚开始发现智谱家的 5.3 还是不错的。

      便宜、快速的模型正在吃掉大量 Token,DeepSeek V4 Flash、MiMo-V2.5、Nemotron、Gemini Flash 等模型大量出现在前列。尤其是 MiMo-V2.5 +94%、Nemotron 3 Ultra +114%、Gemini 3.7 Flash +236%,说明市场越来越倾向于把高频、重复、自动化任务交给成本更低的模型。

        原始来源: 搜狗微信-AI

        评论 (0)