← 文章 / AI技术
元启深空 55分钟前 · 2026-10-02 05:09:04 · 4 阅读

4个国产大模型免费API,最高送7000万token,不用绑卡

昨天写了四个海外免费API,今天把国产的补上。智谱、阿里云百炼、硅基流动、Kimi,全是国内平台,国内网络直连,不用折腾,注册也不用绑信用卡。

先把话说在前面:下面每个额度的数字,我10月1号去各家官方文档里核过一遍,写的时候都有效;但注册领Key这一步我没法替你走,控制台的具体按钮位置以官网实时页面为准,额度政策厂商也可能随时调,动手前自己去控制台看一眼。

智谱 BigModel:新用户2000万token,Flash系列模型永久免费

智谱是清华系的,开放平台叫BigModel。官方定价页写得明白:新用户注册得2000万Tokens。这是个资源包,只能用来抵扣付费模型的调用,不是直接打到余额里。

真正划算的是它的Flash免费模型:glm-4.7-flash、glm-4-flash-250414、glm-z1-flash(推理)、glm-4v-flash(图像理解),还有CogView-3-Flash画图,调用不花钱也不扣额度。提个醒:免费只覆盖4.x这一代,5.x旗舰比如glm-5.3是付费的,想用最新模型就得靠那2000万资源包去抵。另外旧版本下线后会自动路由到新版,代码里的model id别写死,留神官方下线公告。

注册去 open.bigmodel.cn,手机号注册加实名认证。API Key在控制台"API Keys"页面创建。

base_url:https://open.bigmodel.cn/api/paas/v4

curl这样调:

bash · 轻触全选复制

curl https://open.bigmodel.cn/api/paas/v4/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $ZHIPU_API_KEY" \
  -d '{
    "model": "glm-4.7-flash",
    "messages": [{"role": "user", "content": "你好"}]
  }'

Python用OpenAI SDK写法:

python · 轻触全选复制

from openai import OpenAI

client = OpenAI(
    api_key="你的Key",
    base_url="https://open.bigmodel.cn/api/paas/v4",
)
resp = client.chat.completions.create(
    model="glm-4.7-flash",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

避坑:智谱的限流触发后返回错误码1302,平台过载返回1305;每个模型的并发上限单独设置,数值不公开,去控制台"速率限制"页看自己账户的额度,不够用可以申请提并发。

阿里云百炼:每模型100万token,70多个模型加起来超7000万

这是今天额度最狠的一个。官方帮助文档原文:首次开通百炼,每个模型自动发放100万Token免费额度,覆盖70多个模型,总额超7000万,有效期90天。开通就自动到账,一般两小时内生效,不用手动领。

最友好的一点:领这个额度不用实名认证。官方原话是"无需实名认证即可获取和使用免费额度"。不过额度用完之后,没认证的账号就调不动了,得先认证再充值才能继续按量付费。怕手滑被扣费的话,控制台有个"免费额度用完即停"开关,打开之后额度耗尽直接返回403(错误码AllocationQuota.FreeTierOnly),一分钱不会多扣,没认证的用户这个开关是默认强制开的。

注册去 bailian.console.aliyun.com,开通即发放。API Key在控制台"API-Key"页面创建,一个Key能调所有模型,不用每个模型单独建。

base_url:https://dashscope.aliyuncs.com/compatible-mode/v1

python · 轻触全选复制

from openai import OpenAI

client = OpenAI(
    api_key="你的Key",
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
resp = client.chat.completions.create(
    model="qwen-turbo",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

避坑:额度按模型独立计算,qwen-turbo的100万用完了不会自动切到qwen-plus,得自己改model参数;只有华北2(北京)地域的模型有免费额度;免费额度只抵扣实时推理,Batch批量调用不抵扣。

硅基流动:实名送16元,一个Key调几十个模型

硅基流动是个聚合平台,卖点是一个API Key能调几十个模型,DeepSeek、Qwen、GLM这些都在上面,国内直连。官方产品文档里写了Qwen2.5(7B)等多个大模型API免费使用,不过最近有社区复核说免费模型的范围收窄了,具体哪些免费以控制台"模型广场"的实时标识为准。

新用户福利是实名认证后送一张16元的"认证奖励券",一次性的,每人只能领一次。券有有效期,领了尽快用。

注册去 cloud.siliconflow.cn,注册加实名认证后领券。API Key在"API密钥"页面创建。

base_url:https://api.siliconflow.cn/v1

python · 轻触全选复制

from openai import OpenAI

client = OpenAI(
    api_key="你的Key",
    base_url="https://api.siliconflow.cn/v1",
)
resp = client.chat.completions.create(
    model="Qwen/Qwen2.5-7B-Instruct",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

避坑:硅基流动的模型名是"厂商/模型名"格式,写错会报模型不存在;聚合平台的模型上下架比较勤,调不通先去模型广场确认这个模型还在不在。

Kimi(月之暗面):新用户送15元,长文本是强项

Kimi的API开放平台,新用户注册加个人认证送15元赠金。这个数字是社区里多人实测过的,官方文档里没单独公示,领的时候以控制台"账户总览"显示的为准。

Kimi的强项是长上下文,做长文档问答、代码库分析合适。提醒一句:15元赠金用不了最新的Kimi K3旗舰模型,K3要求真实充值,赠金适合用在moonshot-v1系列这些经典模型上。

注册去 platform.moonshot.cn,注册后做个人认证。API Key在控制台"API Key管理"里新建。

base_url:https://api.moonshot.cn/v1

bash · 轻触全选复制

curl https://api.moonshot.cn/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $MOONSHOT_API_KEY" \
  -d '{
    "model": "moonshot-v1-8k",
    "messages": [{"role": "user", "content": "你好"}]
  }'

python · 轻触全选复制

from openai import OpenAI

client = OpenAI(
    api_key="你的Key",
    base_url="https://api.moonshot.cn/v1",
)
resp = client.chat.completions.create(
    model="moonshot-v1-8k",
    messages=[{"role": "user", "content": "你好"}],
)
print(resp.choices[0].message.content)

避坑:Kimi的限流按并发数、RPM、TPM、TPD四个维度算,用户级共享;响应头里有X-RateLimit-Remaining,写代码时可以读这个做退避,别等429了再降频。

通用避坑三句话:401先查Key有没有复制全、有没有多带空格,再查账户余额是不是空了;429就降频加指数退避,1秒、2秒、4秒往上加,别硬怼;百炼和智谱都能在控制台看剩余额度,余量掉到20%就该收手或者换一家。

四家加起来,正常写代码、做小工具、喂给智能体当模型后端,撑几个月没问题。额度政策厂商随时会调,动手前去各家控制台看一眼实时页面。

我每天都会扒一波能薅的,关注一下,手快有手慢无。

原始来源: 元启深空

评论 (0)