用 OpenAI SDK 兼容方式零成本调用 Gemini 多模态模型

OpenAI SDK 作为统一客户端,只需替换 Base URL 和 key 即可接入 Gemini 免费接口,无需专用 SDK

✓ 免费无需信用卡✓ 1M 上下文多模态 ✕ 免费档数据可能被用于训练

方案简介

本方案来自 awesome-free-llm-apis 清单:通过 Google Gemini 官方免费档 API,以 OpenAI SDK 兼容的接口方式调用大模型文本推理服务。仓库定位为「LLM APIs with permanent free tiers for text inference」,即收录提供永久免费额度的 LLM 推理 API。Google Gemini 条目标注「Free tier, no credit card」,适合零预算开发者在个人项目、原型验证、学习实验中直接用熟悉的 OpenAI SDK 客户端接入多模态模型,无需改造现有代码。

亮点与能力

  • 免费档无需绑定信用卡
  • 接口与 OpenAI SDK 兼容,迁移成本低
  • 提供最大 1M token 上下文窗口
  • 支持 Text + Image + Audio + Video 多模态输入
  • 最大输出 65K token
  • 覆盖 Flash / Flash-Lite / Pro 多档模型选择

组成与分工

  • Google Gemini:模型提供方,通过 Google AI Studio 发放 API key,提供免费推理额度与多模态模型(Gemini Flash/Pro、Gemma 系列)
  • OpenAI SDK:通用客户端,仓库声明「All endpoints are OpenAI SDK-compatible unless noted」,开发者用 OpenAI SDK 指向 Gemini 的 Base URL 即可调用

前置要求

  • 一个 Google 账号(用于在 AI Studio 获取 API key,无需信用卡)
  • 项目中已安装 OpenAI SDK
  • 获取 API key:仓库说明「Each link points to the provider's API key page」,Google Gemini 条目链接指向 https://aistudio.google.com/app/apikey

实施步骤

1. 获取 API Key

前往 Google AI Studio 的 API key 页面(仓库条目中的链接)创建密钥。

2. 配置客户端 Base URL

将 OpenAI SDK 的 base_url 指向 Gemini 的免费接口地址:

https://generativelanguage.googleapis.com/v1beta

3. 选择模型并调用

按需从模型表中选取,如 Gemini 3.5 Flash(1M 上下文,15 RPM / 1,500 RPD)或轻量的 Flash-Lite(30 RPM / 1,500 RPD)。

使用与配置要点

  • 日常使用时注意速率限制:Flash 系列为 15 RPM、1,500 RPD;Flash-Lite 系列为 30 RPM、1,500 RPD;Pro 为 5 RPM、50 RPD
  • Gemini 2.5 Pro 免费额度最低(5 RPM, 50 RPD),仅适合低频任务
  • 通过 context(1M)和 max output(65K)参数规划长文本与长输出场景

注意事项与常见问题

  • 免费档隐私限制:「Free-tier prompts may be used by Google to improve products」,即免费档的提示词可能被 Google 用于产品改进,敏感数据慎用
  • 仓库默认声明 OpenAI SDK 兼容,但「unless noted」,接入前应确认条目无特殊说明
  • 部分模型行 Rate Limit 为「—」,具体限额以官方页面为准

优缺点

  • ✓ 免费无需信用卡
  • ✓ 1M 上下文多模态
  • ✕ 免费档数据可能被用于训练

出处

本方案挖掘自开源项目 mnfst/awesome-free-llm-apis,方案内容与实施命令均来自其 README 原文。

方案出处
mnfst/awesome-free-llm-apis:List of Permanent Free LLM API (API Keys)
7393 star List of Permanent Free LLM API (API Keys)

本方案由真实开源项目挖掘整理,实施命令均来自其 README 原文,安装使用请遵循项目开源协议。