直接答案:截至 2026 年 8 月 31 日,Google 的 Gemini Developer API 定价页在标准调用中,为 20 个 endpoint 标出了免费输入和输出。它们覆盖通用 Gemini、实时语音、嵌入和机器人模型。但“定价表有免费单元格”不等于你的项目一定能调用,也不代表某个工具或处理模式免费;最终应以你登录 Google AI Studio 的 Rate Limits 页面 后看到的项目实时限额为准。
如果你只是想先跑通一个原型,可以先从项目中已启用的通用 Flash endpoint 评估,并在请求前后记录实际模型名与限额。若要上线生产,必须以模型目录明确标注的生命周期为准,不要因为模型能免费调用就忽略稳定性、地区和数据使用条款。
先做这 4 项检查,再看模型清单
- 地区是否可用。Google 的可用地区页面在 2026 年 8 月 31 日列出了新加坡,但可见列表中没有中国大陆。这个观察会变化,也不能替代法律或账户资格判断;请先查看最新的可用地区列表。页面同时要求用户年满 18 岁。
- 项目是否仍在免费层。新账户从 Free Tier 开始,但层级取决于所选项目及其结算状态。为同一项目新建多个 API key 不会得到多份额度。
- endpoint 是否在你的项目中启用。模型目录只证明模型存在,不证明它对你的项目开放免费调用;定价页也不能显示账户级开通状态。
- 实时限额是否够用。Gemini API 常见维度包括 RPM(每分钟请求数)、输入 TPM(每分钟输入 token)与 RPD(每日请求数)。它们按项目计算,RPD 在太平洋时间午夜重置;部分模型还有其他维度。

这里有一个重要的停止条件:公开文档无法告诉你某个具体项目当前拥有多少 RPM、TPM、RPD、并发或其他额度。不要把博客或旧截图里的固定数字当成自己的配额。Google 也明确说明,公布的速率限制并非保证容量,预览与实验模型通常可能更严格。
当前免费层 endpoint 清单
以下列表来自 Google 官方定价页在 2026 年 8 月 31 日显示的标准输入、输出免费项。为了让选择更快,表中按最自然的候选用途整理;真正的能力、输入类型和生命周期仍应回到模型目录逐项确认。
| 候选方向 | 免费输入/输出 endpoint | 选择提示 |
|---|---|---|
| 通用生成候选 | gemini-3.7-flash、gemini-3.6-flash、gemini-3.5-flash、gemini-3.5-flash-lite、gemini-3.1-flash-lite、gemini-3-flash-preview、gemini-2.5-pro、gemini-2.5-flash、gemini-2.5-flash-lite | 原型可先看 Flash;生产环境按模型目录核对稳定标签,带 preview 的 endpoint 要准备替换方案 |
| 实时、翻译、转写与语音 | gemini-3.5-live-translate-preview、gemini-3.5-transcribe-live、gemini-3.5-transcribe、gemini-3.1-flash-live-preview、gemini-3.1-flash-tts-preview、gemini-2.5-flash-native-audio-preview-12-2025、gemini-2.5-flash-preview-tts | 名称相近不代表协议、音频能力或免费模式相同;按目标 endpoint 的文档测试 |
| 嵌入 | gemini-embedding-001 | 这是当前已核验的免费输入 endpoint;不要自行猜测 Gemini Embedding 2 的调用字符串 |
| 机器人 | gemini-robotics-er-2-preview、gemini-robotics-er-2-streaming-preview、gemini-robotics-er-1.6-preview | 适合明确的机器人研究任务,不应因为免费就作为普通聊天应用默认项 |
所谓“免费”,这里严格指标准定价行里的输入与输出费用为免费。Batch、缓存、图像生成、搜索或地图 grounding、文件检索等工具与模式可能另有可用性或费用;不能从 token 免费推导出整条请求链都免费。
哪些看起来像 Gemini,却不属于这份标准免费清单
同一日期,定价页把下列 endpoint 的标准免费层输入和输出显示为不可用:
gemini-omni-1.1-flashgemini-omni-flash-previewgemini-3.1-pro-previewgemini-3.1-pro-preview-customtoolsgemini-3.1-flash-imagegemini-3.1-flash-lite-imagegemini-3-pro-imagegemini-2.5-flash-imagegemini-2.5-pro-preview-ttsgemini-2.5-computer-use-preview-10-2025
即使其中某个模型能在 AI Studio 界面中试用,也不能据此认定 Gemini API 为它提供免费额度。“AI Studio 可测试”与“API 项目有免费配额”是两个不同结论。
按工作负载选,而不是按版本号追新
普通文本、多模态理解或结构化输出
先从项目中实际可见的通用 Flash 候选开始,再到模型目录确认其能力与生命周期。用自己的典型输入测试响应质量、延迟和 token 消耗,再决定是否需要更强模型。不要直接把最高版本号当成最适合的默认项。
大上下文或质量优先的低频任务
如果你的项目确实开放 gemini-2.5-pro 免费调用,可以把它作为质量优先的候选,但仍需以项目实时配额判断能否覆盖工作量。免费资格不会消除速率限制,也不会保证持续容量。
实时音频、翻译、转写或 TTS
从名字匹配任务的 endpoint 开始核对,但必须进一步确认模型页所列的输入/输出类型、调用协议与生命周期。多个 endpoint 带 preview 或日期后缀,意味着调用方应把模型名配置化,并为更换 endpoint 留出回归测试。
嵌入与检索
当前可以安全写入配置的是 gemini-embedding-001。定价页虽展示了 Gemini Embedding 2 的免费项,但本轮核验无法在定价页和模型目录之间一致确认它的可调用 endpoint 字符串;在 Google 给出一致标识前,不要凭产品名拼接模型名。

最小调用前核对示例
先在 AI Studio 复制项目实际可用的模型名,再把它放进环境变量。这样,预览模型变化时不用改业务代码。
bashexport GEMINI_MODEL="gemini-3.5-flash" curl "https://generativelanguage.googleapis.com/v1beta/models/${GEMINI_MODEL}:generateContent" \ -H "x-goog-api-key: ${GEMINI_API_KEY}" \ -H "Content-Type: application/json" \ -X POST \ -d '{ "contents": [{ "parts": [{"text": "用一句话说明这次请求是否成功。"}] }] }'
这段示例只演示模型名配置与基本请求,不证明该 endpoint 对你的项目开放,也不代表它适合生产。收到 429 时,先检查触发的是 RPM、TPM、RPD 还是模型特有维度;不要靠轮换同一项目的 API key 规避,因为限额按项目计算。
免费层的数据边界往往比价格更重要
根据 Gemini API Additional Terms,提交给 Unpaid Services 的内容及生成结果可能被用于提供、改进和开发 Google 产品与机器学习技术,也可能由人工审核人员读取、标注和处理。Google 明确建议不要向免费服务提交敏感、机密或个人信息。
付费服务的数据使用条款不同:Google 表示不会用 Paid Services 的提示和回复改进产品。欧洲经济区、瑞士和英国在满足条款所述地区条件时,免费访问适用付费服务的数据处理待遇。这里是操作层面的摘要,不是法律意见;有合规要求时应阅读最新的Gemini API Additional Terms。
因此,只要输入可能包含客户资料、内部代码、个人信息或商业机密,就不应只问“有没有免费额度”。先确定数据能否进入 unpaid service;不能确定时,停止上传,并让法务、安全或数据负责人确认服务层级与条款。
常见问题
Gemini API 免费层有固定的每日请求数吗?
没有一个可对所有读者、所有项目和所有模型通用的可信固定数字。实际限制取决于项目、层级和 endpoint,并可能变化。登录 AI Studio 查看当前项目的 Rate Limits 才是正确做法。
多建几个 API key 能增加免费额度吗?
不能。同一项目中的 key 共用项目级限额。若业务量超过免费层,应评估付费层,而不是把 key 轮换当成扩容方案。
为什么模型目录里有模型,定价页却没有免费额度?
因为“模型存在”“账户可调用”“标准输入输出免费”“某项工具免费”是不同维度。至少要同时核对模型目录、定价页和自己项目的实时限额。
预览模型能用于生产吗?
可以评估,但要接受更快变化、退役和更严格限额的风险。Google 的模型指南建议大多数生产应用使用明确的稳定模型;如果必须使用预览 endpoint,应固定版本、增加回归测试,并准备可切换的替代项。
最后的选择顺序
把决策压缩成五步:先核对地区与年龄资格,再确认项目处于免费层;从定价页筛出免费 endpoint;到模型目录核对能力与生命周期;最后用 AI Studio 的项目实时限额验证工作负载。只有这五步都成立,某个模型才是对你真正“可用的免费模型”。
准备开始时,先用一条非敏感、可重复的真实请求做小规模测试,并保存测试日期、endpoint、项目层级和触发的限额维度。这样,无论 Google 后续调整清单还是配额,你都能知道该重新验证哪一环。



