为什么会有「隐藏配额」
大模型官方的 free tier 通常有两套逻辑:一套写在定价页上(比如「每月赠送 X 额度」),另一套藏在控制台的行为里——按项目计、按模型分级、按限流窗口重置。前者人人可见,后者需要动手才能挖出来。
本文只讲 2026 年真实存在、可直接操作的官方路径,不涉及任何第三方中转。具体数字各家会调整,下面统一用「约/通常」表述,请以你登录控制台时看到的为准。
方案一:Google AI Studio / Gemini API —— 用「多项目」而非「多账号」
Google 的免费层是按 Google Cloud 项目发放的,而不是按 Google 账号。这是最容易被忽略的一点。
操作步骤
- 用同一个 Google 账号登录 Google AI Studio(aistudio.google.com)。
- 在 Google Cloud Console 里新建一个项目,把它设为 AI Studio 的当前项目。
- 在 AI Studio 里生成该项目的 API Key,先跑通一次
generateContent调用。 - 需要更多额度时,再新建第二个项目、第三个项目,分别生成 Key。
- 在代码里把多个 Key 做成轮询池(注意:要遵守各项目的独立限流,不要用并发压测去打)。
适用条件与限制
- 免费层的速率限制是按项目计算的,多项目确实能提高总吞吐。
- 但 Google 的服务条款禁止「通过多项目规避配额以变相扩容」,大量建项目有被限权风险,建议控制在合理数量内、仅用于开发测试。
- 部分高能力模型(如带 thinking 的版本)在免费层可能不可用或限流更严,需要到控制台确认当前可用模型列表。
方案二:Mistral La Plateforme —— 免费实验层 + 模型分级
Mistral 的控制台(console.mistral.ai)提供免费实验层,额度通常按模型档位区分:小模型给得多,旗舰模型给得少甚至不给。
操作步骤
- 注册 Mistral 账号,进入 La Plateforme 控制台。
- 在 Billing / Plan 页面确认当前处于免费实验层(Experiment / Free)。
- 调用
GET /v1/models拉取模型列表,逐个测试哪些模型在免费层可用。 - 把可用的小模型用于分类、抽取、摘要等任务,把免费额度省给真正需要旗舰模型的场景。
适用条件与限制
- 免费层通常要求绑定手机号,部分地区可能受限。
- 免费层的调用有速率上限,且官方可能随时调整哪些模型纳入免费范围。
- 免费层数据可能被用于服务改进,不要传敏感数据。
方案三:Cohere —— Trial Key 的「月度重置」节奏
Cohere 的 Dashboard 会给新用户发放 Trial Key,这类 Key 的额度通常是按月重置而不是一次性用完即止。
操作步骤
- 注册 Cohere 账号,在 Dashboard 里找到 Trial API Key(注意区分 Trial 与 Production Key)。
- 记录你的额度重置日期,把开发测试工作集中安排在重置后的窗口内。
- 用 Trial Key 跑
chat和embed两个端点,Embed 类模型通常额度更宽松,适合做向量化批处理。
适用条件与限制
- Trial Key 只允许用于开发和评估,禁止用于生产流量,违反会被封 Key。
- 速率限制较严,批量任务需要自己做节流。
- 额度数值和重置周期以 Dashboard 实时显示为准。
方案四:GitHub Models —— 用 PAT 直接调,额度随账号等级
GitHub Models 是常被忽略的一条官方路径:它把多家模型放在 GitHub 自己的网关后面,用 GitHub PAT 就能调用。
操作步骤
- 登录 GitHub,进入 github.com/marketplace/models。
- 选择一个模型,点击 Playground 先试跑,确认可用。
- 生成一个 fine-grained PAT,只勾选
models:read权限。 - 用该 PAT 调用
https://models.github.ai/inference端点。
适用条件与限制
- 免费额度与你的 GitHub 账号类型(Free / Pro / 组织成员)相关,不同等级拿到的速率不同。
- 免费层主要面向实验和原型,速率限制明显低于付费。
- 这是 GitHub 官方网关,不属于第三方中转。
方案五:阿里云百炼 —— 新用户模型级免费额度
阿里云百炼(bailian.console.aliyun.com)对通义系列模型提供按模型的新用户免费额度,常以「每个模型各自赠送若干 Token」的形式发放。
操作步骤
- 注册阿里云账号并完成实名认证,开通百炼服务。
- 在百炼控制台的「模型广场」逐个查看哪些模型标注了免费额度。
- 为每个有免费额度的模型单独创建 API Key,并记录各自的到期时间。
- 优先用免费额度覆盖 Qwen 小模型的批量任务。
适用条件与限制
- 免费额度通常有有效期(例如开通后若干天内有效),过期不补。
- 按模型独立计算,用超某个模型的额度后不会自动扣其他模型的余额,但会开始计费,需自行设好告警。
- 需要实名认证,且部分模型可能不对个人用户开放免费额度。
操作步骤(通用流程)
- 先查清计量单位:额度是按项目、按账号还是按模型发放?这决定了你能不能叠加。
- 拉取模型列表:免费层的可用模型往往和付费层不同,先跑
/models或看控制台列表。 - 测限流而非测总量:用低频请求摸清 RPM/TPM 上限,比盲目跑批量更有用。
- 记录重置周期:把开发节奏对齐到额度重置窗口。
- 设好用量告警:所有免费层一旦超额都会自动转计费,务必先设预算告警。
注意事项
- 不要用多账号、多虚拟卡等方式刷额度,这属于明确违反服务条款的行为,封号风险高且不划算。
- 免费层普遍不承诺 SLA,且数据可能被用于模型改进,切勿传入个人隐私、商业机密或生产数据。
- 各家额度政策在 2026 年仍处于高频调整期,本文所述机制请以你实际登录控制台时的页面为准。
- 免费额度适合开发、原型、评测;一旦进入生产,请规划正式付费方案。
适用场景
- 个人开发者在做 AI 应用原型,需要稳定的测试额度。
- 小团队做模型选型评测,需要横向对比多家模型效果。
- 教学、课程作业、开源项目 Demo 等非商业用途。
- 需要把 Embedding、分类、摘要这类高频低价值任务放到免费额度上跑。