免费大模型 API

这里收集无需付费就能调用大模型的 API。有长期免费的,有注册就送额度的,也有只在一段时间内免费的限时活动,可按额度、限速与稳定性快速挑选。

免费大模型通常限制较为严格,建议用于开发或测试用途,不建议用于生产环境。

额度、限速、稳定性星级为站长主观测试与标注,仅供参考,实际情况请以各厂商官网为准。

共 8 个生效中

国家/地区

Google AI Studio(Gemini)

美国
额度 限速 稳定性

Google AI Studio 为每个账号提供 Gemini 模型的免费档,按天重置请求额度,不同模型限额不一样,具体以实际为准。

  • Gemini 3.8 Flash
  • Gemini 3.5 Flash Lite
  • Gemma 4 31B
核验于 2026/9/23
前往使用 长期免费

Ollama Cloud

美国
额度 限速 稳定性

Ollama部分云端模型提供一定免费额度,QPS限制相对宽松,每隔2周重置一次额度。注册时可能要求海外手机号验证。

  • gpt-oss:120b
  • gemma4:31b
  • gpt-oss:20b
核验于 2026/9/23
前往使用 长期免费

OpenRouter

美国
额度 限速 稳定性

聚合了数百个模型的统一入口,只有标注了 :free 后缀的模型可以免费使用,厂商发布新模型时通常会在OpenRouter限免,但免费模型速度可能较慢,稳定性一般。

  • gemma-4-31b-it:free
  • glm-5.2:free
核验于 2026/9/23
前往使用 长期免费

Cloudflare Workers AI

美国
额度 限速 稳定性

每个 Cloudflare 账号每天免费10k神经元,可调用部分开源模型,上手较为复杂,速度一般。

  • glm-5.3-flash
  • qwen3.8-27b
  • deepseek-v4-flash-0731
核验于 2026/9/23 来源
前往使用 长期免费

AMD Radeon Cloud

美国
额度 限速 稳定性

AMD Radeon Cloud 是 AMD 面向开发者提供的免费共享大模型 API 服务,兼容 OpenAI 接口,由于使用人数较多,导致速度和稳定性一般。

  • DeepSeek-V4.1-Flash
  • GLM-5.3-Flash
  • Qwen3.8-27B
核验于 2026/9/23
前往使用 长期免费

NVIDIA NIM

美国
额度 限速 稳定性

英伟达官方提供的免费大模型服务,注册时需要手机号验证,限额较为严重,稳定性一般。

  • deepseek-v4.1-flash
  • glm-5.3-flash
核验于 2026/9/23
前往使用 长期免费

Groq

美国
额度 限速 稳定性

Groq 是一家美国 AI 芯片与云服务公司(不是马斯克的Grok哦),专为大模型推理加速设计的 LPU 芯片及高速推理云平台闻名。部分开源模型提供免费额度,速度非常快,但额比较少,模型比较老旧,每日重置一次。

  • qwen3.8-27b
  • gpt-oss-120b
核验于 2026/9/23
前往使用 长期免费

常见问题

这些免费 API 真的免费吗?
都提供了真正免费的调用方式,但形式不同:有的是长期免费但限速很低,有的是注册一次性赠送额度,还有的是会过期的限时活动。使用前请以各家官方的定价页为准。
为什么免费额度老是变?
免费档属于推广手段,厂商会不定期调整甚至取消,且不一定提前通知。我们会定期复核并记录每个条目的最近更新时间。如果发现信息过期,请以官网为准。
需要信用卡或者科学上网吗?
因厂商而异。有的即使使用免费档也要求绑定手机号或支付方式;有的则因地区限制需要自备网络环境。注册前建议先看清各家的要求。
星级是怎么评的?
星级是编辑整理的印象分,不是基准测试。额度反映能拿到多少,限速反映节流有多严格(星越多越宽松),稳定性反映接口在实测中的可靠性。星级用于快速扫视,具体数值请以简介描述为准。

关于本页

我们收集各家大模型厂商公开的免费档、注册赠金与限时活动,整理出「能拿到什么、好不好用」。内容为人工维护,并随政策变动更新。

本页为非官方整理,与所列厂商均无关联。免费政策变动频繁且可能有地区限制,请务必以各厂商官网为准——每张卡片上的链接即为权威出处。