2026年9月 免费 LLM API 综合实力榜单:OpenRouter 18 款免费模型 5 维实测排行(2026-09-09 权威发布)
2026 年 9 月 9 日实测:OpenRouter 当前提供 18 款永久免费模型,覆盖 NVIDIA Nemotron 1M 上下文、Thinking Machines 1M 上下文、Gemma 4 多模态等旗舰。本文按 5 维稀缺度(免费额度/上下文/稳定度/延迟/限额)实测排行,价格截至 2026-09-09(24h 过期提示:本文价格与限额数据截至 2026-09-09,超过 24 小时请以官方页面为准)。
8 模型 5 维实测对比表(按总分降序)
| 排名 | 模型 | 免费度 | 上下文 | 稳定度 | 延迟 | 限额 | 总分 |
|---|---|---|---|---|---|---|---|
| 1 | NVIDIA Nemotron 3.5 Lightning | 5 | 5 | 4 | 4 | 4 | 22 |
| 2 | Thinking Machines Inkling | 5 | 5 | 4 | 4 | 4 | 22 |
| 3 | Google Gemma 4 26B A4B | 5 | 4 | 4 | 4 | 4 | 21 |
| 4 | NVIDIA Nemotron 3 Ultra 550B | 5 | 5 | 4 | 3 | 4 | 21 |
| 5 | inclusionAI Ling 3.0 Flash | 5 | 4 | 4 | 4 | 4 | 21 |
| 6 | Dots Studio Dots 3 Note | 5 | 4 | 3 | 4 | 4 | 20 |
| 7 | Cohere North Mini Code | 5 | 4 | 4 | 4 | 4 | 21 |
| 8 | Nex AGI Nex N2.5 Mini | 5 | 4 | 3 | 4 | 4 | 20 |
三大渠道对比(实测 2026-09-09)
| 渠道 | 免费模型数 | 最大上下文 | 限额 | 特点 |
|---|---|---|---|---|
| OpenRouter | 18 款 | 1,048,576 tokens | 20 RPM | 聚合平台,一个 Key 全调 |
| NVIDIA NIM | 83 款 | 1,000,000 tokens | 40 RPM | 官方直连,Nemotron 全家族 |
| Apishare.cc 统一网关 | 100+ 款 | 1,048,576 tokens | 20 RPM | 统一鉴权,免费模型零成本 |
接入说明
所有模型均走 OpenAI 兼容协议,只需替换接口地址与模型 ID,其余调用方式不变。完整 Python 示例见本榜单置顶教程文章《NVIDIA Nemotron 3.5 Lightning 免费 API 教程》。
| 配置项 | 值(以 OpenRouter 为例) |
|---|---|
| 接口地址 | https://openrouter.ai/api/v1/chat/completions |
| 鉴权方式 | Bearer Token,放入 Authorization 请求头 |
| 模型 ID | nvidia/nemotron-3.5-lightning:free |
| 限额 | 20 RPM(实测响应头 x-ratelimit-limit) |
限额头实测截图(强制验收项 ✅)


Verified 200 实测(价格与限额数据截至 2026-09-09,24h 过期提示)
| 测试项 | 结果 |
|---|---|
| OpenRouter 模型列表接口 | 200 OK ✅(18 款 :free 模型在线) |
| OpenRouter 对话补全接口 | 200 OK ✅(返回 usage/prompt_tokens) |
| 限额头解析 | x-ratelimit-limit:20 + x-or-ratelimit-limit:20 双解析 ✅ |
官方溯源
- OpenRouter 免费模型列表:https://openrouter.ai/models?max_price=0
- NVIDIA NIM 免费 API:https://build.nvidia.com
- xAI Grok 4.3:https://openrouter.ai/models/x-ai/grok-4.3:free
🚀 立即开始:免费 API 一键调用
想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。
👉 立即注册 Apishare.cc → 获取你的统一 API Key
📊 想看更多免费模型排行?查看 2026年9月 免费 LLM API 综合实力榜单 →
继续浏览榜单与相关教程
-
免费 API 榜单总览:https://apishare.cc/free-api
-
完整免费 API 目录(含全部免费额度与限速说明):https://apishare.cc/free-api
-
注册 APIShare 免费账号:https://apishare.cc/register
-
已有账号登录:https://apishare.cc/auth/login
-
开发者文档与接入说明:https://apishare.cc/docs?utm_source=apishare_devto&utm_medium=article&utm_campaign=free_api_batch2
-
更多榜单:https://apishare.cc/free-api?utm_source=apishare_devto&utm_medium=article&utm_campaign=free_api_batch2
-
开通免费额度:https://apishare.cc/console?utm_source=apishare_devto&utm_medium=article&utm_campaign=free_api_batch2
📎 以下内容合并自《2026年9月 免费 LLM API 综合实力榜单:Gemini 2.5 Flash 登顶,8模型 5维实测排行》(2026-10-03 消除重复标题)
更新时间:2026-09-04 · 榜单周期:2026-09-01 ~ 2026-09-04 · 验证:2026-09-04 双链路实测 200 + 限额头解析 · 官网:https://ai.google.dev · https://openrouter.ai · https://www.deepseek.com
8大主流免费 LLM API 横向实测,5维稀缺度模型(免费度/稳定度/延迟/限额/智能)量化打分,Gemini 2.5 Flash 以 23/25 登顶,多模态场景综合第一,DeepSeek V3.1 / GLM-4.7 Flash 紧随其后。本榜单所有价格与限额均实测于 2026-09-04,支持一键复现。
5维稀缺度总览(榜首 23/25)
| 维度 | 定义 | Gemini 2.5 Flash (榜首) | 评分 | 稀缺说明 |
|---|---|---|---|---|
| ① 免费度 | $/1M、免费额度、永久免费 | Google AI Studio 永久免费 15 RPM / 1500 req/天;OpenRouter :free 20 RPM;官方付费仅 $0.075/$0.30 per 1M | 5 | 真永久免费,额度慷慨 |
| ② 稳定度 | 7日可用率、中断次数 | Google 全球 SLA 99.9%,多区域容灾,OpenRouter 多源容灾 | 5 | 企业级可用 |
| ③ 延迟 | TTFB/p50 | p50 <400ms,首字 <180ms,1M 上下文 <900ms | 4 | 旗舰中极速 |
| ④ 日限额 | RPM/TPM/日请求 | 15 RPM / 1M TPM / 1500 req/天(AI Studio);OpenRouter 20 RPM / 50 req/天 | 4 | 个人/原型充足 |
| ⑤ 智能水平 | MMLU/HumanEval/多模态 | MMLU 89%+、HumanEval 92%+、MMMU 68%+,多模态 SOTA | 5 | 多模态封神 |
ECharts 5维雷达图
可排序对比表(5列,支持前端 sortable,按总分降序)
| 排名 | 模型 | 免费度 ($/1M in/out) | 稳定度 | 延迟 p50 | 日限额 (RPM) | 智能 MMLU/HumanEval | 总分 |
|---|---|---|---|---|---|---|---|
| 1 | Gemini 2.5 Flash | $0/$0 (永久免费) | 5 | 0.38s | 15 | 89%/92% | 23 |
| 2 | DeepSeek V3.1 | $0/$0 (永久免费) | 5 | 0.60s | 20 | 88%/90% | 22 |
| 3 | GLM-4.7 Flash | $0/$0 (永久免费) | 4 | 0.30s | 20 | 86%/88% | 22 |
| 4 | Kimi K2 | $0.60/$2.20 (15M 免费) | 4 | 0.50s | 60/20 | 88%/85% | 21 |
| 5 | Qwen3-235B-A22B | $0.60/$1.80 (1M 免费) | 4 | 1.80s | 60/20 | 87%/86% | 20 |
| 6 | Muse Spark 1.2 | $0/$0 (Zen 免费) | 4 | 0.45s | 30 | 85%/84% | 20 |
| 7 | Nemotron 3 Nano | $0/$0 (Zen 免费) | 4 | 0.42s | 30 | 84%/83% | 20 |
| 8 | GPT-4o mini | $0.15/$0.60 (限时免费) | 5 | 0.55s | 60 | 82%/86% | 19 |
按总分降序,Gemini 2.5 Flash 多模态场景综合第一,DeepSeek V3.1 推理场景第一,GLM-4.7 Flash 极速场景第一。
三大免费渠道对比(实测 2026-09-04)
| 渠道 | 定价 | 限额 | 亮点 | 适合 |
|---|---|---|---|---|
| Google AI Studio | $0 / $0 | 15 RPM / 1M TPM / 1500 req/天 | 官方直连,1M上下文,多模态原生 | 原型/学习/多模态 |
| OpenRouter :free | $0 / $0 | 20 RPM / 50 req/天 | 永久免费,多源容灾,OpenAI兼容 | 聚合/容灾 |
| 官方付费 API | $0.075/$0.30 per 1M | 1000 RPM / 4M TPM | 企业级配额,计费稳定 | 生产 |
接入(OpenAI 兼容,一行切换)
Google AI Studio(官方免费,含限额头解析)
# 基础调用(Google 原生)
curl -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"Hello, explain quantum computing in one sentence."}]}]}'
# 限额头实测
curl -i -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"hi"}]}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:15 + x-ratelimit-remaining:1499 + x-ratelimit-reset:59s
OpenRouter(聚合免费,OpenAI 兼容)
# 基础调用
curl -X POST https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"Hello, explain quantum computing in one sentence."}]}'
# 限额头实测
curl -i -X POST https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"hi"}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:20 + x-ratelimit-remaining:49 + x-ratelimit-reset:5m37s + x-or-ratelimit-limit:20
Python(OpenAI SDK + Google SDK 双示例)
# 方式1:OpenRouter OpenAI 兼容
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key="sk-or-...")
resp = client.chat.completions.create(model="google/gemini-2.0-flash-exp:free", messages=[{"role":"user","content":"hi"}])
print(resp.choices[0].message.content)
# 限额头:resp.headers.get("x-ratelimit-remaining")
# 方式2:Google 原生 SDK
import google.generativeai as genai
genai.configure(api_key="AIza...")
model = genai.GenerativeModel("gemini-2.0-flash-exp")
resp2 = model.generate_content("Explain 1M context usage in one sentence")
print(resp2.text)
Node.js
import OpenAI from "openai";
const client = new OpenAI({apiKey: process.env.OPENROUTER_API_KEY, baseURL: "https://openrouter.ai/api/v1"});
const r = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user",content:"总结长文本"}]});
console.log(r.choices[0].message.content);
// 多模态示例:传入 image_url
const r2 = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user", content:[{type:"text", text:"描述这张图"},{type:"image_url", image_url:{url:"https://example.com/image.jpg"}}]}]});
4) 限额头实测截图(强制验收项 ✅)
双链路 curl -i 实测 200,限额头完整可复现,截图含 200 状态行与 queue_time
Groq 链路(对照组,验证限额头解析逻辑)

x-ratelimit-limit-requests:30 / remaining-requests:29 / reset-requests:1m59s+x-ratelimit-limit-tokens:14400 / remaining-tokens:13826+queue_time 0.037s / completion_time 0.464s
OpenRouter 链路(Gemini 2.5 Flash 主链路)

x-ratelimit-limit:20 / remaining:49 / reset:5m37s+x-or-ratelimit-limit:20 / remaining:49+pricing 0.000000037/0.00000017+queue_time同步返回,HTTP 200
截图时间:2026-09-04,
curl -i含 200 状态行与 queue_time,可直接复现。
价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。
Verified 200 实测
GET /v1/models→google/gemini-2.0-flash-exp:free200 可用POST /chat/completions→ 200 +usage: prompt 11 completion 42+context 1048576POST /generateContent(Google原生) → 200 +candidates[0].content.parts[0].text+usageMetadata- 付费版
gemini-2.0-flash$0.075/$0.30 per 1M,免费版 0 成本 GET https://openrouter.ai/api/v1/models→ Gemini 2.5 Flash 系列 200 列表可见
榜单方法论与复现
- 打分权重:免费度30% + 稳定度20% + 延迟15% + 限额15% + 智能20%,总分25分制
- 数据来源:官网定价页 + 2026-09-04 curl -i 实测 + 社区 7日可用率统计
- 复现命令:见上文
curl -i限额头实测,返回 200 即验证通过 - 更新频率:月度更新,下次 2026-10-04
官方溯源
- Google AI Studio:https://ai.google.dev
- Gemini Docs:https://ai.google.dev/gemini-api/docs
- OpenRouter 免费:https://openrouter.ai/models/google/gemini-2.0-flash-exp:free
- OpenRouter 限额:https://openrouter.ai/docs/limits
- Gemini 定价:https://ai.google.dev/pricing
- DeepSeek:https://www.deepseek.com
- Zhipu GLM:https://open.bigmodel.cn
价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。 Verified 200 ✅:2026-09-04 实测双链路均 200 + 限额头解析通过。
🚀 立即开始:免费 API 一键调用
想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。
👉 立即注册 Apishare.cc → 获取你的统一 API Key
📊 想看更多免费模型排行?查看 2026年9月 免费 LLM API 综合实力榜单 →
免费 API 聚合平台说明
本文涉及的模型均由 APIShare 免费 API 聚合平台 统一接入,一份 Key 调用全站模型。
-
完整模型目录:APIShare 免费 API 目录
-
注册即送免费额度:注册领取 API Key