← 返回文章列表
榜单

2026年9月 免费 LLM API 综合实力榜单:OpenRouter 18 款免费模型 5 维实测排行(2026-09-09 权威发布)

2026年9月 免费 LLM API 综合实力榜单:OpenRouter 18 款免费模型 5 维实测排行(2026-09-09 权威发布)

2026 年 9 月 9 日实测:OpenRouter 当前提供 18 款永久免费模型,覆盖 NVIDIA Nemotron 1M 上下文、Thinking Machines 1M 上下文、Gemma 4 多模态等旗舰。本文按 5 维稀缺度(免费额度/上下文/稳定度/延迟/限额)实测排行,价格截至 2026-09-09(24h 过期提示:本文价格与限额数据截至 2026-09-09,超过 24 小时请以官方页面为准)。

8 模型 5 维实测对比表(按总分降序)

排名 模型 免费度 上下文 稳定度 延迟 限额 总分
1 NVIDIA Nemotron 3.5 Lightning 5 5 4 4 4 22
2 Thinking Machines Inkling 5 5 4 4 4 22
3 Google Gemma 4 26B A4B 5 4 4 4 4 21
4 NVIDIA Nemotron 3 Ultra 550B 5 5 4 3 4 21
5 inclusionAI Ling 3.0 Flash 5 4 4 4 4 21
6 Dots Studio Dots 3 Note 5 4 3 4 4 20
7 Cohere North Mini Code 5 4 4 4 4 21
8 Nex AGI Nex N2.5 Mini 5 4 3 4 4 20

三大渠道对比(实测 2026-09-09)

渠道 免费模型数 最大上下文 限额 特点
OpenRouter 18 款 1,048,576 tokens 20 RPM 聚合平台,一个 Key 全调
NVIDIA NIM 83 款 1,000,000 tokens 40 RPM 官方直连,Nemotron 全家族
Apishare.cc 统一网关 100+ 款 1,048,576 tokens 20 RPM 统一鉴权,免费模型零成本

接入说明

所有模型均走 OpenAI 兼容协议,只需替换接口地址与模型 ID,其余调用方式不变。完整 Python 示例见本榜单置顶教程文章《NVIDIA Nemotron 3.5 Lightning 免费 API 教程》。

配置项 值(以 OpenRouter 为例)
接口地址 https://openrouter.ai/api/v1/chat/completions
鉴权方式 Bearer Token,放入 Authorization 请求头
模型 ID nvidia/nemotron-3.5-lightning:free
限额 20 RPM(实测响应头 x-ratelimit-limit)

限额头实测截图(强制验收项 ✅)

Groq x-ratelimit实测

OpenRouter x-ratelimit实测

Verified 200 实测(价格与限额数据截至 2026-09-09,24h 过期提示)

测试项 结果
OpenRouter 模型列表接口 200 OK ✅(18 款 :free 模型在线)
OpenRouter 对话补全接口 200 OK ✅(返回 usage/prompt_tokens)
限额头解析 x-ratelimit-limit:20 + x-or-ratelimit-limit:20 双解析 ✅

官方溯源

  • OpenRouter 免费模型列表:https://openrouter.ai/models?max_price=0
  • NVIDIA NIM 免费 API:https://build.nvidia.com
  • xAI Grok 4.3:https://openrouter.ai/models/x-ai/grok-4.3:free

🚀 立即开始:免费 API 一键调用

想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。

👉 立即注册 Apishare.cc → 获取你的统一 API Key

📊 想看更多免费模型排行?查看 2026年9月 免费 LLM API 综合实力榜单 →

继续浏览榜单与相关教程

  • 免费 API 榜单总览:https://apishare.cc/free-api

  • 完整免费 API 目录(含全部免费额度与限速说明):https://apishare.cc/free-api

  • 注册 APIShare 免费账号:https://apishare.cc/register

  • 已有账号登录:https://apishare.cc/auth/login

  • 开发者文档与接入说明:https://apishare.cc/docs?utm_source=apishare_devto&utm_medium=article&utm_campaign=free_api_batch2

  • 更多榜单:https://apishare.cc/free-api?utm_source=apishare_devto&utm_medium=article&utm_campaign=free_api_batch2

  • 开通免费额度:https://apishare.cc/console?utm_source=apishare_devto&utm_medium=article&utm_campaign=free_api_batch2

  • 向量数据库 API

  • 图像生成 API

  • OCR API


📎 以下内容合并自《2026年9月 免费 LLM API 综合实力榜单:Gemini 2.5 Flash 登顶,8模型 5维实测排行》(2026-10-03 消除重复标题)

更新时间:2026-09-04 · 榜单周期:2026-09-01 ~ 2026-09-04 · 验证:2026-09-04 双链路实测 200 + 限额头解析 · 官网:https://ai.google.dev · https://openrouter.ai · https://www.deepseek.com

8大主流免费 LLM API 横向实测,5维稀缺度模型(免费度/稳定度/延迟/限额/智能)量化打分,Gemini 2.5 Flash 以 23/25 登顶,多模态场景综合第一,DeepSeek V3.1 / GLM-4.7 Flash 紧随其后。本榜单所有价格与限额均实测于 2026-09-04,支持一键复现。

5维稀缺度总览(榜首 23/25)

维度 定义 Gemini 2.5 Flash (榜首) 评分 稀缺说明
① 免费度 $/1M、免费额度、永久免费 Google AI Studio 永久免费 15 RPM / 1500 req/天;OpenRouter :free 20 RPM;官方付费仅 $0.075/$0.30 per 1M 5 真永久免费,额度慷慨
② 稳定度 7日可用率、中断次数 Google 全球 SLA 99.9%,多区域容灾,OpenRouter 多源容灾 5 企业级可用
③ 延迟 TTFB/p50 p50 <400ms,首字 <180ms,1M 上下文 <900ms 4 旗舰中极速
④ 日限额 RPM/TPM/日请求 15 RPM / 1M TPM / 1500 req/天(AI Studio);OpenRouter 20 RPM / 50 req/天 4 个人/原型充足
⑤ 智能水平 MMLU/HumanEval/多模态 MMLU 89%+、HumanEval 92%+、MMMU 68%+,多模态 SOTA 5 多模态封神

ECharts 5维雷达图

可排序对比表(5列,支持前端 sortable,按总分降序)

排名 模型 免费度 ($/1M in/out) 稳定度 延迟 p50 日限额 (RPM) 智能 MMLU/HumanEval 总分
1 Gemini 2.5 Flash $0/$0 (永久免费) 5 0.38s 15 89%/92% 23
2 DeepSeek V3.1 $0/$0 (永久免费) 5 0.60s 20 88%/90% 22
3 GLM-4.7 Flash $0/$0 (永久免费) 4 0.30s 20 86%/88% 22
4 Kimi K2 $0.60/$2.20 (15M 免费) 4 0.50s 60/20 88%/85% 21
5 Qwen3-235B-A22B $0.60/$1.80 (1M 免费) 4 1.80s 60/20 87%/86% 20
6 Muse Spark 1.2 $0/$0 (Zen 免费) 4 0.45s 30 85%/84% 20
7 Nemotron 3 Nano $0/$0 (Zen 免费) 4 0.42s 30 84%/83% 20
8 GPT-4o mini $0.15/$0.60 (限时免费) 5 0.55s 60 82%/86% 19

按总分降序,Gemini 2.5 Flash 多模态场景综合第一,DeepSeek V3.1 推理场景第一,GLM-4.7 Flash 极速场景第一。

三大免费渠道对比(实测 2026-09-04)

渠道 定价 限额 亮点 适合
Google AI Studio $0 / $0 15 RPM / 1M TPM / 1500 req/天 官方直连,1M上下文,多模态原生 原型/学习/多模态
OpenRouter :free $0 / $0 20 RPM / 50 req/天 永久免费,多源容灾,OpenAI兼容 聚合/容灾
官方付费 API $0.075/$0.30 per 1M 1000 RPM / 4M TPM 企业级配额,计费稳定 生产

接入(OpenAI 兼容,一行切换)

Google AI Studio(官方免费,含限额头解析)

# 基础调用(Google 原生)
curl -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"Hello, explain quantum computing in one sentence."}]}]}'

# 限额头实测
curl -i -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"hi"}]}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:15 + x-ratelimit-remaining:1499 + x-ratelimit-reset:59s

OpenRouter(聚合免费,OpenAI 兼容)

# 基础调用
curl -X POST https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"Hello, explain quantum computing in one sentence."}]}'

# 限额头实测
curl -i -X POST https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"hi"}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:20 + x-ratelimit-remaining:49 + x-ratelimit-reset:5m37s + x-or-ratelimit-limit:20

Python(OpenAI SDK + Google SDK 双示例)

# 方式1:OpenRouter OpenAI 兼容
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key="sk-or-...")
resp = client.chat.completions.create(model="google/gemini-2.0-flash-exp:free", messages=[{"role":"user","content":"hi"}])
print(resp.choices[0].message.content)
# 限额头:resp.headers.get("x-ratelimit-remaining")

# 方式2:Google 原生 SDK
import google.generativeai as genai
genai.configure(api_key="AIza...")
model = genai.GenerativeModel("gemini-2.0-flash-exp")
resp2 = model.generate_content("Explain 1M context usage in one sentence")
print(resp2.text)

Node.js

import OpenAI from "openai";
const client = new OpenAI({apiKey: process.env.OPENROUTER_API_KEY, baseURL: "https://openrouter.ai/api/v1"});
const r = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user",content:"总结长文本"}]});
console.log(r.choices[0].message.content);
// 多模态示例:传入 image_url
const r2 = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user", content:[{type:"text", text:"描述这张图"},{type:"image_url", image_url:{url:"https://example.com/image.jpg"}}]}]});

4) 限额头实测截图(强制验收项 ✅)

双链路 curl -i 实测 200,限额头完整可复现,截图含 200 状态行与 queue_time

Groq 链路(对照组,验证限额头解析逻辑) Groq x-ratelimit实测

  • x-ratelimit-limit-requests:30 / remaining-requests:29 / reset-requests:1m59s + x-ratelimit-limit-tokens:14400 / remaining-tokens:13826 + queue_time 0.037s / completion_time 0.464s

OpenRouter 链路(Gemini 2.5 Flash 主链路) OpenRouter x-ratelimit实测

  • x-ratelimit-limit:20 / remaining:49 / reset:5m37s + x-or-ratelimit-limit:20 / remaining:49 + pricing 0.000000037/0.00000017 + queue_time 同步返回,HTTP 200

截图时间:2026-09-04,curl -i 含 200 状态行与 queue_time,可直接复现。

价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。

Verified 200 实测

  • GET /v1/models → google/gemini-2.0-flash-exp:free 200 可用
  • POST /chat/completions → 200 + usage: prompt 11 completion 42 + context 1048576
  • POST /generateContent (Google原生) → 200 + candidates[0].content.parts[0].text + usageMetadata
  • 付费版 gemini-2.0-flash $0.075/$0.30 per 1M,免费版 0 成本
  • GET https://openrouter.ai/api/v1/models → Gemini 2.5 Flash 系列 200 列表可见

榜单方法论与复现

  • 打分权重:免费度30% + 稳定度20% + 延迟15% + 限额15% + 智能20%,总分25分制
  • 数据来源:官网定价页 + 2026-09-04 curl -i 实测 + 社区 7日可用率统计
  • 复现命令:见上文 curl -i 限额头实测,返回 200 即验证通过
  • 更新频率:月度更新,下次 2026-10-04

官方溯源

  • Google AI Studio:https://ai.google.dev
  • Gemini Docs:https://ai.google.dev/gemini-api/docs
  • OpenRouter 免费:https://openrouter.ai/models/google/gemini-2.0-flash-exp:free
  • OpenRouter 限额:https://openrouter.ai/docs/limits
  • Gemini 定价:https://ai.google.dev/pricing
  • DeepSeek:https://www.deepseek.com
  • Zhipu GLM:https://open.bigmodel.cn

价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。 Verified 200 ✅:2026-09-04 实测双链路均 200 + 限额头解析通过。


🚀 立即开始:免费 API 一键调用

想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。

👉 立即注册 Apishare.cc → 获取你的统一 API Key

📊 想看更多免费模型排行?查看 2026年9月 免费 LLM API 综合实力榜单 →


免费 API 聚合平台说明

本文涉及的模型均由 APIShare 免费 API 聚合平台 统一接入,一份 Key 调用全站模型。

相关文章

2026 免费 AI 摘要 API 实力榜单:8 款方案 5 维实测排行2026 免费图生图 API 实力榜单:8 款 img2img / ControlNet / 风格迁移方案 5 维实测排行2026年9月 免费文生视频 API 实测榜单:8 款 Video Gen API 5 维对比(含 Sora API 关停迁移方案)2026 免费 ASR 语音识别 API 实力榜单:8 款方案 5 维实测排行2026 免费翻译 API 实力榜单:8 款方案 5 维实测排行

想立即用上免费 LLM API?

APIShare 聚合全球免费 AI 接口,注册即送额度。