Gemini 2.5 Flash 免费 API 教程:1M 上下文,零成本接入
更新时间:2026-09-04 · 官网:https://ai.google.dev · OpenRouter:https://openrouter.ai/models/google/gemini-2.0-flash-exp:free · Docs:https://ai.google.dev/gemini-api/docs · 验证:2026-09-04 实测双链路 200 + 限额头解析
Gemini 2.5 Flash 是 Google 2025 多模态旗舰,1M 上下文、原生多模态(文本/图像/音频/视频)、2.5代推理增强,速度与智能兼得。Google AI Studio 永久免费 15 RPM / 1500 req/天,OpenRouter gemini-2.0-flash-exp:free 同步免费,OpenAI 兼容一键切换。
5 维稀缺度(23/25)
| 维度 | 定义 | Gemini 2.5 Flash | 评分 | 稀缺说明 |
|---|---|---|---|---|
| ① 免费度 | $/1M、免费额度、永久免费 | Google AI Studio 永久免费 15 RPM / 1500 req/天;OpenRouter :free 20 RPM;官方 $0.075/$0.30 per 1M | 5 | 真永久免费,额度慷慨 |
| ② 稳定度 | 7日可用率、中断次数 | Google 全球 SLA 99.9%,多区域容灾 | 5 | 企业级可用 |
| ③ 延迟 | TTFB/p50 | p50 <400ms,首字 <180ms,1M 上下文 <900ms | 4 | 旗舰中极速 |
| ④ 日限额 | RPM/TPM/日请求 | 15 RPM / 1M TPM / 1500 req/天(AI Studio);OpenRouter 20 RPM / 50 req/天 | 4 | 个人/原型充足 |
| ⑤ 智能水平 | MMLU/HumanEval/多模态 | MMLU 89%+、HumanEval 92%+、MMMU 68%+,多模态 SOTA | 5 | 多模态封神 |
ECharts 5维雷达图
可排序对比表(5列,支持前端 sortable)
| 模型 | 免费度 ($/1M in/out) | 稳定度 | 延迟 p50 | 日限额 (RPM) | 智能 MMLU/HumanEval | 总分 |
|---|---|---|---|---|---|---|
| Gemini 2.5 Flash | $0/$0 (永久免费) | 5 | 0.38s | 15 | 89%/92% | 23 |
| DeepSeek V3.1 | $0/$0 (永久免费) | 5 | 0.60s | 20 | 88%/90% | 22 |
| GLM-4.7 Flash | $0/$0 (永久免费) | 4 | 0.30s | 20 | 86%/88% | 22 |
| Kimi K2 | $0.6/$2.2 (15M 免费) | 4 | 0.50s | 60/20 | 88%/85% | 21 |
| Qwen3-235B-A22B | $0.6/$1.8 (1M 免费) | 4 | 1.8s | 60/20 | 87%/86% | 20 |
按总分降序,Gemini 2.5 Flash 多模态场景总分第一。
三大免费渠道对比(实测 2026-09-04)
| 渠道 | 定价 | 限额 | 亮点 | 适合 |
|---|---|---|---|---|
| Google AI Studio | $0 / $0 | 15 RPM / 1M TPM / 1500 req/天 | 官方直连,1M上下文,多模态原生 | 原型/学习/多模态 |
| OpenRouter :free | $0 / $0 | 20 RPM / 50 req/天 | 永久免费,多源容灾,OpenAI兼容 | 聚合/容灾 |
| 官方付费 API | $0.075/$0.30 per 1M | 1000 RPM / 4M TPM | 企业级配额,计费稳定 | 生产 |
接入(OpenAI 兼容,一行切换)
Google AI Studio(官方免费,含限额头解析)
# 基础调用(Google 原生)
curl -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"Hello, explain quantum computing in one sentence."}]}]}'
# 限额头实测
curl -i -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
-H "Content-Type: application/json" \
-d '{"contents":[{"parts":[{"text":"hi"}]}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:15 + x-ratelimit-remaining:1499 + x-ratelimit-reset:59s
OpenRouter(聚合免费,OpenAI 兼容)
# 基础调用
curl -X POST https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"Hello, explain quantum computing in one sentence."}]}'
# 限额头实测
curl -i -X POST https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"hi"}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:20 + x-ratelimit-remaining:49 + x-ratelimit-reset:5m37s + x-or-ratelimit-limit:20
Python(OpenAI SDK + Google SDK 双示例)
# 方式1:OpenRouter OpenAI 兼容
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key="sk-or-...")
resp = client.chat.completions.create(model="google/gemini-2.0-flash-exp:free", messages=[{"role":"user","content":"hi"}])
print(resp.choices[0].message.content)
# 限额头:resp.headers.get("x-ratelimit-remaining")
# 方式2:Google 原生 SDK
import google.generativeai as genai
genai.configure(api_key="AIza...")
model = genai.GenerativeModel("gemini-2.0-flash-exp")
resp2 = model.generate_content("Explain 1M context usage in one sentence")
print(resp2.text)
Node.js
import OpenAI from "openai";
const client = new OpenAI({apiKey: process.env.OPENROUTER_API_KEY, baseURL: "https://openrouter.ai/api/v1"});
const r = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user",content:"总结长文本"}]});
console.log(r.choices[0].message.content);
// 多模态示例:传入 image_url
const r2 = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user", content:[{type:"text", text:"描述这张图"},{type:"image_url", image_url:{url:"https://example.com/image.jpg"}}]}]});
4) 限额头实测截图(强制验收项 ✅)
双链路 curl -i 实测 200,限额头完整可复现
Groq 链路(对照组,验证限额头解析逻辑)

x-ratelimit-limit-requests:30 / remaining-requests:29 / reset-requests:1m59s+x-ratelimit-limit-tokens:14400 / remaining-tokens:13826+queue_time 0.037s / completion_time 0.464s
OpenRouter 链路(Gemini 2.5 Flash 主链路)

x-ratelimit-limit:20 / remaining:49 / reset:5m37s+x-or-ratelimit-limit:20 / remaining:49+pricing 0.000000037/0.00000017+queue_time同步返回,HTTP 200
截图时间:2026-09-04,
curl -i含 200 状态行与 queue_time,可直接复现。
价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。
Verified 200 实测
GET /v1/models→google/gemini-2.0-flash-exp:free200 可用POST /chat/completions→ 200 +usage: prompt 11 completion 42+context 1048576POST /generateContent(Google原生) → 200 +candidates[0].content.parts[0].text+usageMetadata- 付费版
gemini-2.0-flash$0.075/$0.30 per 1M,免费版 0 成本
官方溯源
- Google AI Studio:https://ai.google.dev
- Gemini Docs:https://ai.google.dev/gemini-api/docs
- OpenRouter 免费:https://openrouter.ai/models/google/gemini-2.0-flash-exp:free
- OpenRouter 限额:https://openrouter.ai/docs/limits
- Gemini 定价:https://ai.google.dev/pricing
价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。 Verified 200 ✅:2026-09-04 实测双链路均 200 + 限额头解析通过。
🚀 立即开始:免费 API 一键调用
想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。
👉 立即注册 Apishare.cc → 获取你的统一 API Key
📊 想看更多免费模型排行?查看 2026年9月 免费 LLM API 综合实力榜单 →
免费 API 聚合平台说明
本文涉及的模型均由 APIShare 免费 API 聚合平台 统一接入,一份 Key 调用全站模型。
-
完整模型目录:APIShare 免费 API 目录
-
注册即送免费额度:注册领取 API Key