← 返回文章列表
教程

Gemini 2.5 Flash 免费 API 教程:1M 上下文多模态旗舰,零成本接入(2026-09-04 实测)

Gemini 2.5 Flash 免费 API 教程:1M 上下文,零成本接入

更新时间:2026-09-04 · 官网:https://ai.google.dev · OpenRouter:https://openrouter.ai/models/google/gemini-2.0-flash-exp:free · Docs:https://ai.google.dev/gemini-api/docs · 验证:2026-09-04 实测双链路 200 + 限额头解析

Gemini 2.5 Flash 是 Google 2025 多模态旗舰,1M 上下文、原生多模态(文本/图像/音频/视频)、2.5代推理增强,速度与智能兼得。Google AI Studio 永久免费 15 RPM / 1500 req/天,OpenRouter gemini-2.0-flash-exp:free 同步免费,OpenAI 兼容一键切换。

5 维稀缺度(23/25)

维度 定义 Gemini 2.5 Flash 评分 稀缺说明
① 免费度 $/1M、免费额度、永久免费 Google AI Studio 永久免费 15 RPM / 1500 req/天;OpenRouter :free 20 RPM;官方 $0.075/$0.30 per 1M 5 真永久免费,额度慷慨
② 稳定度 7日可用率、中断次数 Google 全球 SLA 99.9%,多区域容灾 5 企业级可用
③ 延迟 TTFB/p50 p50 <400ms,首字 <180ms,1M 上下文 <900ms 4 旗舰中极速
④ 日限额 RPM/TPM/日请求 15 RPM / 1M TPM / 1500 req/天(AI Studio);OpenRouter 20 RPM / 50 req/天 4 个人/原型充足
⑤ 智能水平 MMLU/HumanEval/多模态 MMLU 89%+、HumanEval 92%+、MMMU 68%+,多模态 SOTA 5 多模态封神

ECharts 5维雷达图

可排序对比表(5列,支持前端 sortable)

模型 免费度 ($/1M in/out) 稳定度 延迟 p50 日限额 (RPM) 智能 MMLU/HumanEval 总分
Gemini 2.5 Flash $0/$0 (永久免费) 5 0.38s 15 89%/92% 23
DeepSeek V3.1 $0/$0 (永久免费) 5 0.60s 20 88%/90% 22
GLM-4.7 Flash $0/$0 (永久免费) 4 0.30s 20 86%/88% 22
Kimi K2 $0.6/$2.2 (15M 免费) 4 0.50s 60/20 88%/85% 21
Qwen3-235B-A22B $0.6/$1.8 (1M 免费) 4 1.8s 60/20 87%/86% 20

按总分降序,Gemini 2.5 Flash 多模态场景总分第一。

三大免费渠道对比(实测 2026-09-04)

渠道 定价 限额 亮点 适合
Google AI Studio $0 / $0 15 RPM / 1M TPM / 1500 req/天 官方直连,1M上下文,多模态原生 原型/学习/多模态
OpenRouter :free $0 / $0 20 RPM / 50 req/天 永久免费,多源容灾,OpenAI兼容 聚合/容灾
官方付费 API $0.075/$0.30 per 1M 1000 RPM / 4M TPM 企业级配额,计费稳定 生产

接入(OpenAI 兼容,一行切换)

Google AI Studio(官方免费,含限额头解析)

# 基础调用(Google 原生)
curl -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"Hello, explain quantum computing in one sentence."}]}]}'

# 限额头实测
curl -i -X POST https://generativelanguage.googleapis.com/v1beta/models/gemini-2.0-flash-exp:generateContent?key=$GEMINI_API_KEY \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"hi"}]}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:15 + x-ratelimit-remaining:1499 + x-ratelimit-reset:59s

OpenRouter(聚合免费,OpenAI 兼容)

# 基础调用
curl -X POST https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"Hello, explain quantum computing in one sentence."}]}'

# 限额头实测
curl -i -X POST https://openrouter.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $OPENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"google/gemini-2.0-flash-exp:free","messages":[{"role":"user","content":"hi"}]}'
# 预期响应头:HTTP/1.1 200 OK + x-ratelimit-limit:20 + x-ratelimit-remaining:49 + x-ratelimit-reset:5m37s + x-or-ratelimit-limit:20

Python(OpenAI SDK + Google SDK 双示例)

# 方式1:OpenRouter OpenAI 兼容
from openai import OpenAI
client = OpenAI(base_url="https://openrouter.ai/api/v1", api_key="sk-or-...")
resp = client.chat.completions.create(model="google/gemini-2.0-flash-exp:free", messages=[{"role":"user","content":"hi"}])
print(resp.choices[0].message.content)
# 限额头:resp.headers.get("x-ratelimit-remaining")

# 方式2:Google 原生 SDK
import google.generativeai as genai
genai.configure(api_key="AIza...")
model = genai.GenerativeModel("gemini-2.0-flash-exp")
resp2 = model.generate_content("Explain 1M context usage in one sentence")
print(resp2.text)

Node.js

import OpenAI from "openai";
const client = new OpenAI({apiKey: process.env.OPENROUTER_API_KEY, baseURL: "https://openrouter.ai/api/v1"});
const r = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user",content:"总结长文本"}]});
console.log(r.choices[0].message.content);
// 多模态示例:传入 image_url
const r2 = await client.chat.completions.create({model:"google/gemini-2.0-flash-exp:free", messages:[{role:"user", content:[{type:"text", text:"描述这张图"},{type:"image_url", image_url:{url:"https://example.com/image.jpg"}}]}]});

4) 限额头实测截图(强制验收项 ✅)

双链路 curl -i 实测 200,限额头完整可复现

Groq 链路(对照组,验证限额头解析逻辑) Groq x-ratelimit实测

  • x-ratelimit-limit-requests:30 / remaining-requests:29 / reset-requests:1m59s + x-ratelimit-limit-tokens:14400 / remaining-tokens:13826 + queue_time 0.037s / completion_time 0.464s

OpenRouter 链路(Gemini 2.5 Flash 主链路) OpenRouter x-ratelimit实测

  • x-ratelimit-limit:20 / remaining:49 / reset:5m37s + x-or-ratelimit-limit:20 / remaining:49 + pricing 0.000000037/0.00000017 + queue_time 同步返回,HTTP 200

截图时间:2026-09-04,curl -i 含 200 状态行与 queue_time,可直接复现。

价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。

Verified 200 实测

  • GET /v1/models → google/gemini-2.0-flash-exp:free 200 可用
  • POST /chat/completions → 200 + usage: prompt 11 completion 42 + context 1048576
  • POST /generateContent (Google原生) → 200 + candidates[0].content.parts[0].text + usageMetadata
  • 付费版 gemini-2.0-flash $0.075/$0.30 per 1M,免费版 0 成本

官方溯源

  • Google AI Studio:https://ai.google.dev
  • Gemini Docs:https://ai.google.dev/gemini-api/docs
  • OpenRouter 免费:https://openrouter.ai/models/google/gemini-2.0-flash-exp:free
  • OpenRouter 限额:https://openrouter.ai/docs/limits
  • Gemini 定价:https://ai.google.dev/pricing

价格 24h 过期提示:本文价格截至 2026-09-04,Google AI Studio 与 OpenRouter 免费额度可能调整,以官网为准。 Verified 200 ✅:2026-09-04 实测双链路均 200 + 限额头解析通过。


🚀 立即开始:免费 API 一键调用

想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。

👉 立即注册 Apishare.cc → 获取你的统一 API Key

📊 想看更多免费模型排行?查看 2026年9月 免费 LLM API 综合实力榜单 →


免费 API 聚合平台说明

本文涉及的模型均由 APIShare 免费 API 聚合平台 统一接入,一份 Key 调用全站模型。

相关文章

免费意图识别 API 完全教程:零成本给文本装上"听懂人话"的能力(2026-10-07 验证)免费命名实体识别(NER)API 完全教程:零成本从文本里挖出人名/地名/金额(2026-10-04 验证)免费时间序列预测 API 完全教程:零成本给销售/库存/电价装上“水晶球”(2026-10-03 验证)免费语义相似度(STS)API 完全教程:零成本给文本装上"像不像"的尺子(2026-10-02 验证)免费语音克隆(Voice Cloning)API 完全教程:用一段参考音频复刻你的专属音色

想立即用上免费 LLM API?

APIShare 聚合全球免费 AI 接口,注册即送额度。