← 返回文章列表 / Back to list
overview

TokenRouter 免费 API 全解析:2 款永久免费模型 + 133 款聚合,一键接入 OpenAI/Claude/Gemini 兼容接口

TokenRouter Free API Guide: 2 Permanent Free Models + 133 Aggregated, One-Click OpenAI/Claude/Gemini Compatible Gateway

更新时间:2026-08-29 · 官网:https://www.tokenrouter.com · 模型数:133 款 · 免费验证:2026-08-29 实测定价页

一句话简介:TokenRouter 是由 PaleBlueDot AI 打造的统一 AI 模型聚合分发平台,把 OpenAI / Anthropic / Google / 阿里 / DeepSeek / xAI 等主流模型统一成 OpenAI、Claude、Gemini 兼容接口,单 Key、单 Base URL 即可调用,兼顾个人极简接入与企业级集中管控。

为什么选 TokenRouter

  • 一 Key 通 133 模型:文本、图像、视频、音频全模态,覆盖 Qwen、GLM、DeepSeek、Gemini、Claude、GPT、Grok、Seedream、Kling、MiniMax 等
  • 三兼容接口openai / openai-response / anthropic / gemini / video-generation 等,按模型自动适配,无需重写业务代码
  • 永久免费模型qwen/qwen3.8-max-freenvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free 输入输出均为 $0.00 / 1M tokens(Pay as you go,官网定价页已验证)
  • 动态全球路由 + 多通道容灾:全球分布式节点实时选优 + 多上游/自建推理云自动切换,单通道限流/超时自动 Failover
  • 智能缓存 + 实时成本治理:请求级过滤与结果复用降 Token,请求前/中/后三段风控防异常账单
  • 企业级管控:集中计费、按成员/团队/部门配额、审计日志、零数据留存(仅记录模型/时间/Token/费用,不存内容)

免费 API 详解(已验证)

模型 提供方 能力 API 格式 计费 输入 输出
qwen/qwen3.8-max-free 阿里巴巴 Text openai Pay as you go $0.00 / 1M $0.00 / 1M
nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free Nvidia Text openai Pay as you go $0.00 / 1M $0.00 / 1M

详情页:https://www.tokenrouter.com/models/qwen/qwen3.8-max-free/ 与 https://www.tokenrouter.com/models/nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free/ 均显示 $0.0000 per 1M。适合零成本跑通接入、Prompt 调优、自动化测试与教学演示。

对比参考(同站付费模型):

  • qwen/qwen3.8-max:$1.00 / $3.00 per 1M
  • deepseek/deepseek-v4-pro:$1.32 / $3.96 per 1M
  • 模型列表页 https://www.tokenrouter.com/models 可按输入/输出/缓存价排序对比

5 分钟快速开始

1) 注册与创建 Key

  1. 打开 https://www.tokenrouter.com 点击 Sign Up 完成注册(邮箱验证)
  2. 控制台 → API Keys → Create Key,命名如 quickstart 并妥善保存
  3. (可选)Providers 中添加上游 Provider Key(如 OpenAI/Anthropic),用于特定路由;仅用免费模型可跳过
  4. Models 页搜索并复制模型名(如 qwen/qwen3.8-max-free
  5. Chat 页可先在线试调,再接入代码;Usage LogsBalance 随时核对消耗

2) 一键调用(OpenAI 兼容)

curl https://api.tokenrouter.com/v1/chat/completions \
  -H "Authorization: Bearer $TOKENROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.8-max-free",
    "messages": [{"role": "user", "content": "用一句话介绍 TokenRouter"}],
    "temperature": 0.7
  }'
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_TOKENROUTER_API_KEY",
    base_url="https://api.tokenrouter.com/v1"  # 统一入口,按文档以控制台实际 Base URL 为准
)
resp = client.chat.completions.create(
    model="nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free",
    messages=[{"role": "user", "content": "Explain TokenRouter in one sentence."}],
)
print(resp.choices[0].message.content)
print(resp.usage)
// Node.js 18+ / TypeScript
import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.TOKENROUTER_API_KEY,
  baseURL: "https://api.tokenrouter.com/v1",
});
const res = await client.chat.completions.create({
  model: "qwen/qwen3.8-max-free",
  messages: [{ role: "user", content: "Hello from TokenRouter!" }],
});
console.log(res.choices[0].message.content);

迁移提示:已接入 OpenAI 的项目通常只需改 base_url + api_key 即可平迁;Claude/Gemini 兼容模型按模型页标注的 anthropic / gemini 格式调用。

3) 免费模型实战建议

  • 先用 :free 模型跑通链路与 Prompt,再按需切换到 qwen3.8-max / deepseek-v4-pro 等付费旗舰对比效果与成本
  • 视频/图像类(wan3.0-videoseedream-5.0-prokling-3.0-turbo 等)走 video-generation / image-generation 端点,计费按秒/张,注意与文本模型分开调试
  • 开启 Usage Logs 追踪 model / tokens / cost / latency,结合 Smart Caching 复用高频 Prompt 降本

个人版 vs 企业版

维度 个人版 企业版
目标 个人试用/独立开发 团队协作/预算管控
账户 自助管理 管理员集中管理
余额 个人钱包 组织统一余额
日志 个人消耗 全员 + 成员级明细
场景 尝鲜、单人集成 统一采购、配额分发、审计

企业版支持:成员/角色管理、按周/月配额、组织级 Overview 大盘、多维分析与全链路审计,适合需要统一结算与合规留痕的团队。

定价与成本优化

  • 透明定价:Models 页每张卡片直接展示 input / output / cache 单价,接入前即可比价
  • 路由模式cost(最省)/ quality(最优)/ speed(最快)/ 指定模型,生产环境可先 cost 起步再精调
  • 自建推理云:对开源模型通过自托管 GPU 集群提供更具性价比的通道(官网博客已说明)
  • 零数据留存:仅记录基础请求元数据(模型、时间戳、Token、费用),内容不落盘,满足隐私与合规诉求

常见问题

Q: 免费模型限速/限额吗? 以控制台与模型页实时展示为准,免费通道适合开发与轻量流量,生产高并发建议切付费模型或企业配额。

Q: 已有 OpenAI 代码要改多少? 大多只需替换 baseURLapiKey,模型名改为 TokenRouter 标识(如 qwen/qwen3.8-max-free),其余 messages / temperature 等参数保持 OpenAI 规范。

Q: 如何排查 401 / No provider keys? 检查 Authorization: Bearer 是否为 TokenRouter Key、是否漏配 Provider Key(特定路由需要)、Base URL 是否与控制台一致。

官方资源

相关文章 / Related

Meta GPT-OSS 120B 入驻 Groq:120B MoE 免费可用,MMLU 90% + Groq LPU 低延迟实测Cerebras Inference 免费 API 完全指南:2000 tokens/s 极速推理,Llama 3.3 70B 零成本接入Pollinations AI 免费 API 实测:图像真免 Key,文本必须匿名才免费(带 Key 反而 402)Cloudflare Workers AI 免费层完全指南:在边缘运行 Llama 3、Mistral 等开源模型inclusionAI Ling 3.0 Flash Fin 免费 API:262K 上下文金融推理,零成本上线