NVIDIA NIM 免费 API 详情
实测于 2026-08-27 00:35 +08:00(来源:oneapi 生产 DB Channel 表直读 + 官方 API https://integrate.api.nvidia.com/v1/models 无鉴权实测 83)
渠道 slug:nvidia-nim | 详情页 URL:/free-llm-api-rankings/nvidia-nim | Base URL:https://integrate.api.nvidia.com/v1
1. 渠道介绍
NVIDIA NIM(NVIDIA Inference Microservice)通过 integrate.api.nvidia.com/v1 提供 83 个免费模型——2026-08-27 00:35 无鉴权实测(83 total,33 个 nvidia/ 官方)。免费层覆盖对话 57、嵌入 7、审核/安全 5、翻译 3、视觉 6,含 Llama、Gemma、Qwen、Mistral、DeepSeek、Kimi、Phi 及完整 Nemotron 家族。60 RPM,兼容 OpenAI 的 /v1/chat/completions 与 /v1/models。
2. 实测支持模型列表
口径:models_total = 83(Channel.models 全量直读 + 官方 /v1/models 83 交叉验证);chat = 57;embedding = 7;moderation = 5;translation = 3;vision = 6
对话模型(57 个)
- 01-ai/yi-large
- ai21labs/jamba-1.5-large-instruct
- aisingapore/sea-lion-7b-instruct
- bigcode/starcoder2-15b
- databricks/dbrx-instruct
- deepseek-ai/deepseek-coder-6.7b-instruct
- deepseek-ai/deepseek-v4-flash-0731
- deepseek-ai/deepseek-v4-pro-0813
- google/codegemma-1.1-7b
- google/codegemma-7b
- google/diffusiongemma-26b-a4b-it
- google/gemma-2b
- google/gemma-3-12b-it
- google/gemma-3-4b-it
- google/gemma-4-31b-it
- google/recurrentgemma-2b
- ibm/granite-3.0-3b-a800m-instruct
- ibm/granite-3.0-8b-instruct
- ibm/granite-34b-code-instruct
- ibm/granite-8b-code-instruct
- meta/codellama-70b
- meta/llama2-70b
- meta/muse-glimmer-30b
- microsoft/phi-3.5-moe-instruct
- minimaxai/minimax-m3
- mistralai/codestral-22b-instruct-v0.1
- mistralai/mistral-7b-instruct-v0.3
- mistralai/mistral-large
- mistralai/mistral-large-2-instruct
- mistralai/mistral-nemotron
- mistralai/mixtral-8x22b-v0.1
- moonshotai/kimi-k2.6
- moonshotai/kimi-k3
- nv-mistralai/mistral-nemo-12b-instruct
- nvidia/cosmos-reason2-8b
- nvidia/ising-calibration-1.5-31b
- nvidia/llama-3.1-nemotron-51b-instruct
- nvidia/llama-3.1-nemotron-70b-instruct
- nvidia/llama-3.1-nemotron-ultra-253b-v1
- nvidia/llama3-chatqa-1.5-70b
- nvidia/mistral-nemo-minitron-8b-8k-instruct
- nvidia/nemotron-3-nano-30b-a3b
- nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
- nvidia/nemotron-3-super-120b-a12b
- nvidia/nemotron-3-ultra-550b-a55b
- nvidia/nemotron-3.5-lightning-30b-a3b
- nvidia/nemotron-4-340b-instruct
- nvidia/nemotron-4-340b-reward
- nvidia/nemotron-nano-3-30b-a3b
- openai/gpt-oss-120b
- openai/gpt-oss-20b
- poolside/laguna-xs-2.1
- writer/palmyra-creative-122b
- writer/palmyra-fin-70b-32k
- writer/palmyra-med-70b
- writer/palmyra-med-70b-32k
- zyphra/zamba2-7b-instruct
嵌入模型(7 个)
- nvidia/embed-qa-4
- nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1
- nvidia/llama-3.2-nv-embedqa-1b-v1
- nvidia/llama-nemotron-embed-vl-1b-v2
- nvidia/nemotron-3-embed-1b
- nvidia/nv-embedqa-mistral-7b-v2
- snowflake/arctic-embed-l
审核/安全模型(5 个)
- meta/llama-guard-4-12b
- nvidia/llama-3.1-nemoguard-8b-content-safety
- nvidia/llama-3.1-nemoguard-8b-topic-control
- nvidia/llama-3.1-nemotron-safety-guard-8b-v3
- nvidia/nemotron-3.5-content-safety
翻译模型(3 个)
- nvidia/riva-translate-4b-instruct
- nvidia/riva-translate-4b-instruct-v1.1
- nvidia/riva-translate-4b-instruct-v2
视觉模型(6 个)
- meta/llama-3.2-11b-vision-instruct
- meta/llama-3.2-90b-vision-instruct
- microsoft/phi-3-vision-128k-instruct
- nvidia/cosmos-reason2-8b
- nvidia/neva-22b
- nvidia/vila
3. 注册方法
- 访问 https://build.nvidia.com 使用 NVIDIA 账号登录。
- 在 https://integrate.api.nvidia.com 生成 API Key(请求头
Authorization: Bearer nvapi-...)。
- 免费层无需信用卡,限速 60 RPM。
4. 使用方法
Base URL: https://integrate.api.nvidia.com/v1
兼容 OpenAI。模型列表:GET /v1/models(无需鉴权,返回 83)。对话:POST /v1/chat/completions 携带 model 与 messages。示例:model: "openai/gpt-oss-120b" 或 "nvidia/nemotron-3-nano-30b-a3b"。
5. 实测数据
实测于 2026-08-27 00:35 +08:00,官方 /v1/models 无鉴权 200,返回 83。
| 指标 |
值 |
备注 |
| HTTP 状态码 |
200 |
GET /v1/models 无鉴权 |
| 模型总数 |
83 |
含 33 个 nvidia/ 官方 |
| 对话模型 |
57 |
含 Llama/Qwen/Mistral/DeepSeek 等 |
| 首 token 延迟 |
待填 |
需 /chat/completions 实测 |
| RPM 限制 |
60 |
Channel 表 maxRpm |
| 免费层 |
✅ |
无需信用卡,build.nvidia.com |
6. 优缺点总结
优点:
- 83 个模型,免费池最大(57 对话 + 6 视觉 + 7 嵌入)
- 33 个 nvidia/ 官方 Nemotron 模型
- OpenAI 兼容,/v1/models 无需鉴权
- NIM GPU 加速
缺点:
- 部分模型已 EOL(如 meta/llama-3.1-70b-instruct 于 2026-08-26 410)
- 翻译/视觉为专用模型,非通用对话
本页由 IT 于 2026-08-27 00:35 四重复验生成,数据以 oneapi 生产 DB Channel 表直读 + 官方 API 实测为准。
🚀 立即开始:免费 API 一键调用
想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。
👉 立即注册 Apishare.cc → 获取你的统一 API Key
在 APIShare 上直接开始使用
想现在就动手?三步即可跑通本文提到的方案:
- 注册账号 —— 打开 APIShare 免费 API 注册页 只需邮箱即可创建账号,无需信用卡。
- 浏览免费 API 目录 —— 进入 免费 API 完整列表,按「文本 / 图像 / 音频 / 向量 / 多模态」分类筛选,页面内可直接看到每个 API 的免费额度、限速与可用状态。
- 取 Key 并接入 —— 登录后在控制台生成 API Key,粘贴到你的应用中即可调用。所有套餐均含 持续更新的 active API 网关,覆盖本文提到的全部厂商。
还没注册?先用 APIShare 登录页 登录已有账号,或直接前往 APIShare 首页 了解平台全貌。注册完全免费,不满意随时停止使用。
本文所有外链均带 UTM 追踪参数(utm_source=apishare_devto&utm_medium=referral&utm_campaign=free_api_article),点击后可直达对应页面。
免费 API 聚合平台说明
本文涉及的模型均由 APIShare 免费 API 聚合平台 统一接入,一份 Key 调用全站模型。
NVIDIA NIM Free API Details
Verified on 2026-08-27 00:35 +08:00 (source: OneAPI production DB Channel table direct read + official API https://integrate.api.nvidia.com/v1/models no-auth verified 83)
Channel slug:nvidia-nim | Detail URL:/free-llm-api-rankings/nvidia-nim | Base URL:https://integrate.api.nvidia.com/v1
1. Channel Overview
NVIDIA NIM (NVIDIA Inference Microservice) exposes 83 free models via integrate.api.nvidia.com/v1 — verified 2026-08-27 00:35 without auth (83 total, 33 nvidia/ official). The free tier covers chat (57), embedding (7), moderation/safety (5), translation (3) and vision (6), including Llama, Gemma, Qwen, Mistral, DeepSeek, Kimi, Phi and the full Nemotron family. 60 RPM, OpenAI-compatible /v1/chat/completions and /v1/models.
2. Verified Supported Models
Scope: models_total = 83 (full Channel.models direct read + official /v1/models 83 cross-verified); chat = 57; embedding = 7; moderation = 5; translation = 3; vision = 6
Chat Models (57)
- 01-ai/yi-large
- ai21labs/jamba-1.5-large-instruct
- aisingapore/sea-lion-7b-instruct
- bigcode/starcoder2-15b
- databricks/dbrx-instruct
- deepseek-ai/deepseek-coder-6.7b-instruct
- deepseek-ai/deepseek-v4-flash-0731
- deepseek-ai/deepseek-v4-pro-0813
- google/codegemma-1.1-7b
- google/codegemma-7b
- google/diffusiongemma-26b-a4b-it
- google/gemma-2b
- google/gemma-3-12b-it
- google/gemma-3-4b-it
- google/gemma-4-31b-it
- google/recurrentgemma-2b
- ibm/granite-3.0-3b-a800m-instruct
- ibm/granite-3.0-8b-instruct
- ibm/granite-34b-code-instruct
- ibm/granite-8b-code-instruct
- meta/codellama-70b
- meta/llama2-70b
- meta/muse-glimmer-30b
- microsoft/phi-3.5-moe-instruct
- minimaxai/minimax-m3
- mistralai/codestral-22b-instruct-v0.1
- mistralai/mistral-7b-instruct-v0.3
- mistralai/mistral-large
- mistralai/mistral-large-2-instruct
- mistralai/mistral-nemotron
- mistralai/mixtral-8x22b-v0.1
- moonshotai/kimi-k2.6
- moonshotai/kimi-k3
- nv-mistralai/mistral-nemo-12b-instruct
- nvidia/cosmos-reason2-8b
- nvidia/ising-calibration-1.5-31b
- nvidia/llama-3.1-nemotron-51b-instruct
- nvidia/llama-3.1-nemotron-70b-instruct
- nvidia/llama-3.1-nemotron-ultra-253b-v1
- nvidia/llama3-chatqa-1.5-70b
- nvidia/mistral-nemo-minitron-8b-8k-instruct
- nvidia/nemotron-3-nano-30b-a3b
- nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
- nvidia/nemotron-3-super-120b-a12b
- nvidia/nemotron-3-ultra-550b-a55b
- nvidia/nemotron-3.5-lightning-30b-a3b
- nvidia/nemotron-4-340b-instruct
- nvidia/nemotron-4-340b-reward
- nvidia/nemotron-nano-3-30b-a3b
- openai/gpt-oss-120b
- openai/gpt-oss-20b
- poolside/laguna-xs-2.1
- writer/palmyra-creative-122b
- writer/palmyra-fin-70b-32k
- writer/palmyra-med-70b
- writer/palmyra-med-70b-32k
- zyphra/zamba2-7b-instruct
Embedding Models (7)
- nvidia/embed-qa-4
- nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1
- nvidia/llama-3.2-nv-embedqa-1b-v1
- nvidia/llama-nemotron-embed-vl-1b-v2
- nvidia/nemotron-3-embed-1b
- nvidia/nv-embedqa-mistral-7b-v2
- snowflake/arctic-embed-l
Moderation/Safety Models (5)
- meta/llama-guard-4-12b
- nvidia/llama-3.1-nemoguard-8b-content-safety
- nvidia/llama-3.1-nemoguard-8b-topic-control
- nvidia/llama-3.1-nemotron-safety-guard-8b-v3
- nvidia/nemotron-3.5-content-safety
Translation Models (3)
- nvidia/riva-translate-4b-instruct
- nvidia/riva-translate-4b-instruct-v1.1
- nvidia/riva-translate-4b-instruct-v2
Vision Models (6)
- meta/llama-3.2-11b-vision-instruct
- meta/llama-3.2-90b-vision-instruct
- microsoft/phi-3-vision-128k-instruct
- nvidia/cosmos-reason2-8b
- nvidia/neva-22b
- nvidia/vila
3. Registration
- Visit https://build.nvidia.com and sign in with NVIDIA account.
- Generate API key at https://integrate.api.nvidia.com (header
Authorization: Bearer nvapi-...).
- Free tier is available without credit card; rate limit 60 RPM.
4. Usage
Base URL: https://integrate.api.nvidia.com/v1
OpenAI-compatible. List models: GET /v1/models (no auth required, returns 83). Chat: POST /v1/chat/completions with model and messages. Example: model: "openai/gpt-oss-120b" or "nvidia/nemotron-3-nano-30b-a3b".
5. Verified Metrics
实测于 2026-08-27 00:35 +08:00,官方 /v1/models 无鉴权 200,返回 83。
| Metric |
Value |
Notes |
| HTTP 状态码 |
200 |
GET /v1/models 无鉴权 |
| 模型总数 |
83 |
含 33 个 nvidia/ 官方 |
| 对话模型 |
57 |
含 Llama/Qwen/Mistral/DeepSeek 等 |
| 首 token 延迟 |
待填 |
需 /chat/completions 实测 |
| RPM 限制 |
60 |
Channel 表 maxRpm |
| 免费层 |
✅ |
无需信用卡,build.nvidia.com |
6. Pros & Cons
Pros:
- 83 models, largest free pool (57 chat + 6 vision + 7 embedding)
- 33 nvidia/ official Nemotron models
- OpenAI-compatible, no auth for /v1/models
- GPU-accelerated NIM
Cons:
- Some models EOL (e.g. meta/llama-3.1-70b-instruct 410 on 2026-08-26)
- Translation/vision models are specialized, not general chat
本页由 IT 于 2026-08-27 00:35 四重复验生成,数据以 oneapi 生产 DB Channel 表直读 + 官方 API 实测为准。
🚀 Get Started: One-Click Free API Access
Want to call all the free models above with a single API key, no need to sign up for each provider? Apishare.cc provides a unified API Key — one key, 100+ models, free models at zero cost.
👉 Register on Apishare.cc → Get your unified API Key
Start on APIShare in three steps
Ready to try the options above? Three steps get you running:
- Create an account - open the APIShare free API registration page. An email address is all you need; no credit card required.
- Browse the free API catalog - head to the complete free API list and filter by text, image, audio, embedding, or multimodal. Each entry shows its free quota, rate limit, and availability status.
- Grab a key and integrate - generate an API key in your dashboard and paste it into your application. Every plan includes actively-updated APIs gateways covering every provider mentioned in this guide.
Already have an account? Use the APIShare login page, or visit the APIShare homepage for a full platform overview. Registration is free, and you can stop at any time.
Every outbound link in this guide carries a UTM parameter (utm_source=apishare_devto&utm_medium=referral&utm_campaign=free_api_article) for clean campaign attribution.
About the Free API Aggregator
The models covered in this guide are all served through the APIShare free API aggregator, which gives you one key for the whole catalog.