NVIDIA NIM 免费 API 详情
实测于 2026-08-27 00:35 +08:00(来源:oneapi 生产 DB Channel 表直读 + 官方 API https://integrate.api.nvidia.com/v1/models 无鉴权实测 83) 渠道 slug:nvidia-nim | 详情页 URL:/free-llm-api-rankings/nvidia-nim | Base URL:https://integrate.api.nvidia.com/v1
1. 渠道介绍
NVIDIA NIM(NVIDIA Inference Microservice)通过 integrate.api.nvidia.com/v1 提供 83 个免费模型——2026-08-27 00:35 无鉴权实测(83 total,33 个 nvidia/ 官方)。免费层覆盖对话 57、嵌入 7、审核/安全 5、翻译 3、视觉 6,含 Llama、Gemma、Qwen、Mistral、DeepSeek、Kimi、Phi 及完整 Nemotron 家族。60 RPM,兼容 OpenAI 的 /v1/chat/completions 与 /v1/models。
2. 实测支持模型列表
口径:models_total = 83(Channel.models 全量直读 + 官方 /v1/models 83 交叉验证);chat = 57;embedding = 7;moderation = 5;translation = 3;vision = 6
对话模型(57 个)
- 01-ai/yi-large
- ai21labs/jamba-1.5-large-instruct
- aisingapore/sea-lion-7b-instruct
- bigcode/starcoder2-15b
- databricks/dbrx-instruct
- deepseek-ai/deepseek-coder-6.7b-instruct
- deepseek-ai/deepseek-v4-flash-0731
- deepseek-ai/deepseek-v4-pro-0813
- google/codegemma-1.1-7b
- google/codegemma-7b
- google/diffusiongemma-26b-a4b-it
- google/gemma-2b
- google/gemma-3-12b-it
- google/gemma-3-4b-it
- google/gemma-4-31b-it
- google/recurrentgemma-2b
- ibm/granite-3.0-3b-a800m-instruct
- ibm/granite-3.0-8b-instruct
- ibm/granite-34b-code-instruct
- ibm/granite-8b-code-instruct
- meta/codellama-70b
- meta/llama2-70b
- meta/muse-glimmer-30b
- microsoft/phi-3.5-moe-instruct
- minimaxai/minimax-m3
- mistralai/codestral-22b-instruct-v0.1
- mistralai/mistral-7b-instruct-v0.3
- mistralai/mistral-large
- mistralai/mistral-large-2-instruct
- mistralai/mistral-nemotron
- mistralai/mixtral-8x22b-v0.1
- moonshotai/kimi-k2.6
- moonshotai/kimi-k3
- nv-mistralai/mistral-nemo-12b-instruct
- nvidia/cosmos-reason2-8b
- nvidia/ising-calibration-1.5-31b
- nvidia/llama-3.1-nemotron-51b-instruct
- nvidia/llama-3.1-nemotron-70b-instruct
- nvidia/llama-3.1-nemotron-ultra-253b-v1
- nvidia/llama3-chatqa-1.5-70b
- nvidia/mistral-nemo-minitron-8b-8k-instruct
- nvidia/nemotron-3-nano-30b-a3b
- nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
- nvidia/nemotron-3-super-120b-a12b
- nvidia/nemotron-3-ultra-550b-a55b
- nvidia/nemotron-3.5-lightning-30b-a3b
- nvidia/nemotron-4-340b-instruct
- nvidia/nemotron-4-340b-reward
- nvidia/nemotron-nano-3-30b-a3b
- openai/gpt-oss-120b
- openai/gpt-oss-20b
- poolside/laguna-xs-2.1
- writer/palmyra-creative-122b
- writer/palmyra-fin-70b-32k
- writer/palmyra-med-70b
- writer/palmyra-med-70b-32k
- zyphra/zamba2-7b-instruct
嵌入模型(7 个)
- nvidia/embed-qa-4
- nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1
- nvidia/llama-3.2-nv-embedqa-1b-v1
- nvidia/llama-nemotron-embed-vl-1b-v2
- nvidia/nemotron-3-embed-1b
- nvidia/nv-embedqa-mistral-7b-v2
- snowflake/arctic-embed-l
审核/安全模型(5 个)
- meta/llama-guard-4-12b
- nvidia/llama-3.1-nemoguard-8b-content-safety
- nvidia/llama-3.1-nemoguard-8b-topic-control
- nvidia/llama-3.1-nemotron-safety-guard-8b-v3
- nvidia/nemotron-3.5-content-safety
翻译模型(3 个)
- nvidia/riva-translate-4b-instruct
- nvidia/riva-translate-4b-instruct-v1.1
- nvidia/riva-translate-4b-instruct-v2
视觉模型(6 个)
- meta/llama-3.2-11b-vision-instruct
- meta/llama-3.2-90b-vision-instruct
- microsoft/phi-3-vision-128k-instruct
- nvidia/cosmos-reason2-8b
- nvidia/neva-22b
- nvidia/vila
3. 注册方法
- 访问 https://build.nvidia.com 使用 NVIDIA 账号登录。
- 在 https://integrate.api.nvidia.com 生成 API Key(请求头
Authorization: Bearer nvapi-...)。 - 免费层无需信用卡,限速 60 RPM。
4. 使用方法
Base URL: https://integrate.api.nvidia.com/v1
兼容 OpenAI。模型列表:GET /v1/models(无需鉴权,返回 83)。对话:POST /v1/chat/completions 携带 model 与 messages。示例:model: "openai/gpt-oss-120b" 或 "nvidia/nemotron-3-nano-30b-a3b"。
5. 实测数据
实测于 2026-08-27 00:35 +08:00,官方 /v1/models 无鉴权 200,返回 83。
| 指标 | 值 | 备注 |
|---|---|---|
| HTTP 状态码 | 200 | GET /v1/models 无鉴权 |
| 模型总数 | 83 | 含 33 个 nvidia/ 官方 |
| 对话模型 | 57 | 含 Llama/Qwen/Mistral/DeepSeek 等 |
| 首 token 延迟 | 待填 | 需 /chat/completions 实测 |
| RPM 限制 | 60 | Channel 表 maxRpm |
| 免费层 | ✅ | 无需信用卡,build.nvidia.com |
6. 优缺点总结
优点:
- 83 个模型,免费池最大(57 对话 + 6 视觉 + 7 嵌入)
- 33 个 nvidia/ 官方 Nemotron 模型
- OpenAI 兼容,/v1/models 无需鉴权
- NIM GPU 加速
缺点:
- 部分模型已 EOL(如 meta/llama-3.1-70b-instruct 于 2026-08-26 410)
- 翻译/视觉为专用模型,非通用对话
本页由 IT 于 2026-08-27 00:35 四重复验生成,数据以 oneapi 生产 DB Channel 表直读 + 官方 API 实测为准。
🚀 立即开始:免费 API 一键调用
想要无需逐一注册、统一鉴权调用以上全部免费模型?Apishare.cc 提供统一 API Key,一个 Key 调用 100+ 模型,免费模型零成本直连。
👉 立即注册 Apishare.cc → 获取你的统一 API Key
📊 想看更多免费模型排行?查看 2026年9月 免费 LLM API 综合实力榜单 →
在 APIShare 上直接开始使用
想现在就动手?三步即可跑通本文提到的方案:
- 注册账号 —— 打开 APIShare 免费 API 注册页 只需邮箱即可创建账号,无需信用卡。
- 浏览免费 API 目录 —— 进入 免费 API 完整列表,按「文本 / 图像 / 音频 / 向量 / 多模态」分类筛选,页面内可直接看到每个 API 的免费额度、限速与可用状态。
- 取 Key 并接入 —— 登录后在控制台生成 API Key,粘贴到你的应用中即可调用。所有套餐均含 持续更新的 active API 网关,覆盖本文提到的全部厂商。
还没注册?先用 APIShare 登录页 登录已有账号,或直接前往 APIShare 首页 了解平台全貌。注册完全免费,不满意随时停止使用。
本文所有外链均带 UTM 追踪参数(utm_source=apishare_devto&utm_medium=referral&utm_campaign=free_api_article),点击后可直达对应页面。
免费 API 聚合平台说明
本文涉及的模型均由 APIShare 免费 API 聚合平台 统一接入,一份 Key 调用全站模型。
- 完整模型目录:APIShare 免费 API 目录
- 注册即送免费额度:注册领取 API Key