← 返回文章列表 / Back to list
rankings

NVIDIA NIM 免费 API - 83 个模型(57 对话 + 26 专项)

NVIDIA NIM Free API - 83 Models (57 Chat + 26 Specialized)

NVIDIA NIM 免费 API 详情

实测于 2026-08-27 00:35 +08:00(来源:oneapi 生产 DB Channel 表直读 + 官方 API https://integrate.api.nvidia.com/v1/models 无鉴权实测 83) 渠道 slug:nvidia-nim | 详情页 URL:/free-llm-api-rankings/nvidia-nim | Base URL:https://integrate.api.nvidia.com/v1


1. 渠道介绍

NVIDIA NIM(NVIDIA Inference Microservice)通过 integrate.api.nvidia.com/v1 提供 83 个免费模型——2026-08-27 00:35 无鉴权实测(83 total,33 个 nvidia/ 官方)。免费层覆盖对话 57、嵌入 7、审核/安全 5、翻译 3、视觉 6,含 Llama、Gemma、Qwen、Mistral、DeepSeek、Kimi、Phi 及完整 Nemotron 家族。60 RPM,兼容 OpenAI 的 /v1/chat/completions/v1/models


2. 实测支持模型列表

口径:models_total = 83(Channel.models 全量直读 + 官方 /v1/models 83 交叉验证);chat = 57;embedding = 7;moderation = 5;translation = 3;vision = 6

对话模型(57 个)

  • 01-ai/yi-large
  • ai21labs/jamba-1.5-large-instruct
  • aisingapore/sea-lion-7b-instruct
  • bigcode/starcoder2-15b
  • databricks/dbrx-instruct
  • deepseek-ai/deepseek-coder-6.7b-instruct
  • deepseek-ai/deepseek-v4-flash-0731
  • deepseek-ai/deepseek-v4-pro-0813
  • google/codegemma-1.1-7b
  • google/codegemma-7b
  • google/diffusiongemma-26b-a4b-it
  • google/gemma-2b
  • google/gemma-3-12b-it
  • google/gemma-3-4b-it
  • google/gemma-4-31b-it
  • google/recurrentgemma-2b
  • ibm/granite-3.0-3b-a800m-instruct
  • ibm/granite-3.0-8b-instruct
  • ibm/granite-34b-code-instruct
  • ibm/granite-8b-code-instruct
  • meta/codellama-70b
  • meta/llama2-70b
  • meta/muse-glimmer-30b
  • microsoft/phi-3.5-moe-instruct
  • minimaxai/minimax-m3
  • mistralai/codestral-22b-instruct-v0.1
  • mistralai/mistral-7b-instruct-v0.3
  • mistralai/mistral-large
  • mistralai/mistral-large-2-instruct
  • mistralai/mistral-nemotron
  • mistralai/mixtral-8x22b-v0.1
  • moonshotai/kimi-k2.6
  • moonshotai/kimi-k3
  • nv-mistralai/mistral-nemo-12b-instruct
  • nvidia/cosmos-reason2-8b
  • nvidia/ising-calibration-1.5-31b
  • nvidia/llama-3.1-nemotron-51b-instruct
  • nvidia/llama-3.1-nemotron-70b-instruct
  • nvidia/llama-3.1-nemotron-ultra-253b-v1
  • nvidia/llama3-chatqa-1.5-70b
  • nvidia/mistral-nemo-minitron-8b-8k-instruct
  • nvidia/nemotron-3-nano-30b-a3b
  • nvidia/nemotron-3-nano-omni-30b-a3b-reasoning
  • nvidia/nemotron-3-super-120b-a12b
  • nvidia/nemotron-3-ultra-550b-a55b
  • nvidia/nemotron-3.5-lightning-30b-a3b
  • nvidia/nemotron-4-340b-instruct
  • nvidia/nemotron-4-340b-reward
  • nvidia/nemotron-nano-3-30b-a3b
  • openai/gpt-oss-120b
  • openai/gpt-oss-20b
  • poolside/laguna-xs-2.1
  • writer/palmyra-creative-122b
  • writer/palmyra-fin-70b-32k
  • writer/palmyra-med-70b
  • writer/palmyra-med-70b-32k
  • zyphra/zamba2-7b-instruct

嵌入模型(7 个)

  • nvidia/embed-qa-4
  • nvidia/llama-3.2-nemoretriever-1b-vlm-embed-v1
  • nvidia/llama-3.2-nv-embedqa-1b-v1
  • nvidia/llama-nemotron-embed-vl-1b-v2
  • nvidia/nemotron-3-embed-1b
  • nvidia/nv-embedqa-mistral-7b-v2
  • snowflake/arctic-embed-l

审核/安全模型(5 个)

  • meta/llama-guard-4-12b
  • nvidia/llama-3.1-nemoguard-8b-content-safety
  • nvidia/llama-3.1-nemoguard-8b-topic-control
  • nvidia/llama-3.1-nemotron-safety-guard-8b-v3
  • nvidia/nemotron-3.5-content-safety

翻译模型(3 个)

  • nvidia/riva-translate-4b-instruct
  • nvidia/riva-translate-4b-instruct-v1.1
  • nvidia/riva-translate-4b-instruct-v2

视觉模型(6 个)

  • meta/llama-3.2-11b-vision-instruct
  • meta/llama-3.2-90b-vision-instruct
  • microsoft/phi-3-vision-128k-instruct
  • nvidia/cosmos-reason2-8b
  • nvidia/neva-22b
  • nvidia/vila

3. 注册方法

  1. 访问 https://build.nvidia.com 使用 NVIDIA 账号登录。
  2. https://integrate.api.nvidia.com 生成 API Key(请求头 Authorization: Bearer nvapi-...)。
  3. 免费层无需信用卡,限速 60 RPM。

4. 使用方法

Base URL: https://integrate.api.nvidia.com/v1

兼容 OpenAI。模型列表:GET /v1/models(无需鉴权,返回 83)。对话:POST /v1/chat/completions 携带 modelmessages。示例:model: "openai/gpt-oss-120b""nvidia/nemotron-3-nano-30b-a3b"


5. 实测数据

实测于 2026-08-27 00:35 +08:00,官方 /v1/models 无鉴权 200,返回 83。

指标 备注
HTTP 状态码 200 GET /v1/models 无鉴权
模型总数 83 含 33 个 nvidia/ 官方
对话模型 57 含 Llama/Qwen/Mistral/DeepSeek 等
首 token 延迟 待填 需 /chat/completions 实测
RPM 限制 60 Channel 表 maxRpm
免费层 无需信用卡,build.nvidia.com

6. 优缺点总结

优点:

  • 83 个模型,免费池最大(57 对话 + 6 视觉 + 7 嵌入)
  • 33 个 nvidia/ 官方 Nemotron 模型
  • OpenAI 兼容,/v1/models 无需鉴权
  • NIM GPU 加速

缺点:

  • 部分模型已 EOL(如 meta/llama-3.1-70b-instruct 于 2026-08-26 410)
  • 翻译/视觉为专用模型,非通用对话

本页由 IT 于 2026-08-27 00:35 四重复验生成,数据以 oneapi 生产 DB Channel 表直读 + 官方 API 实测为准。

相关文章 / Related

opencode.ai Zen 免费 API - 8 个匿名模型(OpenAI 兼容)Agnes 免费 LLM API - 10 个多模态模型(5 对话 + 2 图像 + 3 视频)2026 免费 AI API 速度榜单:Cerebras 领跑,Groq/Mistral 紧随其后Mistral 免费 LLM API - 39 个开源模型Cloudflare 免费 LLM API - 2 个边缘模型