NVIDIA 在 build.nvidia.com 提供名为 NIM(NVIDIA Inference Microservices,NVIDIA 推理微服务)的平台,用户注册后可免费获取 API Key,并接入 100 多个模型,包括 Kimi、DeepSeek、MiniMax、Llama、Gemma、Qwen 和 Mistral 等。该平台运行在 DGX Cloud 上,API 格式与 OpenAI 兼容。
免费额度与调用限制
新账号默认可获得 1,000 inference credits。如果额度不够,用户可在 API Keys 页面点击“Request More”申请额外 4,000 credits,单个账号总额度上限为 5,000 credits。免费层还设置了 40 RPM 的速率限制,也就是每分钟最多 40 次请求,调用过快时可能出现 429 错误。
API Key 的有效期最长可设置为 12 个月。不过,平台当前使用热度较高,原文提到在实际测试中出现过 timeout 和 503 错误,这类情况更多与服务器排队有关,而非本地环境异常。
注册流程分为4步
第一步是在 build.nvidia.com 创建账号,填写邮箱和密码并完成邮箱验证。第二步是手机短信验证,页面会提示“Verify your account to unlock API access”,完成这一步后才能真正调用 API。素材提到,+886 号码可以通过验证,不需要 VPN,也不需要信用卡。
第三步是在 API Keys 页面创建密钥。创建时需要设置名称和过期时间,生成后的 Key 只会完整显示一次,关闭窗口后无法再次查看完整字符串。第四步则是在模型页面查看对应的 Model ID,并将生成的 API 信息填入自己的程序。由于接口格式与 OpenAI 接近,迁移成本相对较低。
可选模型覆盖多类任务
素材列出的可选模型包括 Kimi-K2.5、DeepSeek V3.2、MiniMax-M2.5 / M2.7、Meta Llama 系列以及 NVIDIA Nemotron。另外,Google Gemma、Alibaba Qwen、Mistral 也在平台支持名单中。原文认为,长上下文推理、代码生成、数学推理和多模态任务都能在这些模型中找到对应选项。
常见问题集中在额度、速率和使用范围
如果 1,000 credits 用完,用户可以直接申请额外额度;如果创建 Key 后忘记复制,只能删除后重新生成。对于 429 或 timeout,素材建议从速率限制和平台拥堵两个方向排查,并在重试逻辑中加入指数退避。
使用范围上,原文明确写���免费层仅限 个人原型开发和学习用途,不适用于商用或生产环境。若需要更高调用速率,可前往 NVIDIA 开发者论坛申请提升限制。

