输入 $0.10 → $0.08,输出 $0.25 → $0.20,缓存读取 $0.05 → $0.04。
模型日报 · 2026-08-17
模型日报 2026-08-17|Nemotron 3.5 Lightning API 价格下调 20%
OpenRouter 当前精确付费型号 nvidia/nemotron-3.5-lightning 的输入、输出和缓存读取价格均下降 20%。本期核对新旧报价、Artificial Analysis 独立评测与选型边界。
TODAY'S TAKE
一句话结论
变化绑定 nvidia/nemotron-3.5-lightning,不合并免费版或相似名称。
Artificial Analysis 独立评测继续描述能力;OpenRouter 只负责当前 API 价格与可用性。
Nemotron 3.5 Lightning 的 API 价格怎么变
OpenRouter 第一方模型 API 与模型详情页在 2026-08-17 01:03:58 UTC 显示,精确付费型号 nvidia/nemotron-3.5-lightning 的三项目录价均低于 2026-08-12 01:04:58 UTC 的上一已提交观测。单位均为美元/百万 Token。
| 项目 | 上一观测 | 当前观测 | 变化 |
|---|---|---|---|
| 输入 | $0.10 | $0.08 | -20% |
| 输出 | $0.25 | $0.20 | -20% |
| 缓存读取 | $0.05 | $0.04 | -20% |
若一次调用恰好使用 100 万输入 Token 与 100 万输出 Token,目录价的简单合计会从 $0.35 降至 $0.28,减少 $0.07。真实账单仍取决于实际 Token 结构、缓存命中和所选 provider,不能把这个示例当作固定任务成本。
独立评测告诉了我们什么
本站模型页保留 Artificial Analysis 的第三方观测。其当前模型详情页将 Nemotron 3.5 Lightning 的 Intelligence Index 展示为 24,并标注 31.6B 总参数、3.6B 激活参数和 1M 上下文窗口。它说明这是偏高吞吐、长上下文的开放权重模型,但不等于 OpenRouter 的当前 API 报价。
这次没有新增模型或新评测,也没有用价格变化改写能力分数。对选型真正有用的是把两条证据并排看:第三方评测回答“能力和性能如何”,精确 API 价格回答“当前调用成本如何”。
对模型选型的影响
三项价格同步下降 20%,对高频 Agent 调用、长输入和缓存读取量较大的工作负载都有直接成本影响。若团队此前因为输出价或缓存价排除了这个型号,可以按真实 Token 分布重算一次;若主要约束是能力上限,仍应先看独立评测和自己的任务回放。
模型页可见多个 provider,实际路由报价、延迟和吞吐可能不同。生产预算应固定 model ID,并根据路由策略核对 provider,而不是只按模型名称做模糊匹配。
未知项与不可比边界
- 本期只确认 OpenRouter 精确付费型号;独立
:freevariant 不进入付费价格历史。 - OpenRouter 目录价、详情页 provider 报价与 Artificial Analysis 的评测成本是不同口径,不能互相覆盖。
- 价格是在两次 observedAt 之间被观察到变化,不代表我们知道它的精确生效时刻。
- Artificial Analysis 的排名与性能展示会随 provider 与样本更新;本期没有把动态排序变化当作新评测。
相关页面
FAQ
Nemotron 3.5 Lightning 价格常见问题
Nemotron 3.5 Lightning 这次降价多少?
OpenRouter 精确付费型号 nvidia/nemotron-3.5-lightning 的输入、输出和缓存读取目录价均比上一已提交观测下降 20%。
这个价格等于 Artificial Analysis 的评测价格吗?
不等于。本文当前 API 价格只来自 OpenRouter;Artificial Analysis 的价格与 Cost per Task 属于其独立评测和 provider 口径。
可以把免费型号当作同一价格吗?
不可以。带 :free 后缀的型号是独立的限额或路由 variant,不能覆盖精确付费型号的价格历史。