模型日报 · 2026-08-17

模型日报 2026-08-17|Nemotron 3.5 Lightning API 价格下调 20%

OpenRouter 当前精确付费型号 nvidia/nemotron-3.5-lightning 的输入、输出和缓存读取价格均下降 20%。本期核对新旧报价、Artificial Analysis 独立评测与选型边界。

数据快照:2026-08-17查看 OpenRouter 精确型号 ↗

TODAY'S TAKE

一句话结论

三项均降 20%

输入 $0.10 → $0.08,输出 $0.25 → $0.20,缓存读取 $0.05 → $0.04。

只认精确型号

变化绑定 nvidia/nemotron-3.5-lightning,不合并免费版或相似名称。

能力与价格分开

Artificial Analysis 独立评测继续描述能力;OpenRouter 只负责当前 API 价格与可用性。

Nemotron 3.5 Lightning 的 API 价格怎么变

OpenRouter 第一方模型 API 与模型详情页在 2026-08-17 01:03:58 UTC 显示,精确付费型号 nvidia/nemotron-3.5-lightning 的三项目录价均低于 2026-08-12 01:04:58 UTC 的上一已提交观测。单位均为美元/百万 Token。

OpenRouter 精确付费 variant 价格变化(USD / 1M tokens)
项目上一观测当前观测变化
输入$0.10$0.08-20%
输出$0.25$0.20-20%
缓存读取$0.05$0.04-20%

若一次调用恰好使用 100 万输入 Token 与 100 万输出 Token,目录价的简单合计会从 $0.35 降至 $0.28,减少 $0.07。真实账单仍取决于实际 Token 结构、缓存命中和所选 provider,不能把这个示例当作固定任务成本。

独立评测告诉了我们什么

本站模型页保留 Artificial Analysis 的第三方观测。其当前模型详情页将 Nemotron 3.5 Lightning 的 Intelligence Index 展示为 24,并标注 31.6B 总参数、3.6B 激活参数和 1M 上下文窗口。它说明这是偏高吞吐、长上下文的开放权重模型,但不等于 OpenRouter 的当前 API 报价。

这次没有新增模型或新评测,也没有用价格变化改写能力分数。对选型真正有用的是把两条证据并排看:第三方评测回答“能力和性能如何”,精确 API 价格回答“当前调用成本如何”。

对模型选型的影响

三项价格同步下降 20%,对高频 Agent 调用、长输入和缓存读取量较大的工作负载都有直接成本影响。若团队此前因为输出价或缓存价排除了这个型号,可以按真实 Token 分布重算一次;若主要约束是能力上限,仍应先看独立评测和自己的任务回放。

模型页可见多个 provider,实际路由报价、延迟和吞吐可能不同。生产预算应固定 model ID,并根据路由策略核对 provider,而不是只按模型名称做模糊匹配。

未知项与不可比边界

  • 本期只确认 OpenRouter 精确付费型号;独立 :free variant 不进入付费价格历史。
  • OpenRouter 目录价、详情页 provider 报价与 Artificial Analysis 的评测成本是不同口径,不能互相覆盖。
  • 价格是在两次 observedAt 之间被观察到变化,不代表我们知道它的精确生效时刻。
  • Artificial Analysis 的排名与性能展示会随 provider 与样本更新;本期没有把动态排序变化当作新评测。

相关页面

FAQ

Nemotron 3.5 Lightning 价格常见问题

Nemotron 3.5 Lightning 这次降价多少?

OpenRouter 精确付费型号 nvidia/nemotron-3.5-lightning 的输入、输出和缓存读取目录价均比上一已提交观测下降 20%。

这个价格等于 Artificial Analysis 的评测价格吗?

不等于。本文当前 API 价格只来自 OpenRouter;Artificial Analysis 的价格与 Cost per Task 属于其独立评测和 provider 口径。

可以把免费型号当作同一价格吗?

不可以。带 :free 后缀的型号是独立的限额或路由 variant,不能覆盖精确付费型号的价格历史。