MODEL PROVIDERS

GPT-5 Codex (high) API Provider 比较

比较 GPT-5 Codex (high) 在 2 家 API Provider 上的价格、任务成本、输出速度、延迟和端到端响应。数据来自公开实测,不修改原始数值。

数据快照:2026-07-28查看原始来源 ↗
已测 Provider2OpenAI、Azure
输出最快156.4Azure · Token/s
首 Token 最快14.5Azure · 秒
单任务成本最低来源暂无数据
API 混合价最低$1.34OpenAI · 每 1M Token

怎样读这页

同一个模型经不同 Provider 托管时,模型能力通常不变,但价格、限流、输出速度和首字延迟会不同。实时聊天优先看延迟,批处理优先看成本与吞吐,长上下文任务还要单独看对应提示类型。

本页的“输出速度”指开始生成后的 Token/s;“首个回答 Token”指从请求到可见回答的等待;“端到端响应”按输出 500 Token 计算,三者不是同一指标。

API PRICE

Provider API 价格

混合价按 7:2:1 的缓存读取、输入和输出 Token 比例计算,便于同口径比较。

每 1M Token 的 7:2:1 混合价
每 1M Token 的 7:2:1 混合价;公开数据01.34 美元OpenAI: 1.34 美元;7:2:1 混合价OpenAI1.34 美元Azure: 1.34 美元;7:2:1 混合价Azure1.34 美元
查看图表数据
项目数值
OpenAI1.34 美元
Azure1.34 美元

SPEED VS PRICE

速度与价格的权衡

更靠左代表价格更低,更靠上代表输出更快;高亮点为当前输出最快 Provider。

Provider 输出速度 vs API 混合价
Provider 输出速度 vs API 混合价API 混合价 / 1M Token输出速度1.338 美元1.338 美元156.4 Token/s156.4 Token/sAzure: API 混合价 / 1M Token 1.338 美元;输出速度 156.444 Token/sAzure

Azure:API 混合价 / 1M Token 1.338 美元,输出速度 156.444 Token/s

查看图表数据
项目API 混合价 / 1M Token输出速度
Azure1.338 美元156.444 Token/s

OUTPUT SPEED

回答生成速度

中位输出速度之外,同时在图表说明中保留 P05–P95 范围,避免只看单点。

Provider 输出速度中位数
Provider 输出速度中位数;公开数据0156.4 Token/sAzure: 156.4 Token/s;P05–P95 110.4–226.3Azure156.4 Token/s
查看图表数据
项目数值
Azure156.4 Token/s

LATENCY

首个回答 Token 等待

数值越低越适合实时交互;P05–P95 能反映请求抖动。

Provider 首个回答 Token 延迟
Provider 首个回答 Token 延迟;公开数据014.5 秒Azure: 14.5 秒;P05–P95 4.4–88.5 秒Azure14.5 秒
查看图表数据
项目数值
Azure14.5 秒

END-TO-END RESPONSE

端到端响应时间

按 500 个输出 Token 计算,拆分输入处理、内部推理和文本生成。

Provider 端到端响应构成
输入处理推理生成 500 Token
Provider 端到端响应构成Azure: 17.6 秒Azure17.6 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Azure17.6 秒14.5 秒0 秒3.2 秒

PROMPT TYPES

不同任务类型下的表现

中等文本、长文本、编码、视觉、并行与 100K 上下文的数据分开呈现,避免用单一中位数替代真实场景。

各任务类型输出速度
各任务类型输出速度;公开数据0156.4 Token/s长文本 · Azure: 156.4 Token/s长文本 · Azure156.4 Token/s100K 上下文 · Azure: 85.5 Token/s100K 上下文 · Azure85.5 Token/s
查看图表数据
项目数值
长文本 · Azure156.4 Token/s
100K 上下文 · Azure85.5 Token/s
各任务类型首块响应
各任务类型首块响应;公开数据014.5 秒长文本 · Azure: 14.5 秒长文本 · Azure14.5 秒100K 上下文 · Azure: 5.3 秒100K 上下文 · Azure5.3 秒
查看图表数据
项目数值
长文本 · Azure14.5 秒
100K 上下文 · Azure5.3 秒
各任务类型端到端响应
各任务类型端到端响应;公开数据017.6 秒长文本 · Azure: 17.6 秒长文本 · Azure17.6 秒100K 上下文 · Azure: 11.1 秒100K 上下文 · Azure11.1 秒
查看图表数据
项目数值
长文本 · Azure17.6 秒
100K 上下文 · Azure11.1 秒

FULL DATA

Provider 完整对照表

图表用于观察关系,表格保留精确数值,便于检索、引用和 AI 系统读取。

GPT-5 Codex (high) Provider 完整数据
Provider输入 / 1M输出 / 1M缓存命中 / 1M7:2:1 混合价单任务成本输出速度速度 P05–P95首 Token延迟 P05–P95端到端上下文函数调用OpenAI 兼容
OpenAI ↗$1.25$10.00$0.13$1.34400,000支持支持
Microsoft Azure ↗$1.25$10.00$0.13$1.34156.4 Token/s110.4–226.314.5 秒4.4–88.5 秒17.6 秒400,000支持支持

FAQ

常见问题

回答由本页结构化公开数据生成。

GPT-5 Codex (high) 有哪些 API Provider?

当前公开数据包含 OpenAI、Azure,共 2 家。

哪家 Provider 输出最快?

Azure 的中位输出速度最高,为 156.4 Token/s。

哪家 Provider 延迟最低?

Azure 的首个回答 Token 中位等待最低,为 14.5 秒。

哪家 Provider 单任务成本最低?

来源暂未给出可比较的任务成本。

为什么同一个模型速度不同?

Provider 的推理硬件、批处理、路由、负载和服务配置不同,因此相同模型的吞吐和延迟会出现差异。