MODEL ANALYSIS
Grok 4.6 (xhigh)
Grok 4.6 (xhigh)(SpaceXAI)公开数据详情:智能指数 60.0、生成速度 61.0 Token/s、上下文 500,000 Token、单任务成本 US$1.23。来源 Artificial Analysis,快照 2026-08-27;本站不重新评测或修改分数。
模型概览
Grok 4.6 (xhigh) 的 Intelligence Index 为 60.0,生成速度为 61.0 Token/s,完整评测成本为 US$1428.64。这些指标分别反映能力、吞吐和评测经济性,不能合并成单一“最好”结论。
技术规格
- 机构
- SpaceXAI
- 发布日期
- 2026-08-12
- 推理类型
- 推理模型
- 模型权重
- 未开放权重
- 上下文窗口
- 500,000 Token
- 输入模态
- 文本、图像
- 输出模态
- 文本
- 性能来源
- SpaceXAI
INTERACTIVE COMPARISON
模型指标比较器
切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据,并始终保留当前模型。
- Claude Fable 562.1
- Grok 4.6 (high)60.9
- Kimi K3 (max)59.7
- GLM-5.359.5
- Qwen3.8-Max58.1
- GLM-5.3-Flash57.5
- Grok 4.5 (high)55.8
INTELLIGENCE
Artificial Analysis 智能指数
v4.1 由 9 项独立评测组成;数值越高越好。蓝色代表当前模型。
查看图表数据
INTELLIGENCE BREAKDOWN
9 项组成评测
各列保留来源站点的展示口径;GDPval 使用归一化值,AA-Omniscience 使用知识可靠指数,其余为通过率。
查看图表数据
| 项目 | 数值 |
|---|---|
| GDPval-AA v2 | 62.8% |
| τ³-Banking | 43.3% |
| Terminal-Bench v2.1 | 88.0% |
| SciCode | 51.6% |
| AA-LCR | 75.7% |
| AA-Omniscience | 29.3 |
| Humanity's Last Exam | 44.1% |
| GPQA Diamond | 93.5% |
| CritPt | 19.7% |
AA-BRIEFCASE
真实知识工作成果质量
Elo 来自对可交付成果的成对比较;同时观察分析质量、呈现质量和任务要求通过率。
查看图表数据
| 项目 | 数值 |
|---|---|
| Claude Opus 5 (max) | 1,710 |
| Claude Opus 5 (xhigh) | 1,687 |
| Claude Opus 5 (high) | 1,606 |
| Grok 4.6 (xhigh) | 1,587 |
| Grok 4.6 (high) | 1,577 |
| Claude Fable 5 | 1,572 |
| Kimi K3 (max) | 1,543 |
| Grok 4.6 (medium) | 1,522 |
| GPT-5.6 Sol (max) | 1,502 |
| Claude Opus 5 (medium) | 1,470 |
| Qwen3.8-Max | 1,420 |
| Claude Sonnet 5 (max) | 1,383 |
| Muse Spark 1.2 (xhigh) | 1,363 |
| Grok 4.5 (high) | 1,311 |
| Grok 4.6 (low) | 1,310 |
| Claude Sonnet 5 (xhigh) | 1,292 |
| DeepSeek V4 Flash 0731 (max) | 1,285 |
| GLM-5.2 (max) | 1,251 |
查看图表数据
| 项目 | 数值 |
|---|---|
| 综合 Elo | 1,587 |
| 分析质量 | 1,743 |
| 呈现质量 | 1,565 |
AA-OMNISCIENCE
知识与幻觉
指数同时考虑正确回答和避免幻觉。当前模型准确率 43.0%,幻觉率 24.0%。
查看图表数据
INTELLIGENCE VS COST
能力与单任务成本
右上代表能力更高但成本也更高;理想区域通常靠近左上。横轴使用对数刻度,避免高价模型压扁主体分布。
Grok 4.6 (xhigh):单任务成本 1.23 美元,智能指数 60.014
查看图表数据
TOKEN USE
输出 Token 使用
Token 更多不等于回答更好;它同时影响成本和等待时间。先看同任务下的回答与推理构成。
查看图表数据
| 项目 | 数值 |
|---|---|
| Llama 4 Scout | 1,312 Token |
| GPT-5.6 Luna (Non-reasoning) | 2,238 Token |
| GPT-5.6 Sol (Non-reasoning) | 2,304 Token |
| Llama 4 Maverick | 2,332 Token |
| GPT-5.6 Terra (Non-reasoning) | 2,354 Token |
| GPT-5.6 Luna (low) | 2,478 Token |
| GPT-5.6 Terra (low) | 2,504 Token |
| GPT-5.5 Instant (June 2026) | 2,516 Token |
| gpt-oss-120b (low) | 2,762 Token |
| GPT-5.6 Sol (low) | 2,834 Token |
| Mistral Large 3 | 3,366 Token |
| GPT-5.6 Luna (medium) | 3,940 Token |
| GPT-5.6 Terra (medium) | 4,143 Token |
| Kimi K3 (low) | 4,197 Token |
| Gemma 4 31B | 4,680 Token |
| GPT-5.6 Sol (medium) | 4,758 Token |
| Grok 4.6 (low) | 5,566 Token |
| Devstral 2 | 6,222 Token |
| Devstral Small 2 | 6,536 Token |
| Grok 4.6 (xhigh) | 23,830 Token |
查看图表数据
| 项目 | 合计 | 回答 Token | 推理 Token |
|---|---|---|---|
| Grok 4.6 (xhigh) | 23,830 Token | 9,860 Token | 13,970 Token |
PRICE AND COST
价格与评测成本
API 标价、单任务成本和跑完整套评测的成本是三个不同口径,这里分开呈现。
查看图表数据
| 项目 | 数值 |
|---|---|
| Granite 4.2 3B | 0 美元 |
| GPT-5.6 Luna (low) | 0.01 美元 |
| MiMo-V2.5 | 0.01 美元 |
| Llama 4 Scout | 0.01 美元 |
| GPT-5.6 Luna (medium) | 0.01 美元 |
| GPT-5.6 Luna (Non-reasoning) | 0.01 美元 |
| Granite 4.2 8B | 0.02 美元 |
| gpt-oss-120b (low) | 0.02 美元 |
| GPT-5.6 Luna (high) | 0.02 美元 |
| HyperNova 60B 2605 | 0.02 美元 |
| Nemotron 3 Nano | 0.02 美元 |
| gpt-oss-20b (high) | 0.02 美元 |
| GPT-5.6 Luna (xhigh) | 0.03 美元 |
| MiMo-V2.5-Pro | 0.03 美元 |
| Llama 4 Maverick | 0.03 美元 |
| Hy3 | 0.04 美元 |
| Ling 3.0 Flash | 0.04 美元 |
| Gemma 4 26B A4B | 0.04 美元 |
| Qwen3 Next 80B A3B | 0.04 美元 |
| Grok 4.6 (xhigh) | 1.23 美元 |
查看图表数据
| 项目 | 合计 | 非缓存输入 | 缓存读取 | 缓存写入 | 回答输出 | 推理输出 |
|---|---|---|---|---|---|---|
| 单任务 | 1.23 美元 | 0.01 美元 | 0.44 美元 | 0.64 美元 | 0.06 美元 | 0.08 美元 |
查看图表数据
| 项目 | 合计 | 非缓存输入 | 缓存读取 | 缓存写入 | 回答输出 | 推理输出 |
|---|---|---|---|---|---|---|
| 完整 Intelligence Index | 1,428.64 美元 | 27.08 美元 | 387.89 美元 | 565.23 美元 | 63.16 美元 | 385.29 美元 |
CONTEXT WINDOW
上下文窗口
上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。
查看图表数据
| 项目 | 数值 |
|---|---|
| Llama 4 Scout | 10,000,000 Token |
| Muse Spark 1.2 (xhigh) | 1,048,576 Token |
| Kimi K3 (low) | 1,048,576 Token |
| Solar Open2 250B | 1,048,576 Token |
| Kimi K3 (max) | 1,048,576 Token |
| MiMo-V2.5-Pro | 1,000,000 Token |
| Nova 2.0 Omni (medium) | 1,000,000 Token |
| Gemini 3.5 Flash (minimal) | 1,000,000 Token |
| GPT-5.6 Luna (low) | 1,000,000 Token |
| GPT-5.6 Sol (low) | 1,000,000 Token |
| Gemini 3.5 Flash-Lite | 1,000,000 Token |
| Inkling | 1,000,000 Token |
| Claude Opus 5 (xhigh) | 1,000,000 Token |
| Claude Sonnet 5 (low) | 1,000,000 Token |
| GLM-5.3-Flash | 1,000,000 Token |
| Nova 2.0 Omni | 1,000,000 Token |
| Claude Opus 5 (low) | 1,000,000 Token |
| MiMo-V2.5 | 1,000,000 Token |
| Nemotron 3 Nano | 1,000,000 Token |
| Grok 4.6 (xhigh) | 500,000 Token |
OUTPUT SPEED
回答生成速度
模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。
查看图表数据
| 项目 | 数值 |
|---|---|
| Celeris-1 | 1,550.9 Token/s |
| Mercury 2 | 1,029.3 Token/s |
| LFM2.5-VL-1.6B | 401.5 Token/s |
| Ling 3.0 Flash | 383.5 Token/s |
| Gemini 3.5 Flash-Lite | 381.5 Token/s |
| Gemini 3.7 Flash (medium) | 362.3 Token/s |
| HyperNova 60B 2605 | 362 Token/s |
| Gemini 3.7 Flash (high) | 361.7 Token/s |
| LFM2.5-8B-A1B | 338.4 Token/s |
| Gemini 3.7 Flash (low) | 336.6 Token/s |
| Nemotron 3 Nano Omni 30B A3B | 326.9 Token/s |
| Nemotron 3.5 Lightning | 302.1 Token/s |
| Nova Micro | 299.8 Token/s |
| DeepSeek V4 Flash | 273 Token/s |
| Command A+ | 260.9 Token/s |
| Qwen3.5 Omni Flash | 256.5 Token/s |
| Nemotron 3 Nano | 232.9 Token/s |
| Nemotron 3 Nano | 226.6 Token/s |
| NVIDIA Nemotron Nano 9B V2 | 223.2 Token/s |
| Grok 4.6 (xhigh) | 61 Token/s |
查看图表数据
| 项目 | 数值 |
|---|---|
| Celeris-1 | 9.2 秒 |
| Llama 4 Scout | 10 秒 |
| gpt-oss-120b (low) | 16.7 秒 |
| GPT-5.5 Instant (June 2026) | 17.2 秒 |
| GPT-5.6 Luna (Non-reasoning) | 19.7 秒 |
| GPT-5.6 Luna (low) | 21.3 秒 |
| GPT-5.6 Terra (Non-reasoning) | 22.7 秒 |
| Llama 4 Maverick | 24 秒 |
| GPT-5.6 Terra (low) | 24.1 秒 |
| Mercury 2 | 28.1 秒 |
| GPT-5.6 Sol (Non-reasoning) | 31.3 秒 |
| GPT-5.6 Luna (medium) | 32.6 秒 |
| Gemini 3.5 Flash-Lite | 35 秒 |
| GPT-5.6 Sol (low) | 38 秒 |
| Gemini 3.7 Flash (low) | 41.2 秒 |
| GPT-5.6 Terra (medium) | 42.9 秒 |
| Devstral Small 2 | 45.8 秒 |
| Gemma 4 31B | 53.6 秒 |
| Qwen3.5 122B A10B | 59.7 秒 |
| Grok 4.6 (xhigh) | 385.7 秒 |
LATENCY
首个回答 Token 等待
推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。
查看图表数据
| 项目 | 合计 | 输入处理 | 推理等待 |
|---|---|---|---|
| Celeris-1 | 0.6 秒 | 0.6 秒 | 0 秒 |
| Ministral 3 3B | 0.6 秒 | 0.6 秒 | 0 秒 |
| DeepSeek V4 Flash | 0 秒 | 0 秒 | 0 秒 |
| Grok 4.3 (Non-reasoning) | 0.7 秒 | 0.7 秒 | 0 秒 |
| Gemma 4 E4B | 0.7 秒 | 0.7 秒 | 0 秒 |
| Llama 4 Scout | 0.8 秒 | 0.8 秒 | 0 秒 |
| Claude 4.5 Haiku | 0.8 秒 | 0.8 秒 | 0 秒 |
| Qwen3.5 4B | 0.8 秒 | 0.8 秒 | 0 秒 |
| Granite 4.1 8B | 0.8 秒 | 0.8 秒 | 0 秒 |
| Grok 4.6 (xhigh) | 38.8 秒 | 38.8 秒 | 0 秒 |
END-TO-END RESPONSE TIME
端到端响应时间
按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。
查看图表数据
| 项目 | 合计 | 输入处理 | 推理 | 生成 500 Token |
|---|---|---|---|---|
| Celeris-1 | 0.9 秒 | 0.6 秒 | 0 秒 | 0.3 秒 |
| Gemini 3.7 Flash (low) | 2.5 秒 | 1 秒 | 0 秒 | 1.5 秒 |
| Nova Micro | 2.5 秒 | 0.9 秒 | 0 秒 | 1.7 秒 |
| DeepSeek V4 Flash | 0 秒 | 0 秒 | 0 秒 | 0 秒 |
| LFM2.5-VL-1.6B | 2.6 秒 | 1.4 秒 | 0 秒 | 1.2 秒 |
| Nemotron 3 Nano | 3.2 秒 | 0.9 秒 | 0 秒 | 2.2 秒 |
| Ministral 3 3B | 3.2 秒 | 0.6 秒 | 0 秒 | 2.6 秒 |
| Gemini 3.5 Flash (minimal) | 3.6 秒 | 0.8 秒 | 0 秒 | 2.8 秒 |
| Qwen3.5 Omni Flash | 3.7 秒 | 1.8 秒 | 0 秒 | 1.9 秒 |
| Grok 4.6 (xhigh) | 47 秒 | 38.8 秒 | 0 秒 | 8.2 秒 |
FAQ
Grok 4.6 常见问题
问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。
Grok 4.6 什么时候发布?
Artificial Analysis 当前记录的发布日期为 2026-08-12;本站按来源快照展示,不把发布前预测当作事实。
Grok 4.6 API 价格是多少?
当前没有精确同款的已核实 API 报价;本站上次记录的 Artificial Analysis model aggregate 数据为输入 US$2、输出 US$6(2026-08-27),仅作历史参考。
Grok 4.6 的评测表现怎么样?
当前公开 Intelligence Index 为 60.0,在 268 个当前模型条目中排名第 7。该指数由多项公开评测组成,不等于所有任务中的统一胜率。
Grok 4.6 的上下文窗口有多大?
上下文窗口为 500,000 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。
Grok 4.6 的生成速度是多少?
公开性能数据为 61.0 Token/s,来源为 SpaceXAI。
Grok 4.6 是开源模型吗?
当前Artificial Analysis未提供可核验的开放权重,本站暂按非开放权重处理。
怎样通过 API 使用 Grok 4.6?
原始来源记录了 1 家 Provider。 Provider 横向明细尚未同步。