MODEL ANALYSIS

Qwen3.8 2.4T A95B

Qwen3.8 2.4T A95B(Alibaba)公开数据详情:智能指数 57.7、生成速度 50.1 Token/s、上下文 983,616 Token、单任务成本 US$1.09。来源 Artificial Analysis,快照 2026-08-14;本站不重新评测或修改分数。

数据快照:2026-08-14查看原始来源 ↗
智能指数57.7第 8 / 275
生成速度50.1Token/s · 第 155 / 175
API 价格$2OpenRouter 当前报价 · 输入 / 1M Token · 输出 $6
单任务成本$1.09低成本第 93 / 100
单任务输出35,986Token · 精简度第 120 / 141

模型概览

Qwen3.8 2.4T A95B 的 Intelligence Index 为 57.7,生成速度为 50.1 Token/s,完整评测成本为 US$1671.89。这些指标分别反映能力、吞吐和评测经济性,不能合并成单一“最好”结论。

技术规格

机构
Alibaba
发布日期
2026-08-12
推理类型
推理模型
模型权重
开放权重
参数规模
2,400B · 激活 95B
权重许可
Qwen3.8-Max License · 不允许商业使用
上下文窗口
983,616 Token
输入模态
文本
输出模态
文本
性能来源
Alibaba
当前 API 来源
OpenRouter · qwen/qwen3.8-2.4t-a95b ↗
核验于 2026-08-14T01:05:01Z

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据,并始终保留当前模型。

24 / 609 个模型 · 正在载入全量数据
智能指数模型比较;当前显示 24 个模型。Grok 4.6 (high)60.9Claude Opus 5 (max)60.7Claude Opus 5 (xhigh)60.1Claude Fable 559.9GPT-5.6 Sol (max)58.9Claude Opus 5 (high)58.9Qwen3.8-Max58.1Qwen3.8 2.4T A95B57.7GPT-5.6 Sol (xhigh)57.7Kimi K357.1Muse Spark 1.2 (xhigh)56.8Claude Opus 5 (medium)56.3Gemini 3.7 Flash (high)56GPT-5.6 Sol (high)55.9Claude Opus 4.8 (max)55.7GPT-5.6 Terra (max)55Grok 4.5 (high)53.8GPT-5.6 Sol (medium)53.6Gemini 3.7 Flash (medium)53.4Claude Sonnet 5 (max)53.4DeepSeek V4 Pro 0813 (max)53DeepSeek V4 Flash 073151.8GPT-5.6 Terra (xhigh)51.6GPT-5.6 Luna (max)51.2

INTELLIGENCE

Artificial Analysis 智能指数

v4.1 由 9 项独立评测组成;数值越高越好。蓝色代表当前模型。

当前模型智能指数对比
当前模型智能指数对比;公开数据060.9Grok 4.6 (high): 60.9;SpaceXAIGrok 4.6 (high)60.9Claude Opus 5 (max): 60.7;AnthropicClaude Opus 5 (max)60.7Claude Opus 5 (xhigh): 60.1;AnthropicClaude Opus 5 (xhigh)60.1Claude Fable 5: 59.9;AnthropicClaude Fable 559.9GPT-5.6 Sol (max): 58.9;OpenAIGPT-5.6 Sol (max)58.9Claude Opus 5 (high): 58.9;AnthropicClaude Opus 5 (high)58.9Qwen3.8-Max: 58.1;AlibabaQwen3.8-Max58.1Qwen3.8 2.4T A95B: 57.7;AlibabaQwen3.8 2.4T A95B57.7GPT-5.6 Sol (xhigh): 57.7;OpenAIGPT-5.6 Sol (xhigh)57.7Kimi K3: 57.1;KimiKimi K357.1Muse Spark 1.2 (xhigh): 56.8;MetaMuse Spark 1.2 (xhigh)56.8Claude Opus 5 (medium): 56.3;AnthropicClaude Opus 5 (medium)56.3Gemini 3.7 Flash (high): 56;GoogleGemini 3.7 Flash (high)56GPT-5.6 Sol (high): 55.9;OpenAIGPT-5.6 Sol (high)55.9Claude Opus 4.8 (max): 55.7;AnthropicClaude Opus 4.8 (max)55.7GPT-5.6 Terra (max): 55;OpenAIGPT-5.6 Terra (max)55Grok 4.5 (high): 53.8;SpaceXAIGrok 4.5 (high)53.8GPT-5.6 Sol (medium): 53.6;OpenAIGPT-5.6 Sol (medium)53.6Gemini 3.7 Flash (medium): 53.4;GoogleGemini 3.7 Flash (medium)53.4Claude Sonnet 5 (max): 53.4;AnthropicClaude Sonnet 5 (max)53.4
查看图表数据
项目数值
Grok 4.6 (high)60.9
Claude Opus 5 (max)60.7
Claude Opus 5 (xhigh)60.1
Claude Fable 559.9
GPT-5.6 Sol (max)58.9
Claude Opus 5 (high)58.9
Qwen3.8-Max58.1
Qwen3.8 2.4T A95B57.7
GPT-5.6 Sol (xhigh)57.7
Kimi K357.1
Muse Spark 1.2 (xhigh)56.8
Claude Opus 5 (medium)56.3
Gemini 3.7 Flash (high)56
GPT-5.6 Sol (high)55.9
Claude Opus 4.8 (max)55.7
GPT-5.6 Terra (max)55
Grok 4.5 (high)53.8
GPT-5.6 Sol (medium)53.6
Gemini 3.7 Flash (medium)53.4
Claude Sonnet 5 (max)53.4

INTELLIGENCE BREAKDOWN

9 项组成评测

各列保留来源站点的展示口径;GDPval 使用归一化值,AA-Omniscience 使用知识可靠指数,其余为通过率。

Qwen3.8 2.4T A95B 分项成绩同图用于观察强弱轮廓,不应直接把不同评测的数值当作同一量纲。
Qwen3.8 2.4T A95B 分项成绩;公开数据093.5GDPval-AA v2: 61.0%GDPval-AA v261.0%τ³-Banking: 49.1%τ³-Banking49.1%Terminal-Bench v2.1: 82.0%Terminal-Bench v2.182.0%SciCode: 51.6%SciCode51.6%AA-LCR: 75.3%AA-LCR75.3%AA-Omniscience: 4.3AA-Omniscience4.3Humanity's Last Exam: 42.4%Humanity's Last Exam42.4%GPQA Diamond: 93.5%GPQA Diamond93.5%CritPt: 20.0%CritPt20.0%
查看图表数据
项目数值
GDPval-AA v261.0%
τ³-Banking49.1%
Terminal-Bench v2.182.0%
SciCode51.6%
AA-LCR75.3%
AA-Omniscience4.3
Humanity's Last Exam42.4%
GPQA Diamond93.5%
CritPt20.0%

AA-OMNISCIENCE

知识与幻觉

指数同时考虑正确回答和避免幻觉。当前模型准确率 31.3%,幻觉率 39.2%。

AA-Omniscience 指数对比
AA-Omniscience 指数对比;公开数据040.2Claude Fable 5: 40.2;AnthropicClaude Fable 540.2Gemini 3.1 Pro Preview: 32.9;GoogleGemini 3.1 Pro Preview32.9Claude Opus 5 (max): 31.3;AnthropicClaude Opus 5 (max)31.3Grok 4.6 (high): 30.5;SpaceXAIGrok 4.6 (high)30.5Claude Opus 5 (xhigh): 29.8;AnthropicClaude Opus 5 (xhigh)29.8Claude Opus 5 (high): 28.1;AnthropicClaude Opus 5 (high)28.1Claude Opus 4.8 (max): 27.4;AnthropicClaude Opus 4.8 (max)27.4Muse Spark 1.2 (xhigh): 27.2;MetaMuse Spark 1.2 (xhigh)27.2Gemini 3.7 Flash (high): 26.5;GoogleGemini 3.7 Flash (high)26.5Grok 4.5 (high): 26.4;SpaceXAIGrok 4.5 (high)26.4Claude Opus 5 (medium): 25.6;AnthropicClaude Opus 5 (medium)25.6Gemini 3.7 Flash (medium): 23.7;GoogleGemini 3.7 Flash (medium)23.7Gemini 3.6 Flash: 23.5;GoogleGemini 3.6 Flash23.5Claude Opus 5 (low): 23.2;AnthropicClaude Opus 5 (low)23.2Gemini 3.5 Flash: 22.7;GoogleGemini 3.5 Flash22.7Gemini 3.7 Flash (low): 22.1;GoogleGemini 3.7 Flash (low)22.1GPT-5.6 Sol (max): 21.7;OpenAIGPT-5.6 Sol (max)21.7Gemini 3.5 Flash (medium): 21.7;GoogleGemini 3.5 Flash (medium)21.7GPT-5.6 Sol (xhigh): 20.6;OpenAIGPT-5.6 Sol (xhigh)20.6Qwen3.8 2.4T A95B: 4.3;AlibabaQwen3.8 2.4T A95B4.3
查看图表数据
项目数值
Claude Fable 540.2
Gemini 3.1 Pro Preview32.9
Claude Opus 5 (max)31.3
Grok 4.6 (high)30.5
Claude Opus 5 (xhigh)29.8
Claude Opus 5 (high)28.1
Claude Opus 4.8 (max)27.4
Muse Spark 1.2 (xhigh)27.2
Gemini 3.7 Flash (high)26.5
Grok 4.5 (high)26.4
Claude Opus 5 (medium)25.6
Gemini 3.7 Flash (medium)23.7
Gemini 3.6 Flash23.5
Claude Opus 5 (low)23.2
Gemini 3.5 Flash22.7
Gemini 3.7 Flash (low)22.1
GPT-5.6 Sol (max)21.7
Gemini 3.5 Flash (medium)21.7
GPT-5.6 Sol (xhigh)20.6
Qwen3.8 2.4T A95B4.3

INTELLIGENCE VS COST

能力与单任务成本

右上代表能力更高但成本也更高;理想区域通常靠近左上。横轴使用对数刻度,避免高价模型压扁主体分布。

智能指数与单任务成本
智能指数与单任务成本单任务成本(对数刻度)智能指数0 美元2.75 美元60.96Gemini 3.5 Flash: 单任务成本 0.586 美元;智能指数 50.203MiMo-V2.5-Pro: 单任务成本 0.062 美元;智能指数 42.239Mercury 2: 单任务成本 0.075 美元;智能指数 21.432Qwen3.5 122B A10B: 单任务成本 0.179 美元;智能指数 27.595GPT-5.6 Luna (low): 单任务成本 0.056 美元;智能指数 33.264GPT-5.6 Sol (low): 单任务成本 0.242 美元;智能指数 49.444Gemini 3.5 Flash-Lite: 单任务成本 0.086 美元;智能指数 36.478Devstral 2: 单任务成本 0 美元;智能指数 19.157Nova 2.0 Pro Preview (medium): 单任务成本 0.173 美元;智能指数 21.765Qwen3.5 397B A17B: 单任务成本 0.333 美元;智能指数 33.682Claude Opus 5 (xhigh): 单任务成本 1.561 美元;智能指数 60.068North Mini Code: 单任务成本 0 美元;智能指数 19.795Claude Opus 5 (low): 单任务成本 0.361 美元;智能指数 50.614Qwen3.5 122B A10B: 单任务成本 0.241 美元;智能指数 32.279MiMo-V2.5: 单任务成本 0.01 美元;智能指数 37.203Claude Sonnet 5 (max): 单任务成本 1.525 美元;智能指数 53.35GPT-5.6 Terra (medium): 单任务成本 0.175 美元;智能指数 45.574Gemini 2.5 Pro: 单任务成本 0.198 美元;智能指数 25.818MiniMax-M3: 单任务成本 0.125 美元;智能指数 44.437Qwen3.5 9B: 单任务成本 0.221 美元;智能指数 21.438Command A+: 单任务成本 0 美元;智能指数 22.51HyperNova 60B 2605: 单任务成本 0.019 美元;智能指数 17.804gpt-oss-20b (high): 单任务成本 0.021 美元;智能指数 14.885Qwen3.6 27B: 单任务成本 0.36 美元;智能指数 30.461Mistral Small 4: 单任务成本 0.098 美元;智能指数 19.556GPT-5.6 Luna (max): 单任务成本 0.277 美元;智能指数 51.236Mistral Large 3: 单任务成本 0.06 美元;智能指数 15.93GPT-5.6 Luna (medium): 单任务成本 0.065 美元;智能指数 38.051Gemini 3.1 Flash-Lite: 单任务成本 0.042 美元;智能指数 25.038Nemotron 3 Ultra: 单任务成本 0.245 美元;智能指数 37.762DeepSeek V4 Pro (high): 单任务成本 0.04 美元;智能指数 43.112Nova 2.0 Lite (high): 单任务成本 0.245 美元;智能指数 18.168NVIDIA Nemotron 3 Super: 单任务成本 0.206 美元;智能指数 25.406Qwen3.6 35B A3B: 单任务成本 0.598 美元;智能指数 24.163Ministral 3 3B: 单任务成本 0.126 美元;智能指数 6.309Qwen3.7 Max: 单任务成本 1.032 美元;智能指数 45.994Step 3.7 Flash: 单任务成本 0.087 美元;智能指数 30.268Gemma 4 26B A4B: 单任务成本 0.029 美元;智能指数 25.695GPT-5.6 Sol (medium): 单任务成本 0.407 美元;智能指数 53.589Magistral Small 1.2: 单任务成本 0.254 美元;智能指数 11.292Claude Opus 5 (high): 单任务成本 1.057 美元;智能指数 58.864Ministral 3 14B: 单任务成本 0.149 美元;智能指数 11.053NVIDIA Nemotron 3 Nano: 单任务成本 0.018 美元;智能指数 14.177Gemini 3.6 Flash: 单任务成本 0.501 美元;智能指数 50.068Grok 4.5 (high): 单任务成本 0.35 美元;智能指数 53.827GPT-5.6 Sol (Non-reasoning): 单任务成本 0.265 美元;智能指数 41.203GPT-5.6 Terra (high): 单任务成本 0.336 美元;智能指数 48.955Magistral Medium 1.2: 单任务成本 0.747 美元;智能指数 17.874Qwen3.6 35B A3B: 单任务成本 0.179 美元;智能指数 31.65GPT-5.6 Luna (xhigh): 单任务成本 0.18 美元;智能指数 49.068GPT-5.6 Sol (high): 单任务成本 0.624 美元;智能指数 55.867Qwen3.6 27B: 单任务成本 0.265 美元;智能指数 37.052Grok 4.3 (Non-reasoning): 单任务成本 0.365 美元;智能指数 24.752Llama 4 Maverick: 单任务成本 0.029 美元;智能指数 14.266Ministral 3 8B: 单任务成本 0.185 美元;智能指数 8.957Llama 3.3 70B: 单任务成本 0.081 美元;智能指数 9.403Claude Opus 4.8 (max): 单任务成本 1.797 美元;智能指数 55.692GPT-5.6 Terra (Non-reasoning): 单任务成本 0.179 美元;智能指数 33.967GPT-5.6 Terra (xhigh): 单任务成本 0.477 美元;智能指数 51.605Phi-4 Mini: 单任务成本 0 美元;智能指数 6.014Nova 2.0 Pro Preview: 单任务成本 0.246 美元;智能指数 14.356Claude 4.5 Haiku: 单任务成本 0.237 美元;智能指数 29.576Qwen3.7 Plus: 单任务成本 0.221 美元;智能指数 38.977GPT-5.6 Luna (high): 单任务成本 0.122 美元;智能指数 46.059Llama 4 Scout: 单任务成本 0.009 美元;智能指数 10.042Hy3: 单任务成本 0.034 美元;智能指数 41.231Trinity Large Thinking: 单任务成本 0.126 美元;智能指数 18.16Claude Opus 5 (max): 单任务成本 2.028 美元;智能指数 60.692Gemini 3.1 Pro Preview: 单任务成本 0.291 美元;智能指数 46.459GPT-5.6 Terra (max): 单任务成本 0.825 美元;智能指数 54.953DeepSeek V4 Pro (max): 单任务成本 0.045 美元;智能指数 44.274GPT-5.5 Instant (June 2026): 单任务成本 0.539 美元;智能指数 28.86Qwen3 Next 80B A3B: 单任务成本 0.169 美元;智能指数 16.72gpt-oss-120b (low): 单任务成本 0.017 美元;智能指数 14.911GPT-5.6 Terra (low): 单任务成本 0.154 美元;智能指数 40.466Claude Fable 5: 单任务成本 2.75 美元;智能指数 59.861Devstral Small 2: 单任务成本 0 美元;智能指数 17.437Gemma 4 31B: 单任务成本 0.034 美元;智能指数 21.769Claude Sonnet 5 (Non-reasoning): 单任务成本 0.375 美元;智能指数 41.731Muse Spark 1.1 (xhigh): 单任务成本 0.261 美元;智能指数 50.623GPT-5.6 Sol (max): 单任务成本 1.537 美元;智能指数 58.89GPT-5.6 Sol (xhigh): 单任务成本 0.946 美元;智能指数 57.654GPT-5.6 Luna (Non-reasoning): 单任务成本 0.081 美元;智能指数 26.56Mistral Medium 3.5: 单任务成本 0.392 美元;智能指数 29.947Ring-2.6-1T: 单任务成本 0.345 美元;智能指数 30.573Qwen3.5 35B A3B: 单任务成本 0.231 美元;智能指数 23.993gpt-oss-120b (high): 单任务成本 0.061 美元;智能指数 23.831Qwen3.6 Plus: 单任务成本 0.314 美元;智能指数 39.561Nova 2.0 Pro Preview (low): 单任务成本 0.213 美元;智能指数 19.606GLM-5.2 (max): 单任务成本 0.319 美元;智能指数 51.086Kimi K3: 单任务成本 0.723 美元;智能指数 57.112Qwen3 Coder Next: 单任务成本 0.329 美元;智能指数 21.109Claude Opus 5 (medium): 单任务成本 0.618 美元;智能指数 56.281Kimi K3 (low): 单任务成本 0.243 美元;智能指数 46.603Muse Spark 1.2 (xhigh): 单任务成本 0.399 美元;智能指数 56.762Nemotron 3.5 Lightning: 单任务成本 0.062 美元;智能指数 23.633Qwen3.8-Max: 单任务成本 1.132 美元;智能指数 58.077Inkling Small: 单任务成本 0.073 美元;智能指数 40.168Qwen3.8 2.4T A95B: 单任务成本 1.092 美元;智能指数 57.704Qwen3.8 2.4T A95BGemini 3.7 Flash (high): 单任务成本 0.402 美元;智能指数 56.03Grok 4.6 (high): 单任务成本 0.837 美元;智能指数 60.923Gemini 3.7 Flash (low): 单任务成本 0.165 美元;智能指数 50.942Ling 3.0 Flash: 单任务成本 0.038 美元;智能指数 37.821Gemini 3.7 Flash (medium): 单任务成本 0.263 美元;智能指数 53.417DeepSeek V4 Flash 0731: 单任务成本 0.027 美元;智能指数 51.767

Qwen3.8 2.4T A95B:单任务成本 1.092 美元,智能指数 57.704

查看图表数据
项目单任务成本智能指数
Gemini 3.5 Flash0.586 美元50.203
MiMo-V2.5-Pro0.062 美元42.239
Mercury 20.075 美元21.432
Qwen3.5 122B A10B0.179 美元27.595
GPT-5.6 Luna (low)0.056 美元33.264
GPT-5.6 Sol (low)0.242 美元49.444
Gemini 3.5 Flash-Lite0.086 美元36.478
Devstral 20 美元19.157
Nova 2.0 Pro Preview (medium)0.173 美元21.765
Qwen3.5 397B A17B0.333 美元33.682
Claude Opus 5 (xhigh)1.561 美元60.068
North Mini Code0 美元19.795
Claude Opus 5 (low)0.361 美元50.614
Qwen3.5 122B A10B0.241 美元32.279
MiMo-V2.50.01 美元37.203
Claude Sonnet 5 (max)1.525 美元53.35
GPT-5.6 Terra (medium)0.175 美元45.574
Gemini 2.5 Pro0.198 美元25.818
MiniMax-M30.125 美元44.437
Qwen3.5 9B0.221 美元21.438
Command A+0 美元22.51
HyperNova 60B 26050.019 美元17.804
gpt-oss-20b (high)0.021 美元14.885
Qwen3.6 27B0.36 美元30.461
Mistral Small 40.098 美元19.556
GPT-5.6 Luna (max)0.277 美元51.236
Mistral Large 30.06 美元15.93
GPT-5.6 Luna (medium)0.065 美元38.051
Gemini 3.1 Flash-Lite0.042 美元25.038
Nemotron 3 Ultra0.245 美元37.762
DeepSeek V4 Pro (high)0.04 美元43.112
Nova 2.0 Lite (high)0.245 美元18.168
NVIDIA Nemotron 3 Super0.206 美元25.406
Qwen3.6 35B A3B0.598 美元24.163
Ministral 3 3B0.126 美元6.309
Qwen3.7 Max1.032 美元45.994
Step 3.7 Flash0.087 美元30.268
Gemma 4 26B A4B0.029 美元25.695
GPT-5.6 Sol (medium)0.407 美元53.589
Magistral Small 1.20.254 美元11.292
Claude Opus 5 (high)1.057 美元58.864
Ministral 3 14B0.149 美元11.053
NVIDIA Nemotron 3 Nano0.018 美元14.177
Gemini 3.6 Flash0.501 美元50.068
Grok 4.5 (high)0.35 美元53.827
GPT-5.6 Sol (Non-reasoning)0.265 美元41.203
GPT-5.6 Terra (high)0.336 美元48.955
Magistral Medium 1.20.747 美元17.874
Qwen3.6 35B A3B0.179 美元31.65
GPT-5.6 Luna (xhigh)0.18 美元49.068
GPT-5.6 Sol (high)0.624 美元55.867
Qwen3.6 27B0.265 美元37.052
Grok 4.3 (Non-reasoning)0.365 美元24.752
Llama 4 Maverick0.029 美元14.266
Ministral 3 8B0.185 美元8.957
Llama 3.3 70B0.081 美元9.403
Claude Opus 4.8 (max)1.797 美元55.692
GPT-5.6 Terra (Non-reasoning)0.179 美元33.967
GPT-5.6 Terra (xhigh)0.477 美元51.605
Phi-4 Mini0 美元6.014
Nova 2.0 Pro Preview0.246 美元14.356
Claude 4.5 Haiku0.237 美元29.576
Qwen3.7 Plus0.221 美元38.977
GPT-5.6 Luna (high)0.122 美元46.059
Llama 4 Scout0.009 美元10.042
Hy30.034 美元41.231
Trinity Large Thinking0.126 美元18.16
Claude Opus 5 (max)2.028 美元60.692
Gemini 3.1 Pro Preview0.291 美元46.459
GPT-5.6 Terra (max)0.825 美元54.953
DeepSeek V4 Pro (max)0.045 美元44.274
GPT-5.5 Instant (June 2026)0.539 美元28.86
Qwen3 Next 80B A3B0.169 美元16.72
gpt-oss-120b (low)0.017 美元14.911
GPT-5.6 Terra (low)0.154 美元40.466
Claude Fable 52.75 美元59.861
Devstral Small 20 美元17.437
Gemma 4 31B0.034 美元21.769
Claude Sonnet 5 (Non-reasoning)0.375 美元41.731
Muse Spark 1.1 (xhigh)0.261 美元50.623
GPT-5.6 Sol (max)1.537 美元58.89
GPT-5.6 Sol (xhigh)0.946 美元57.654
GPT-5.6 Luna (Non-reasoning)0.081 美元26.56
Mistral Medium 3.50.392 美元29.947
Ring-2.6-1T0.345 美元30.573
Qwen3.5 35B A3B0.231 美元23.993
gpt-oss-120b (high)0.061 美元23.831
Qwen3.6 Plus0.314 美元39.561
Nova 2.0 Pro Preview (low)0.213 美元19.606
GLM-5.2 (max)0.319 美元51.086
Kimi K30.723 美元57.112
Qwen3 Coder Next0.329 美元21.109
Claude Opus 5 (medium)0.618 美元56.281
Kimi K3 (low)0.243 美元46.603
Muse Spark 1.2 (xhigh)0.399 美元56.762
Nemotron 3.5 Lightning0.062 美元23.633
Qwen3.8-Max1.132 美元58.077
Inkling Small0.073 美元40.168
Qwen3.8 2.4T A95B1.092 美元57.704
Gemini 3.7 Flash (high)0.402 美元56.03
Grok 4.6 (high)0.837 美元60.923
Gemini 3.7 Flash (low)0.165 美元50.942
Ling 3.0 Flash0.038 美元37.821
Gemini 3.7 Flash (medium)0.263 美元53.417
DeepSeek V4 Flash 07310.027 美元51.767

TOKEN USE

输出 Token 使用

Token 更多不等于回答更好;它同时影响成本和等待时间。先看同任务下的回答与推理构成。

单次 Intelligence 任务输出 Token
单次 Intelligence 任务输出 Token;公开数据035,986 TokenLlama 4 Scout: 1,249 Token;MetaLlama 4 Scout1,249 TokenLlama 3.3 70B: 1,686 Token;MetaLlama 3.3 70B1,686 TokenGPT-5.6 Sol (Non-reasoning): 2,074 Token;OpenAIGPT-5.6 Sol (Non-reasoning)2,074 TokenLlama 4 Maverick: 2,089 Token;MetaLlama 4 Maverick2,089 TokenGPT-5.6 Luna (Non-reasoning): 2,110 Token;OpenAIGPT-5.6 Luna (Non-reasoning)2,110 TokenGPT-5.6 Terra (Non-reasoning): 2,154 Token;OpenAIGPT-5.6 Terra (Non-reasoning)2,154 TokenGPT-5.6 Terra (low): 2,258 Token;OpenAIGPT-5.6 Terra (low)2,258 TokenGPT-5.6 Luna (low): 2,298 Token;OpenAIGPT-5.6 Luna (low)2,298 Tokengpt-oss-120b (low): 2,475 Token;OpenAIgpt-oss-120b (low)2,475 TokenGPT-5.5 Instant (June 2026): 2,493 Token;OpenAIGPT-5.5 Instant (June 2026)2,493 TokenGPT-5.6 Sol (low): 2,508 Token;OpenAIGPT-5.6 Sol (low)2,508 TokenMistral Large 3: 3,031 Token;MistralMistral Large 33,031 TokenNova 2.0 Pro Preview: 3,631 Token;AmazonNova 2.0 Pro Preview3,631 TokenGPT-5.6 Luna (medium): 3,663 Token;OpenAIGPT-5.6 Luna (medium)3,663 TokenGranite 4.1 30B: 3,709 Token;IBMGranite 4.1 30B3,709 TokenGPT-5.6 Terra (medium): 3,769 Token;OpenAIGPT-5.6 Terra (medium)3,769 TokenKimi K3 (low): 4,190 Token;KimiKimi K3 (low)4,190 TokenGPT-5.6 Sol (medium): 4,203 Token;OpenAIGPT-5.6 Sol (medium)4,203 TokenGemma 4 31B: 4,537 Token;GoogleGemma 4 31B4,537 TokenQwen3.8 2.4T A95B: 35,986 Token;AlibabaQwen3.8 2.4T A95B35,986 Token
查看图表数据
项目数值
Llama 4 Scout1,249 Token
Llama 3.3 70B1,686 Token
GPT-5.6 Sol (Non-reasoning)2,074 Token
Llama 4 Maverick2,089 Token
GPT-5.6 Luna (Non-reasoning)2,110 Token
GPT-5.6 Terra (Non-reasoning)2,154 Token
GPT-5.6 Terra (low)2,258 Token
GPT-5.6 Luna (low)2,298 Token
gpt-oss-120b (low)2,475 Token
GPT-5.5 Instant (June 2026)2,493 Token
GPT-5.6 Sol (low)2,508 Token
Mistral Large 33,031 Token
Nova 2.0 Pro Preview3,631 Token
GPT-5.6 Luna (medium)3,663 Token
Granite 4.1 30B3,709 Token
GPT-5.6 Terra (medium)3,769 Token
Kimi K3 (low)4,190 Token
GPT-5.6 Sol (medium)4,203 Token
Gemma 4 31B4,537 Token
Qwen3.8 2.4T A95B35,986 Token
Qwen3.8 2.4T A95B 的回答 / 推理 Token 构成
回答 Token推理 Token
Qwen3.8 2.4T A95B 的回答 / 推理 Token 构成Qwen3.8 2.4T A95B: 35,986 TokenQwen3.8 2.4T A95B35,986 Token
查看图表数据
项目合计回答 Token推理 Token
Qwen3.8 2.4T A95B35,986 Token11,116 Token24,870 Token

PRICE AND COST

价格与评测成本

API 标价、单任务成本和跑完整套评测的成本是三个不同口径,这里分开呈现。

单次 Intelligence 任务成本
单次 Intelligence 任务成本;公开数据01.09 美元Llama 4 Scout: 0.01 美元;MetaLlama 4 Scout0.01 美元MiMo-V2.5: 0.01 美元;XiaomiMiMo-V2.50.01 美元gpt-oss-120b (low): 0.02 美元;OpenAIgpt-oss-120b (low)0.02 美元NVIDIA Nemotron 3 Nano: 0.02 美元;NVIDIANVIDIA Nemotron 3 Nano0.02 美元HyperNova 60B 2605: 0.02 美元;Multiverse ComputingHyperNova 60B 26050.02 美元gpt-oss-20b (high): 0.02 美元;OpenAIgpt-oss-20b (high)0.02 美元DeepSeek V4 Flash 0731: 0.03 美元;DeepSeekDeepSeek V4 Flash 07310.03 美元Llama 4 Maverick: 0.03 美元;MetaLlama 4 Maverick0.03 美元Gemma 4 26B A4B: 0.03 美元;GoogleGemma 4 26B A4B0.03 美元Hy3: 0.03 美元;TencentHy30.03 美元Gemma 4 31B: 0.03 美元;GoogleGemma 4 31B0.03 美元Ling 3.0 Flash: 0.04 美元;InclusionAILing 3.0 Flash0.04 美元DeepSeek V4 Pro (high): 0.04 美元;DeepSeekDeepSeek V4 Pro (high)0.04 美元Gemini 3.1 Flash-Lite: 0.04 美元;GoogleGemini 3.1 Flash-Lite0.04 美元DeepSeek V4 Pro (max): 0.04 美元;DeepSeekDeepSeek V4 Pro (max)0.04 美元GPT-5.6 Luna (low): 0.06 美元;OpenAIGPT-5.6 Luna (low)0.06 美元Mistral Large 3: 0.06 美元;MistralMistral Large 30.06 美元gpt-oss-120b (high): 0.06 美元;OpenAIgpt-oss-120b (high)0.06 美元Nemotron 3.5 Lightning: 0.06 美元;NVIDIANemotron 3.5 Lightning0.06 美元Qwen3.8 2.4T A95B: 1.09 美元;AlibabaQwen3.8 2.4T A95B1.09 美元
查看图表数据
项目数值
Llama 4 Scout0.01 美元
MiMo-V2.50.01 美元
gpt-oss-120b (low)0.02 美元
NVIDIA Nemotron 3 Nano0.02 美元
HyperNova 60B 26050.02 美元
gpt-oss-20b (high)0.02 美元
DeepSeek V4 Flash 07310.03 美元
Llama 4 Maverick0.03 美元
Gemma 4 26B A4B0.03 美元
Hy30.03 美元
Gemma 4 31B0.03 美元
Ling 3.0 Flash0.04 美元
DeepSeek V4 Pro (high)0.04 美元
Gemini 3.1 Flash-Lite0.04 美元
DeepSeek V4 Pro (max)0.04 美元
GPT-5.6 Luna (low)0.06 美元
Mistral Large 30.06 美元
gpt-oss-120b (high)0.06 美元
Nemotron 3.5 Lightning0.06 美元
Qwen3.8 2.4T A95B1.09 美元
Qwen3.8 2.4T A95B 单任务成本构成
非缓存输入缓存读取缓存写入回答输出推理输出
Qwen3.8 2.4T A95B 单任务成本构成单任务: 1.09 美元单任务1.09 美元
查看图表数据
项目合计非缓存输入缓存读取缓存写入回答输出推理输出
单任务1.09 美元0.01 美元0.34 美元0.52 美元0.07 美元0.15 美元
运行完整 Intelligence Index 的成本构成
非缓存输入缓存读取缓存写入回答输出推理输出
运行完整 Intelligence Index 的成本构成完整 Intelligence Index: 1,671.89 美元完整 Intelligence Index1,671.89 美元
查看图表数据
项目合计非缓存输入缓存读取缓存写入回答输出推理输出
完整 Intelligence Index1,671.89 美元28.01 美元328.52 美元501.17 美元76.13 美元738.05 美元
API 价格:每 1M Token
API 价格:每 1M Token;公开数据06 美元缓存命中: 0.25 美元缓存命中0.25 美元输入: 2 美元输入2 美元输出: 6 美元输出6 美元
查看图表数据
项目数值
缓存命中0.25 美元
输入2 美元
输出6 美元

CONTEXT WINDOW

上下文窗口

上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

上下文窗口对比
上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.1 (xhigh): 1,048,576 Token;MetaMuse Spark 1.1 (xhigh)1,048,576 TokenKimi K3: 1,048,576 Token;KimiKimi K31,048,576 TokenKimi K3 (low): 1,048,576 Token;KimiKimi K3 (low)1,048,576 TokenMuse Spark 1.2 (xhigh): 1,048,576 Token;MetaMuse Spark 1.2 (xhigh)1,048,576 TokenSolar Open2 250B: 1,048,576 Token;UpstageSolar Open2 250B1,048,576 TokenGemini 3.5 Flash: 1,000,000 Token;GoogleGemini 3.5 Flash1,000,000 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenGemini 3.5 Flash-Lite: 1,000,000 Token;GoogleGemini 3.5 Flash-Lite1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Opus 5 (xhigh): 1,000,000 Token;AnthropicClaude Opus 5 (xhigh)1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenClaude Opus 5 (low): 1,000,000 Token;AnthropicClaude Opus 5 (low)1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenQwen3.8 2.4T A95B: 983,616 Token;AlibabaQwen3.8 2.4T A95B983,616 Token
查看图表数据
项目数值
Llama 4 Scout10,000,000 Token
Muse Spark 1.1 (xhigh)1,048,576 Token
Kimi K31,048,576 Token
Kimi K3 (low)1,048,576 Token
Muse Spark 1.2 (xhigh)1,048,576 Token
Solar Open2 250B1,048,576 Token
Gemini 3.5 Flash1,000,000 Token
MiMo-V2.5-Pro1,000,000 Token
Nova 2.0 Omni (medium)1,000,000 Token
Gemini 3.5 Flash (minimal)1,000,000 Token
GPT-5.6 Luna (low)1,000,000 Token
GPT-5.6 Sol (low)1,000,000 Token
Gemini 3.5 Flash-Lite1,000,000 Token
Inkling1,000,000 Token
Claude Opus 5 (xhigh)1,000,000 Token
Claude Sonnet 5 (low)1,000,000 Token
Nova 2.0 Omni1,000,000 Token
Claude Opus 5 (low)1,000,000 Token
MiMo-V2.51,000,000 Token
Qwen3.8 2.4T A95B983,616 Token

OUTPUT SPEED

回答生成速度

模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。

输出速度对比
输出速度对比;公开数据02,038.2 Token/sCeleris-1: 2,038.2 Token/s;CelerisCeleris-12,038.2 Token/sMercury 2: 986.7 Token/s;InceptionMercury 2986.7 Token/sNemotron 3.5 Lightning: 480.7 Token/s;NVIDIANemotron 3.5 Lightning480.7 Token/sGemini 3.5 Flash-Lite: 428.3 Token/s;GoogleGemini 3.5 Flash-Lite428.3 Token/sStep 3.7 Flash: 405.2 Token/s;StepFunStep 3.7 Flash405.2 Token/sLFM2.5-VL-1.6B: 400 Token/s;Liquid AILFM2.5-VL-1.6B400 Token/sGranite 4.0 H Small: 385.7 Token/s;IBMGranite 4.0 H Small385.7 Token/sHyperNova 60B 2605: 363.8 Token/s;Multiverse ComputingHyperNova 60B 2605363.8 Token/sGemini 3.7 Flash (high): 340.1 Token/s;GoogleGemini 3.7 Flash (high)340.1 Token/sLFM2.5-8B-A1B: 335.4 Token/s;Liquid AILFM2.5-8B-A1B335.4 Token/sLing 3.0 Flash: 333.1 Token/s;InclusionAILing 3.0 Flash333.1 Token/sGemini 3.1 Flash-Lite: 329 Token/s;GoogleGemini 3.1 Flash-Lite329 Token/sNemotron 3 Nano Omni 30B A3B Reasoning: 318.5 Token/s;NVIDIANemotron 3 Nano Omni 30B A3B …318.5 Token/sgpt-oss-120b (low): 295.4 Token/s;OpenAIgpt-oss-120b (low)295.4 Token/sNova Micro: 284.7 Token/s;AmazonNova Micro284.7 Token/sgpt-oss-120b (high): 283.7 Token/s;OpenAIgpt-oss-120b (high)283.7 Token/sStep 3.5 Flash 2603: 274.6 Token/s;StepFunStep 3.5 Flash 2603274.6 Token/sGemini 3.7 Flash (medium): 273.6 Token/s;GoogleGemini 3.7 Flash (medium)273.6 Token/sGemini 3.7 Flash (low): 253.5 Token/s;GoogleGemini 3.7 Flash (low)253.5 Token/sQwen3.8 2.4T A95B: 50.1 Token/s;AlibabaQwen3.8 2.4T A95B50.1 Token/s
查看图表数据
项目数值
Celeris-12,038.2 Token/s
Mercury 2986.7 Token/s
Nemotron 3.5 Lightning480.7 Token/s
Gemini 3.5 Flash-Lite428.3 Token/s
Step 3.7 Flash405.2 Token/s
LFM2.5-VL-1.6B400 Token/s
Granite 4.0 H Small385.7 Token/s
HyperNova 60B 2605363.8 Token/s
Gemini 3.7 Flash (high)340.1 Token/s
LFM2.5-8B-A1B335.4 Token/s
Ling 3.0 Flash333.1 Token/s
Gemini 3.1 Flash-Lite329 Token/s
Nemotron 3 Nano Omni 30B A3B Reasoning318.5 Token/s
gpt-oss-120b (low)295.4 Token/s
Nova Micro284.7 Token/s
gpt-oss-120b (high)283.7 Token/s
Step 3.5 Flash 2603274.6 Token/s
Gemini 3.7 Flash (medium)273.6 Token/s
Gemini 3.7 Flash (low)253.5 Token/s
Qwen3.8 2.4T A95B50.1 Token/s
单次 Intelligence 任务耗时
单次 Intelligence 任务耗时;公开数据0577.3 秒Celeris-1: 6.8 秒;CelerisCeleris-16.8 秒gpt-oss-120b (low): 8.3 秒;OpenAIgpt-oss-120b (low)8.3 秒GPT-5.6 Luna (Non-reasoning): 11.8 秒;OpenAIGPT-5.6 Luna (Non-reasoning)11.8 秒GPT-5.6 Luna (low): 13.4 秒;OpenAIGPT-5.6 Luna (low)13.4 秒Llama 4 Scout: 14.2 秒;MetaLlama 4 Scout14.2 秒GPT-5.6 Terra (Non-reasoning): 16.2 秒;OpenAIGPT-5.6 Terra (Non-reasoning)16.2 秒GPT-5.6 Terra (low): 17 秒;OpenAIGPT-5.6 Terra (low)17 秒GPT-5.6 Luna (medium): 18.5 秒;OpenAIGPT-5.6 Luna (medium)18.5 秒Llama 3.3 70B: 19.7 秒;MetaLlama 3.3 70B19.7 秒Llama 4 Maverick: 20.1 秒;MetaLlama 4 Maverick20.1 秒GPT-5.6 Sol (Non-reasoning): 27.4 秒;OpenAIGPT-5.6 Sol (Non-reasoning)27.4 秒GPT-5.6 Terra (medium): 29.3 秒;OpenAIGPT-5.6 Terra (medium)29.3 秒Gemini 3.5 Flash-Lite: 29.4 秒;GoogleGemini 3.5 Flash-Lite29.4 秒Mercury 2: 29.5 秒;InceptionMercury 229.5 秒GPT-5.6 Sol (low): 31.7 秒;OpenAIGPT-5.6 Sol (low)31.7 秒Nova 2.0 Pro Preview: 35 秒;AmazonNova 2.0 Pro Preview35 秒Nova 2.0 Pro Preview (low): 41.1 秒;AmazonNova 2.0 Pro Preview (low)41.1 秒GPT-5.6 Luna (high): 43.3 秒;OpenAIGPT-5.6 Luna (high)43.3 秒Gemini 3.7 Flash (low): 53.4 秒;GoogleGemini 3.7 Flash (low)53.4 秒Qwen3.8 2.4T A95B: 577.3 秒;AlibabaQwen3.8 2.4T A95B577.3 秒
查看图表数据
项目数值
Celeris-16.8 秒
gpt-oss-120b (low)8.3 秒
GPT-5.6 Luna (Non-reasoning)11.8 秒
GPT-5.6 Luna (low)13.4 秒
Llama 4 Scout14.2 秒
GPT-5.6 Terra (Non-reasoning)16.2 秒
GPT-5.6 Terra (low)17 秒
GPT-5.6 Luna (medium)18.5 秒
Llama 3.3 70B19.7 秒
Llama 4 Maverick20.1 秒
GPT-5.6 Sol (Non-reasoning)27.4 秒
GPT-5.6 Terra (medium)29.3 秒
Gemini 3.5 Flash-Lite29.4 秒
Mercury 229.5 秒
GPT-5.6 Sol (low)31.7 秒
Nova 2.0 Pro Preview35 秒
Nova 2.0 Pro Preview (low)41.1 秒
GPT-5.6 Luna (high)43.3 秒
Gemini 3.7 Flash (low)53.4 秒
Qwen3.8 2.4T A95B577.3 秒

LATENCY

首个回答 Token 等待

推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。

首个回答 Token:输入处理与推理等待
输入处理推理等待
首个回答 Token:输入处理与推理等待Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒Celeris-1: 0.7 秒Celeris-10.7 秒Mistral Small 4: 0.7 秒Mistral Small 40.7 秒Qwen3.5 4B: 0.7 秒Qwen3.5 4B0.7 秒Ministral 3 8B: 0.7 秒Ministral 3 8B0.7 秒Gemini 3.7 Flash (low): 0.7 秒Gemini 3.7 Flash (low)0.7 秒Gemma 4 E4B: 0.8 秒Gemma 4 E4B0.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒GPT-5.6 Terra (Non-reasoning): 0.8 秒GPT-5.6 Terra (Non-reasoning)0.8 秒Qwen3.8 2.4T A95B: 42.7 秒Qwen3.8 2.4T A95B42.7 秒
查看图表数据
项目合计输入处理推理等待
Ministral 3 3B0.6 秒0.6 秒0 秒
Celeris-10.7 秒0.7 秒0 秒
Mistral Small 40.7 秒0.7 秒0 秒
Qwen3.5 4B0.7 秒0.7 秒0 秒
Ministral 3 8B0.7 秒0.7 秒0 秒
Gemini 3.7 Flash (low)0.7 秒0.7 秒0 秒
Gemma 4 E4B0.8 秒0.8 秒0 秒
Llama 4 Scout0.8 秒0.8 秒0 秒
GPT-5.6 Terra (Non-reasoning)0.8 秒0.8 秒0 秒
Qwen3.8 2.4T A95B42.7 秒2.7 秒39.9 秒

END-TO-END RESPONSE TIME

端到端响应时间

按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。

输出 500 Token 的完整响应时间
输入处理推理生成 500 Token
输出 500 Token 的完整响应时间Celeris-1: 0.9 秒Celeris-10.9 秒Ministral 3 3B: 2.6 秒Ministral 3 3B2.6 秒Nova Micro: 2.7 秒Nova Micro2.7 秒Gemini 3.7 Flash (low): 2.7 秒Gemini 3.7 Flash (low)2.7 秒GPT-5.6 Luna (Non-reasoning): 3.6 秒GPT-5.6 Luna (Non-reasoning)3.6 秒Mistral Small 4: 3.8 秒Mistral Small 43.8 秒Qwen3.5 Omni Flash: 3.9 秒Qwen3.5 Omni Flash3.9 秒Gemini 3.5 Flash (minimal): 3.9 秒Gemini 3.5 Flash (minimal)3.9 秒GPT-5.6 Luna (low): 4.4 秒GPT-5.6 Luna (low)4.4 秒Qwen3.8 2.4T A95B: 52.6 秒Qwen3.8 2.4T A95B52.6 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Celeris-10.9 秒0.7 秒0 秒0.2 秒
Ministral 3 3B2.6 秒0.6 秒0 秒2 秒
Nova Micro2.7 秒0.9 秒0 秒1.8 秒
Gemini 3.7 Flash (low)2.7 秒0.7 秒0 秒2 秒
GPT-5.6 Luna (Non-reasoning)3.6 秒0.8 秒0 秒2.8 秒
Mistral Small 43.8 秒0.7 秒0 秒3.1 秒
Qwen3.5 Omni Flash3.9 秒1.9 秒0 秒2 秒
Gemini 3.5 Flash (minimal)3.9 秒0.9 秒0 秒3 秒
GPT-5.6 Luna (low)4.4 秒1.5 秒0 秒2.9 秒
Qwen3.8 2.4T A95B52.6 秒2.7 秒39.9 秒10 秒

FAQ

Qwen3.8 2.4T A95B 常见问题

问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。

Qwen3.8 2.4T A95B 什么时候发布?

Artificial Analysis 当前记录的发布日期为 2026-08-12;本站按来源快照展示,不把发布前预测当作事实。

Qwen3.8 2.4T A95B API 价格是多少?

OpenRouter 当前公开 API 中精确型号 qwen/qwen3.8-2.4t-a95b 的每 1M Token 输入价格为 US$2,输出价格为 US$6。

Qwen3.8 2.4T A95B 的评测表现怎么样?

当前公开 Intelligence Index 为 57.7,在 275 个当前模型条目中排名第 8。该指数由多项公开评测组成,不等于所有任务中的统一胜率。

Qwen3.8 2.4T A95B 的上下文窗口有多大?

上下文窗口为 983,616 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。

Qwen3.8 2.4T A95B 的生成速度是多少?

公开性能数据为 50.1 Token/s,来源为 Alibaba。

Qwen3.8 2.4T A95B 是开源模型吗?

更准确地说,这是开放权重模型,不等同于采用开源软件许可。来源记录的许可为 Qwen3.8-Max License,当前标记为不允许商业使用。

怎样通过 API 使用 Qwen3.8 2.4T A95B?

当前已核验 OpenRouter · qwen/qwen3.8-2.4t-a95b。 Provider 横向明细尚未同步。