MODEL ANALYSIS

Agnes 2.5 Pro Beta

Agnes 2.5 Pro Beta(Sapiens AI)公开数据详情:智能指数 49.1、生成速度 159.3 Token/s、上下文 1,000,000 Token。来源 Artificial Analysis,快照 2026-08-28;本站不重新评测或修改分数。

数据快照:2026-08-28查看原始来源 ↗
智能指数49.1第 39 / 271
生成速度159.3Token/s · 第 37 / 182
API 价格当前 API 未核实 · Artificial Analysis model aggregate 历史输入 $0.1 / 输出 $0.3(2026-08-28)
单任务成本来源未提供可比较价格
单任务输出50,097Token · 精简度第 121 / 126

模型概览

Agnes 2.5 Pro Beta 的 Intelligence Index 为 49.1,生成速度为 159.3 Token/s,完整评测成本为 暂无数据。这些指标分别反映能力、吞吐和评测经济性,不能合并成单一“最好”结论。

技术规格

机构
Sapiens AI
发布日期
2026-08-26
推理类型
推理模型
模型权重
未开放权重
上下文窗口
1,000,000 Token
输入模态
文本、图像
输出模态
文本
性能来源
Sapiens AI

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据,并始终保留当前模型。

24 / 624 个模型 · 正在载入全量数据
智能指数模型比较;当前显示 24 个模型。Claude Opus 5 (max)63.1Claude Opus 5 (xhigh)62.5Claude Fable 562.1Claude Opus 5 (high)61.5GPT-5.6 Sol (max)60.9Grok 4.6 (high)60.9Grok 4.6 (xhigh)60Kimi K3 (max)59.7GLM-5.359.5GPT-5.6 Sol (xhigh)59Grok 4.6 (medium)59Claude Opus 5 (medium)58.6Qwen3.8-Max58.1Qwen3.8 2.4T A95B57.7GLM-5.3-Flash57.5GPT-5.6 Sol (high)57.3Muse Spark 1.2 (xhigh)56.8GPT-5.6 Terra (max)56.6Gemini 3.7 Flash (high)56Qwen3.8-Flash-Next55.8Grok 4.5 (high)55.8GPT-5.6 Sol (medium)55.6Claude Sonnet 5 (max)55.3Agnes 2.5 Pro Beta49.1

INTELLIGENCE

Artificial Analysis 智能指数

v4.1 由 9 项独立评测组成;数值越高越好。蓝色代表当前模型。

当前模型智能指数对比
当前模型智能指数对比;公开数据063.1Claude Opus 5 (max): 63.1;AnthropicClaude Opus 5 (max)63.1Claude Opus 5 (xhigh): 62.5;AnthropicClaude Opus 5 (xhigh)62.5Claude Fable 5: 62.1;AnthropicClaude Fable 562.1Claude Opus 5 (high): 61.5;AnthropicClaude Opus 5 (high)61.5GPT-5.6 Sol (max): 60.9;OpenAIGPT-5.6 Sol (max)60.9Grok 4.6 (high): 60.9;SpaceXAIGrok 4.6 (high)60.9Grok 4.6 (xhigh): 60;SpaceXAIGrok 4.6 (xhigh)60Kimi K3 (max): 59.7;KimiKimi K3 (max)59.7GLM-5.3: 59.5;Z AIGLM-5.359.5GPT-5.6 Sol (xhigh): 59;OpenAIGPT-5.6 Sol (xhigh)59Grok 4.6 (medium): 59;SpaceXAIGrok 4.6 (medium)59Claude Opus 5 (medium): 58.6;AnthropicClaude Opus 5 (medium)58.6Qwen3.8-Max: 58.1;AlibabaQwen3.8-Max58.1Qwen3.8 2.4T A95B: 57.7;AlibabaQwen3.8 2.4T A95B57.7GLM-5.3-Flash: 57.5;Z AIGLM-5.3-Flash57.5GPT-5.6 Sol (high): 57.3;OpenAIGPT-5.6 Sol (high)57.3Muse Spark 1.2 (xhigh): 56.8;MetaMuse Spark 1.2 (xhigh)56.8GPT-5.6 Terra (max): 56.6;OpenAIGPT-5.6 Terra (max)56.6Gemini 3.7 Flash (high): 56;GoogleGemini 3.7 Flash (high)56Agnes 2.5 Pro Beta: 49.1;Sapiens AIAgnes 2.5 Pro Beta49.1
查看图表数据
项目数值
Claude Opus 5 (max)63.1
Claude Opus 5 (xhigh)62.5
Claude Fable 562.1
Claude Opus 5 (high)61.5
GPT-5.6 Sol (max)60.9
Grok 4.6 (high)60.9
Grok 4.6 (xhigh)60
Kimi K3 (max)59.7
GLM-5.359.5
GPT-5.6 Sol (xhigh)59
Grok 4.6 (medium)59
Claude Opus 5 (medium)58.6
Qwen3.8-Max58.1
Qwen3.8 2.4T A95B57.7
GLM-5.3-Flash57.5
GPT-5.6 Sol (high)57.3
Muse Spark 1.2 (xhigh)56.8
GPT-5.6 Terra (max)56.6
Gemini 3.7 Flash (high)56
Agnes 2.5 Pro Beta49.1

INTELLIGENCE BREAKDOWN

9 项组成评测

各列保留来源站点的展示口径;GDPval 使用归一化值,AA-Omniscience 使用知识可靠指数,其余为通过率。

Agnes 2.5 Pro Beta 分项成绩同图用于观察强弱轮廓,不应直接把不同评测的数值当作同一量纲。
Agnes 2.5 Pro Beta 分项成绩;公开数据090.5GDPval-AA v2: 47.7%GDPval-AA v247.7%τ³-Banking: 35.7%τ³-Banking35.7%Terminal-Bench v2.1: 69.7%Terminal-Bench v2.169.7%SciCode: 47.6%SciCode47.6%AA-LCR: 78.0%AA-LCR78.0%AA-Omniscience: -10.5AA-Omniscience-10.5Humanity's Last Exam: 37.5%Humanity's Last Exam37.5%GPQA Diamond: 90.5%GPQA Diamond90.5%CritPt: 15.7%CritPt15.7%
查看图表数据
项目数值
GDPval-AA v247.7%
τ³-Banking35.7%
Terminal-Bench v2.169.7%
SciCode47.6%
AA-LCR78.0%
AA-Omniscience-10.5
Humanity's Last Exam37.5%
GPQA Diamond90.5%
CritPt15.7%

AA-OMNISCIENCE

知识与幻觉

指数同时考虑正确回答和避免幻觉。当前模型准确率 16.8%,幻觉率 32.8%。

AA-Omniscience 指数对比
AA-Omniscience 指数对比;公开数据043.3Claude Fable 5: 43.3;AnthropicClaude Fable 543.3Claude Opus 5 (max): 37.1;AnthropicClaude Opus 5 (max)37.1Claude Opus 5 (xhigh): 35.4;AnthropicClaude Opus 5 (xhigh)35.4Claude Opus 5 (high): 33.7;AnthropicClaude Opus 5 (high)33.7Gemini 3.1 Pro Preview: 31.9;GoogleGemini 3.1 Pro Preview31.9Claude Opus 5 (medium): 31;AnthropicClaude Opus 5 (medium)31Grok 4.6 (high): 30.5;SpaceXAIGrok 4.6 (high)30.5Grok 4.6 (xhigh): 29.3;SpaceXAIGrok 4.6 (xhigh)29.3Claude Opus 5 (low): 28.6;AnthropicClaude Opus 5 (low)28.6Grok 4.6 (medium): 28;SpaceXAIGrok 4.6 (medium)28Muse Spark 1.2 (xhigh): 27.2;MetaMuse Spark 1.2 (xhigh)27.2Gemini 3.7 Flash (high): 26.5;GoogleGemini 3.7 Flash (high)26.5Grok 4.6 (low): 25.9;SpaceXAIGrok 4.6 (low)25.9Grok 4.5 (high): 25.3;SpaceXAIGrok 4.5 (high)25.3Gemini 3.7 Flash (medium): 23.7;GoogleGemini 3.7 Flash (medium)23.7Gemini 3.6 Flash: 22.1;GoogleGemini 3.6 Flash22.1Gemini 3.7 Flash (low): 22.1;GoogleGemini 3.7 Flash (low)22.1GPT-5.6 Sol (max): 22;OpenAIGPT-5.6 Sol (max)22GPT-5.6 Sol (xhigh): 21;OpenAIGPT-5.6 Sol (xhigh)21Agnes 2.5 Pro Beta: -10.5;Sapiens AIAgnes 2.5 Pro Beta-10.5
查看图表数据
项目数值
Claude Fable 543.3
Claude Opus 5 (max)37.1
Claude Opus 5 (xhigh)35.4
Claude Opus 5 (high)33.7
Gemini 3.1 Pro Preview31.9
Claude Opus 5 (medium)31
Grok 4.6 (high)30.5
Grok 4.6 (xhigh)29.3
Claude Opus 5 (low)28.6
Grok 4.6 (medium)28
Muse Spark 1.2 (xhigh)27.2
Gemini 3.7 Flash (high)26.5
Grok 4.6 (low)25.9
Grok 4.5 (high)25.3
Gemini 3.7 Flash (medium)23.7
Gemini 3.6 Flash22.1
Gemini 3.7 Flash (low)22.1
GPT-5.6 Sol (max)22
GPT-5.6 Sol (xhigh)21
Agnes 2.5 Pro Beta-10.5

TOKEN USE

输出 Token 使用

Token 更多不等于回答更好;它同时影响成本和等待时间。先看同任务下的回答与推理构成。

单次 Intelligence 任务输出 Token
单次 Intelligence 任务输出 Token;公开数据050,097 TokenLlama 4 Scout: 1,312 Token;MetaLlama 4 Scout1,312 TokenGPT-5.6 Luna (Non-reasoning): 2,238 Token;OpenAIGPT-5.6 Luna (Non-reasoning)2,238 TokenGPT-5.6 Sol (Non-reasoning): 2,304 Token;OpenAIGPT-5.6 Sol (Non-reasoning)2,304 TokenLlama 4 Maverick: 2,332 Token;MetaLlama 4 Maverick2,332 TokenGPT-5.6 Terra (Non-reasoning): 2,354 Token;OpenAIGPT-5.6 Terra (Non-reasoning)2,354 TokenGPT-5.6 Luna (low): 2,478 Token;OpenAIGPT-5.6 Luna (low)2,478 TokenGPT-5.6 Terra (low): 2,504 Token;OpenAIGPT-5.6 Terra (low)2,504 TokenGPT-5.5 Instant (June 2026): 2,516 Token;OpenAIGPT-5.5 Instant (June 2026)2,516 Tokengpt-oss-120b (low): 2,762 Token;OpenAIgpt-oss-120b (low)2,762 TokenGPT-5.6 Sol (low): 2,834 Token;OpenAIGPT-5.6 Sol (low)2,834 TokenMistral Large 3: 3,366 Token;MistralMistral Large 33,366 TokenGPT-5.6 Luna (medium): 3,940 Token;OpenAIGPT-5.6 Luna (medium)3,940 TokenGPT-5.6 Terra (medium): 4,143 Token;OpenAIGPT-5.6 Terra (medium)4,143 TokenKimi K3 (low): 4,197 Token;KimiKimi K3 (low)4,197 TokenGemma 4 31B: 4,680 Token;GoogleGemma 4 31B4,680 TokenGPT-5.6 Sol (medium): 4,758 Token;OpenAIGPT-5.6 Sol (medium)4,758 TokenGrok 4.6 (low): 5,566 Token;SpaceXAIGrok 4.6 (low)5,566 TokenDevstral 2: 6,222 Token;MistralDevstral 26,222 TokenDevstral Small 2: 6,536 Token;MistralDevstral Small 26,536 TokenAgnes 2.5 Pro Beta: 50,097 Token;Sapiens AIAgnes 2.5 Pro Beta50,097 Token
查看图表数据
项目数值
Llama 4 Scout1,312 Token
GPT-5.6 Luna (Non-reasoning)2,238 Token
GPT-5.6 Sol (Non-reasoning)2,304 Token
Llama 4 Maverick2,332 Token
GPT-5.6 Terra (Non-reasoning)2,354 Token
GPT-5.6 Luna (low)2,478 Token
GPT-5.6 Terra (low)2,504 Token
GPT-5.5 Instant (June 2026)2,516 Token
gpt-oss-120b (low)2,762 Token
GPT-5.6 Sol (low)2,834 Token
Mistral Large 33,366 Token
GPT-5.6 Luna (medium)3,940 Token
GPT-5.6 Terra (medium)4,143 Token
Kimi K3 (low)4,197 Token
Gemma 4 31B4,680 Token
GPT-5.6 Sol (medium)4,758 Token
Grok 4.6 (low)5,566 Token
Devstral 26,222 Token
Devstral Small 26,536 Token
Agnes 2.5 Pro Beta50,097 Token
Agnes 2.5 Pro Beta 的回答 / 推理 Token 构成
回答 Token推理 Token
Agnes 2.5 Pro Beta 的回答 / 推理 Token 构成Agnes 2.5 Pro Beta: 50,097 TokenAgnes 2.5 Pro Beta50,097 Token
查看图表数据
项目合计回答 Token推理 Token
Agnes 2.5 Pro Beta50,097 Token9,150 Token40,947 Token

CONTEXT WINDOW

上下文窗口

上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

上下文窗口对比
上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.2 (xhigh): 1,048,576 Token;MetaMuse Spark 1.2 (xhigh)1,048,576 TokenKimi K3 (low): 1,048,576 Token;KimiKimi K3 (low)1,048,576 TokenSolar Open2 250B: 1,048,576 Token;UpstageSolar Open2 250B1,048,576 TokenKimi K3 (max): 1,048,576 Token;KimiKimi K3 (max)1,048,576 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenGemini 3.5 Flash-Lite: 1,000,000 Token;GoogleGemini 3.5 Flash-Lite1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Opus 5 (xhigh): 1,000,000 Token;AnthropicClaude Opus 5 (xhigh)1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenGLM-5.3-Flash: 1,000,000 Token;Z AIGLM-5.3-Flash1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenClaude Opus 5 (low): 1,000,000 Token;AnthropicClaude Opus 5 (low)1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNemotron 3 Nano: 1,000,000 Token;NVIDIANemotron 3 Nano1,000,000 TokenAgnes 2.5 Pro Beta: 1,000,000 Token;Sapiens AIAgnes 2.5 Pro Beta1,000,000 Token
查看图表数据
项目数值
Llama 4 Scout10,000,000 Token
Muse Spark 1.2 (xhigh)1,048,576 Token
Kimi K3 (low)1,048,576 Token
Solar Open2 250B1,048,576 Token
Kimi K3 (max)1,048,576 Token
MiMo-V2.5-Pro1,000,000 Token
Nova 2.0 Omni (medium)1,000,000 Token
Gemini 3.5 Flash (minimal)1,000,000 Token
GPT-5.6 Luna (low)1,000,000 Token
GPT-5.6 Sol (low)1,000,000 Token
Gemini 3.5 Flash-Lite1,000,000 Token
Inkling1,000,000 Token
Claude Opus 5 (xhigh)1,000,000 Token
Claude Sonnet 5 (low)1,000,000 Token
GLM-5.3-Flash1,000,000 Token
Nova 2.0 Omni1,000,000 Token
Claude Opus 5 (low)1,000,000 Token
MiMo-V2.51,000,000 Token
Nemotron 3 Nano1,000,000 Token
Agnes 2.5 Pro Beta1,000,000 Token

OUTPUT SPEED

回答生成速度

模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。

输出速度对比
输出速度对比;公开数据01,574.3 Token/sCeleris-1: 1,574.3 Token/s;CelerisCeleris-11,574.3 Token/sMercury 2: 1,004.5 Token/s;InceptionMercury 21,004.5 Token/sLing 3.0 Flash: 385.3 Token/s;InclusionAILing 3.0 Flash385.3 Token/sHyperNova 60B 2605: 365.7 Token/s;Multiverse ComputingHyperNova 60B 2605365.7 Token/sLFM2.5-VL-1.6B: 359 Token/s;Liquid AILFM2.5-VL-1.6B359 Token/sGemini 3.5 Flash-Lite: 352.7 Token/s;GoogleGemini 3.5 Flash-Lite352.7 Token/sLFM2.5-8B-A1B: 338.6 Token/s;Liquid AILFM2.5-8B-A1B338.6 Token/sNemotron 3 Nano Omni 30B A3B: 327.6 Token/s;NVIDIANemotron 3 Nano Omni 30B A3B327.6 Token/sGemini 3.7 Flash (high): 321.9 Token/s;GoogleGemini 3.7 Flash (high)321.9 Token/sGemini 3.7 Flash (low): 319.6 Token/s;GoogleGemini 3.7 Flash (low)319.6 Token/sGemini 3.7 Flash (medium): 318.2 Token/s;GoogleGemini 3.7 Flash (medium)318.2 Token/sNova Micro: 306.7 Token/s;AmazonNova Micro306.7 Token/sNemotron 3.5 Lightning: 293.2 Token/s;NVIDIANemotron 3.5 Lightning293.2 Token/sCommand A+: 268.8 Token/s;CohereCommand A+268.8 Token/sQwen3.5 Omni Flash: 249.9 Token/s;AlibabaQwen3.5 Omni Flash249.9 Token/sDeepSeek V4 Flash: 232.3 Token/s;DeepSeekDeepSeek V4 Flash232.3 Token/sNemotron 3 Nano: 221.7 Token/s;NVIDIANemotron 3 Nano221.7 Token/sGranite 4.2 3B: 219.8 Token/s;IBMGranite 4.2 3B219.8 Token/sNemotron 3 Nano: 218.7 Token/s;NVIDIANemotron 3 Nano218.7 Token/sAgnes 2.5 Pro Beta: 159.3 Token/s;Sapiens AIAgnes 2.5 Pro Beta159.3 Token/s
查看图表数据
项目数值
Celeris-11,574.3 Token/s
Mercury 21,004.5 Token/s
Ling 3.0 Flash385.3 Token/s
HyperNova 60B 2605365.7 Token/s
LFM2.5-VL-1.6B359 Token/s
Gemini 3.5 Flash-Lite352.7 Token/s
LFM2.5-8B-A1B338.6 Token/s
Nemotron 3 Nano Omni 30B A3B327.6 Token/s
Gemini 3.7 Flash (high)321.9 Token/s
Gemini 3.7 Flash (low)319.6 Token/s
Gemini 3.7 Flash (medium)318.2 Token/s
Nova Micro306.7 Token/s
Nemotron 3.5 Lightning293.2 Token/s
Command A+268.8 Token/s
Qwen3.5 Omni Flash249.9 Token/s
DeepSeek V4 Flash232.3 Token/s
Nemotron 3 Nano221.7 Token/s
Granite 4.2 3B219.8 Token/s
Nemotron 3 Nano218.7 Token/s
Agnes 2.5 Pro Beta159.3 Token/s
单次 Intelligence 任务耗时
单次 Intelligence 任务耗时;公开数据0312.5 秒Celeris-1: 9 秒;CelerisCeleris-19 秒Llama 4 Scout: 10 秒;MetaLlama 4 Scout10 秒GPT-5.5 Instant (June 2026): 17.4 秒;OpenAIGPT-5.5 Instant (June 2026)17.4 秒gpt-oss-120b (low): 19 秒;OpenAIgpt-oss-120b (low)19 秒GPT-5.6 Luna (Non-reasoning): 20.8 秒;OpenAIGPT-5.6 Luna (Non-reasoning)20.8 秒GPT-5.6 Luna (low): 22.4 秒;OpenAIGPT-5.6 Luna (low)22.4 秒Llama 4 Maverick: 23 秒;MetaLlama 4 Maverick23 秒GPT-5.6 Terra (low): 24 秒;OpenAIGPT-5.6 Terra (low)24 秒GPT-5.6 Terra (Non-reasoning): 24.3 秒;OpenAIGPT-5.6 Terra (Non-reasoning)24.3 秒Mercury 2: 28.1 秒;InceptionMercury 228.1 秒GPT-5.6 Sol (Non-reasoning): 33.7 秒;OpenAIGPT-5.6 Sol (Non-reasoning)33.7 秒GPT-5.6 Luna (medium): 35.1 秒;OpenAIGPT-5.6 Luna (medium)35.1 秒GPT-5.6 Sol (low): 37.9 秒;OpenAIGPT-5.6 Sol (low)37.9 秒Gemini 3.5 Flash-Lite: 38.4 秒;GoogleGemini 3.5 Flash-Lite38.4 秒Gemini 3.7 Flash (low): 42.5 秒;GoogleGemini 3.7 Flash (low)42.5 秒GPT-5.6 Terra (medium): 44.3 秒;OpenAIGPT-5.6 Terra (medium)44.3 秒Devstral Small 2: 47.6 秒;MistralDevstral Small 247.6 秒Granite 4.2 3B: 52.7 秒;IBMGranite 4.2 3B52.7 秒Gemma 4 31B: 57.2 秒;GoogleGemma 4 31B57.2 秒Agnes 2.5 Pro Beta: 312.5 秒;Sapiens AIAgnes 2.5 Pro Beta312.5 秒
查看图表数据
项目数值
Celeris-19 秒
Llama 4 Scout10 秒
GPT-5.5 Instant (June 2026)17.4 秒
gpt-oss-120b (low)19 秒
GPT-5.6 Luna (Non-reasoning)20.8 秒
GPT-5.6 Luna (low)22.4 秒
Llama 4 Maverick23 秒
GPT-5.6 Terra (low)24 秒
GPT-5.6 Terra (Non-reasoning)24.3 秒
Mercury 228.1 秒
GPT-5.6 Sol (Non-reasoning)33.7 秒
GPT-5.6 Luna (medium)35.1 秒
GPT-5.6 Sol (low)37.9 秒
Gemini 3.5 Flash-Lite38.4 秒
Gemini 3.7 Flash (low)42.5 秒
GPT-5.6 Terra (medium)44.3 秒
Devstral Small 247.6 秒
Granite 4.2 3B52.7 秒
Gemma 4 31B57.2 秒
Agnes 2.5 Pro Beta312.5 秒

LATENCY

首个回答 Token 等待

推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。

首个回答 Token:输入处理与推理等待
输入处理推理等待
首个回答 Token:输入处理与推理等待Celeris-1: 0.6 秒Celeris-10.6 秒Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒DeepSeek V4 Flash: 0.7 秒DeepSeek V4 Flash0.7 秒Qwen3.5 4B: 0.7 秒Qwen3.5 4B0.7 秒Gemma 4 E4B: 0.7 秒Gemma 4 E4B0.7 秒Grok 4.3 (Non-reasoning): 0.7 秒Grok 4.3 (Non-reasoning)0.7 秒Granite 4.1 8B: 0.8 秒Granite 4.1 8B0.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒Ministral 3 8B: 0.8 秒Ministral 3 8B0.8 秒Agnes 2.5 Pro Beta: 15 秒Agnes 2.5 Pro Beta15 秒
查看图表数据
项目合计输入处理推理等待
Celeris-10.6 秒0.6 秒0 秒
Ministral 3 3B0.6 秒0.6 秒0 秒
DeepSeek V4 Flash0.7 秒0.7 秒0 秒
Qwen3.5 4B0.7 秒0.7 秒0 秒
Gemma 4 E4B0.7 秒0.7 秒0 秒
Grok 4.3 (Non-reasoning)0.7 秒0.7 秒0 秒
Granite 4.1 8B0.8 秒0.8 秒0 秒
Llama 4 Scout0.8 秒0.8 秒0 秒
Ministral 3 8B0.8 秒0.8 秒0 秒
Agnes 2.5 Pro Beta15 秒2.5 秒12.6 秒

END-TO-END RESPONSE TIME

端到端响应时间

按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。

输出 500 Token 的完整响应时间
输入处理推理生成 500 Token
输出 500 Token 的完整响应时间Celeris-1: 0.9 秒Celeris-10.9 秒Nova Micro: 2.5 秒Nova Micro2.5 秒Gemini 3.7 Flash (low): 2.5 秒Gemini 3.7 Flash (low)2.5 秒LFM2.5-VL-1.6B: 2.7 秒LFM2.5-VL-1.6B2.7 秒DeepSeek V4 Flash: 2.8 秒DeepSeek V4 Flash2.8 秒Nemotron 3 Nano: 3.2 秒Nemotron 3 Nano3.2 秒Ministral 3 3B: 3.5 秒Ministral 3 3B3.5 秒Gemini 3.5 Flash (minimal): 3.5 秒Gemini 3.5 Flash (minimal)3.5 秒Qwen3.5 Omni Flash: 3.8 秒Qwen3.5 Omni Flash3.8 秒Agnes 2.5 Pro Beta: 18.1 秒Agnes 2.5 Pro Beta18.1 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Celeris-10.9 秒0.6 秒0 秒0.3 秒
Nova Micro2.5 秒0.8 秒0 秒1.6 秒
Gemini 3.7 Flash (low)2.5 秒1 秒0 秒1.6 秒
LFM2.5-VL-1.6B2.7 秒1.3 秒0 秒1.4 秒
DeepSeek V4 Flash2.8 秒2.8 秒0 秒0 秒
Nemotron 3 Nano3.2 秒0.9 秒0 秒2.3 秒
Ministral 3 3B3.5 秒0.6 秒0 秒2.9 秒
Gemini 3.5 Flash (minimal)3.5 秒0.9 秒0 秒2.6 秒
Qwen3.5 Omni Flash3.8 秒1.8 秒0 秒2 秒
Agnes 2.5 Pro Beta18.1 秒2.5 秒12.6 秒3.1 秒

FAQ

Agnes 2.5 Pro Beta 常见问题

问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。

Agnes 2.5 Pro Beta 什么时候发布?

Artificial Analysis 当前记录的发布日期为 2026-08-26;本站按来源快照展示,不把发布前预测当作事实。

Agnes 2.5 Pro Beta API 价格是多少?

当前没有精确同款的已核实 API 报价;本站上次记录的 Artificial Analysis model aggregate 数据为输入 US$0.1、输出 US$0.3(2026-08-28),仅作历史参考。

Agnes 2.5 Pro Beta 的评测表现怎么样?

当前公开 Intelligence Index 为 49.1,在 271 个当前模型条目中排名第 39。该指数由多项公开评测组成,不等于所有任务中的统一胜率。

Agnes 2.5 Pro Beta 的上下文窗口有多大?

上下文窗口为 1,000,000 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。

Agnes 2.5 Pro Beta 的生成速度是多少?

公开性能数据为 159.3 Token/s,来源为 Sapiens AI。

Agnes 2.5 Pro Beta 是开源模型吗?

当前Artificial Analysis未提供可核验的开放权重,本站暂按非开放权重处理。

怎样通过 API 使用 Agnes 2.5 Pro Beta?

原始来源记录了 1 家 Provider。 Provider 横向明细尚未同步。