公榜 · 客观

公榜总览 · 速度

吞吐与延迟. 模型速度公榜:吞吐 tok/s、首包延迟与响应效率。低延迟 / 高吞吐选型。

更新数据更新于 2026-08-03 · AA 315 · gateway 49 · 150 · OpenRouter live · Artificial Analysis / llmrank.cn

  1. #1grok-4.20-0309-non-reasoning100
  2. #2grok-4.3-fast100
  3. #3Step 3.7 Flash100
速度 配图

模型天梯 · capability

速度

吞吐与延迟

显示 150全量 150

列表 150 / 150(全库 150)· 点击「佐证」查看评分依据与测试题面

#模型厂商地区速度分相对说明证据源佐证
🥇grok-4.20-0309-non-reasoning
grok-4.20-0309-non-reasoning
x-ai美国网关100
29.3 tok/s
吞吐 / 延迟
实测OR
查看佐证
🥈grok-4.3-fast
grok-4.3-fast
xai美国网关100
30 tok/s
吞吐 / 延迟
实测OR快照Arena
查看佐证
🥉Step 3.7 Flash
aa/step-3.7-flash
StepFun中国100
410 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
4HyperNova 60B 2605
aa/hypernova-60b-2605
Multiverse Computing96
385 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
5Celeris-1
aa/celeris-1
Celeris94
0.62s
吞吐 / 延迟
AA快照站外对照
查看佐证
6grok-4.20-0309-non-reasoning-console
grok-4.20-0309-non-reasoning-console
x-ai美国网关94
17.6 tok/s
吞吐 / 延迟
实测OR
查看佐证
7grok-composer
grok-composer
xai美国网关87
15 tok/s
吞吐 / 延迟
探测
查看佐证
8qwen3.6:35b-a3b
qwen3.6:35b-a3b
qwen中国网关87
165 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
9gpt-4.1-nano-2025-04-14
gpt-4.1-nano-2025-04-14
openai美国网关84
12.9 tok/s
吞吐 / 延迟
探测OR快照
查看佐证
10qwen3.5:4b
qwen3.5:4b
qwen中国网关82
12 tok/s
吞吐 / 延迟
探测AA快照
查看佐证
11grok-3
grok-3
xai美国网关80
11.1 tok/s
吞吐 / 延迟
探测
查看佐证
12grok-4.20-fast
grok-4.20-fast
xai美国网关80
9.4 tok/s
吞吐 / 延迟
实测
查看佐证
13Gemini 3.1 Flash-Lite
aa/gemini-3.1-flash-lite
Google美国78
310 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
14gpt-5.4-mini
gpt-5.4-mini
openai美国网关71
44 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
15gemini-3-5-flash-low
gemini-3-5-flash-low
google美国网关70
8.5 tok/s
吞吐 / 延迟
探测OR快照
查看佐证
16NVIDIA Nemotron 3 Nano
aa/nvidia-nemotron-3-nano
NVIDIA美国70
280 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
17qwen3.6:27b
qwen3.6:27b
qwen中国网关70
58 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
18gpt-oss-120b (low)
aa/gpt-oss-120b-low
OpenAI美国67
266 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
19grok-4.20-0309-reasoning-console
grok-4.20-0309-reasoning-console
x-ai美国网关67
6.3 tok/s
吞吐 / 延迟
实测OR
查看佐证
20grok-4.20-multi-agent-console
grok-4.20-multi-agent-console
x-ai美国网关65
6.1 tok/s
吞吐 / 延迟
实测OR
查看佐证
21grok-4.3-medium
grok-4.3-medium
xai美国网关65
6.1 tok/s
吞吐 / 延迟
实测OR快照Arena
查看佐证
22gpt-4.1-nano
gpt-4.1-nano
openai美国网关64
7.4 tok/s
吞吐 / 延迟
探测OR快照OR
查看佐证
23gpt-5.6-luna
gpt-5.6-luna
openai美国网关64
181 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
24grok-4.3-high
grok-4.3-high
xai美国网关64
5.9 tok/s
吞吐 / 延迟
实测OR快照Arena
查看佐证
25lingsi1.0
lingsi1.0
other网关64
7.3 tok/s
吞吐 / 延迟
探测
查看佐证
26grok-4.20-0309-console
grok-4.20-0309-console
xai美国网关60
5.5 tok/s
吞吐 / 延迟
实测
查看佐证
27grok-4.3-low
grok-4.3-low
xai美国网关58
5.3 tok/s
吞吐 / 延迟
实测OR快照Arena
查看佐证
28Ministral 3 3B
aa/ministral-3-3b
Mistral其他58
230 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
29grok-4.20-multi-agent-high
grok-4.20-multi-agent-high
x-ai美国网关55
5 tok/s
吞吐 / 延迟
实测OR
查看佐证
30gpt-oss-20b (high)
aa/gpt-oss-20b-high
OpenAI美国54
217 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
31gpt-oss-120b (high)
aa/gpt-oss-120b-high
OpenAI美国53
212 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
32Command A+
aa/command-a+
Cohere美国51
202 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
33grok-composer-2.5-fast
grok-composer-2.5-fast
xai美国网关51
5.7 tok/s
吞吐 / 延迟
探测
查看佐证
34Qwen3 Next 80B A3B
aa/qwen3-next-80b-a3b
Alibaba中国51
203 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
35grok-4.3-console
grok-4.3-console
xai美国网关46
4.3 tok/s
吞吐 / 延迟
实测OR快照Arena
查看佐证
36GPT-5.6 Luna (max)
aa/gpt-5.6-luna-max
OpenAI美国45
181 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
37Muse Spark 1.1 (xhigh)
aa/muse-spark-1.1-xhigh
Meta美国45
180 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
38grok-4.5
grok-4.5
x-ai美国网关44
60 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
39Qwen3.5 35B A3B
aa/qwen3.5-35b-a3b
Alibaba中国44
176 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
40GLM-5.2 (max)
aa/glm-5.2-max
Z AI中国43
173 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
41grok-4.20-multi-agent-medium
grok-4.20-multi-agent-medium
x-ai美国网关42
4 tok/s
吞吐 / 延迟
实测OR
查看佐证
42GPT-5.6 Luna (Non-reasoning)
aa/gpt-5.6-luna-non-reasoning
OpenAI美国41
162 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
43GPT-5.6 Luna (xhigh)
aa/gpt-5.6-luna-xhigh
OpenAI美国41
162 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
44GPT-5.6 Luna (high)
aa/gpt-5.6-luna-high
OpenAI美国39
157 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
45grok-4.20-multi-agent-xhigh
grok-4.20-multi-agent-xhigh
x-ai美国网关39
3.8 tok/s
吞吐 / 延迟
实测OR
查看佐证
46Nova 2.0 Lite (high)
aa/nova-2.0-lite-high
Amazon美国39
154 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
47GPT-5.6 Luna (low)
aa/gpt-5.6-luna-low
OpenAI美国37
149 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
48GPT-5.6 Luna (medium)
aa/gpt-5.6-luna-medium
OpenAI美国37
148 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
49NVIDIA Nemotron 3 Super
aa/nvidia-nemotron-3-super
NVIDIA美国36
142 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
50GPT-5.6 Terra (max)
aa/gpt-5.6-terra-max
OpenAI美国35
139 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
51Grok 4.3 (Non-reasoning)
aa/grok-4.3-non-reasoning
xAI美国35
138 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
52Magistral Small 1.2
aa/magistral-small-1.2
Mistral其他35
141 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
53grok-4.3
grok-4.3
x-ai美国网关33
4.4 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
54Agnes 2.5 Pro Alpha
aa/agnes-2.5-pro-alpha
Sapiens AI32
128 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
55Nex-N2-Pro
aa/nex-n2-pro
Nex AGI32
129 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
56grok-build-0.1
grok-build-0.1
x-ai美国网关31
4.3 tok/s
吞吐 / 延迟
探测OR快照OR
查看佐证
57Ring-2.6-1T
aa/ring-2.6-1t
InclusionAI中国31
125 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
58Ministral 3 8B
aa/ministral-3-8b
Mistral其他30
118 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
59Nova 2.0 Pro Preview (low)
aa/nova-2.0-pro-preview-low
Amazon美国30
119 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
60Nova 2.0 Pro Preview (medium)
aa/nova-2.0-pro-preview-medium
Amazon美国29
117 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
61GPT-5.6 Terra (high)
aa/gpt-5.6-terra-high
OpenAI美国28
112 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
62GPT-5.6 Terra (xhigh)
aa/gpt-5.6-terra-xhigh
OpenAI美国28
113 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
63gemma4:12b
gemma4:12b
google美国27
109 tok/s
吞吐 / 延迟
探测AA快照
查看佐证
64GPT-5.6 Terra (medium)
aa/gpt-5.6-terra-medium
OpenAI美国27
106 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
65GPT-5.6 Terra (low)
aa/gpt-5.6-terra-low
OpenAI美国26
103 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
66GPT-5.6 Terra (Non-reasoning)
aa/gpt-5.6-terra-non-reasoning
OpenAI美国26
105 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
67KAT-Coder-Pro V2
aa/kat-coder-pro-v2
KwaiKAT26
102 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
68Nova 2.0 Pro Preview
aa/nova-2.0-pro-preview
Amazon美国26
102 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
69Claude 4.5 Haiku
aa/claude-4.5-haiku
Anthropic美国25
100 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
70composer-2.5
composer-2.5
cursor网关24
3.9 tok/s
吞吐 / 延迟
探测
查看佐证
71Gemma 4 E4B
aa/gemma-4-e4b
Google美国22
86 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
72Ling 2.6 Flash
aa/ling-2.6-flash
InclusionAI中国22
86 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
73Ministral 3 14B
aa/ministral-3-14b
Mistral其他22
89 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
74Claude Sonnet 5 (max)
aa/claude-sonnet-5-max
Anthropic美国21
82 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
75Llama 3.3 70B
aa/llama-3.3-70b
Meta美国21
84 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
76Qwen3.5 9B
aa/qwen3.5-9b
Alibaba中国19
76 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
77Claude Fable 5 (with fallback)
aa/claude-fable-5-with-fallback
Anthropic美国18
73 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
78Claude Sonnet 5 (xhigh)
aa/claude-sonnet-5-xhigh
Anthropic美国18
72 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
79GPT-5.6 Sol (max)
aa/gpt-5.6-sol-max
OpenAI美国18
70 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
80Hy3
aa/hy3
Tencent中国18
72 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
81Claude Sonnet 5 (high)
aa/claude-sonnet-5-high
Anthropic美国17
68 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
82gpt-5.4
gpt-5.4
openai美国网关17
3.6 tok/s
吞吐 / 延迟
探测OR快照OR
查看佐证
83GPT-5.6 Sol (xhigh)
aa/gpt-5.6-sol-xhigh
OpenAI美国17
69 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
84Claude Sonnet 5 (low)
aa/claude-sonnet-5-low
Anthropic美国16
64 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
85Claude Sonnet 5 (medium)
aa/claude-sonnet-5-medium
Anthropic美国16
65 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
86Claude Sonnet 5 (Non-reasoning)
aa/claude-sonnet-5-non-reasoning
Anthropic美国16
63 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
87DeepSeek V4 Pro (high)
aa/deepseek-v4-pro-high
DeepSeek中国16
65 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
88deepseek-v4-pro
deepseek-v4-pro
deepseek中国网关16
55 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
89Devstral Small 2
aa/devstral-small-2
Mistral其他16
65 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
90GPT-5.6 Sol (medium)
aa/gpt-5.6-sol-medium
OpenAI美国16
63 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
91GPT-5.6 Sol (Non-reasoning)
aa/gpt-5.6-sol-non-reasoning
OpenAI美国16
64 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
92GPT-5.6 Sol (high)
aa/gpt-5.6-sol-high
OpenAI美国15
60 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
93GPT-5.6 Sol (low)
aa/gpt-5.6-sol-low
OpenAI美国15
60 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
94Grok 4.5 (high)
aa/grok-4.5-high
xAI美国15
60 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
95Magistral Medium 1.2
aa/magistral-medium-1.2
Mistral其他15
59 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
96Claude Opus 5 (max)
aa/claude-opus-5-max
Anthropic美国14
55 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
97Claude Opus 5 (xhigh)
aa/claude-opus-5-xhigh
Anthropic美国14
55 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
98DeepSeek V4 Pro (max)
aa/deepseek-v4-pro-max
DeepSeek中国14
55 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
99gpt-5.6-terra
gpt-5.6-terra
openai美国网关14
139 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
100Qwen3.6 Plus
aa/qwen3.6-plus
Alibaba中国14
56 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
101Claude Opus 5 (high)
aa/claude-opus-5-high
Anthropic美国13
53 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
102Claude Opus 5 (low)
aa/claude-opus-5-low
Anthropic美国13
52 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
103Claude Opus 5 (medium)
aa/claude-opus-5-medium
Anthropic美国13
52 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
104deepseek-v4-flash
deepseek-v4-flash
deepseek中国网关13
3.5 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
105codex-auto-review
codex-auto-review
openai美国网关12
2.1 tok/s
吞吐 / 延迟
探测
查看佐证
106Devstral 2
aa/devstral-2
Mistral其他12
46 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
107gpt-5.2
gpt-5.2
openai美国网关12
2.3 tok/s
吞吐 / 延迟
探测OR快照OR
查看佐证
108gpt-5.2-2025-12-11
gpt-5.2-2025-12-11
openai美国网关12
2 tok/s
吞吐 / 延迟
探测OR快照
查看佐证
109gpt-5.2-chat-latest
gpt-5.2-chat-latest
openai美国网关12
2.3 tok/s
吞吐 / 延迟
探测OR快照
查看佐证
110gpt-5.2-pro
gpt-5.2-pro
openai美国网关12
2.3 tok/s
吞吐 / 延迟
探测OR快照OR
查看佐证
111gpt-5.2-pro-2025-12-11
gpt-5.2-pro-2025-12-11
openai美国网关12
2.3 tok/s
吞吐 / 延迟
探测OR快照
查看佐证
112gpt-5.3-codex-spark
gpt-5.3-codex-spark
openai美国网关12
2.3 tok/s
吞吐 / 延迟
探测OR快照
查看佐证
113gpt-5.4-2026-03-05
gpt-5.4-2026-03-05
openai美国网关12
0.2 tok/s
吞吐 / 延迟
探测OR快照Arena
查看佐证
114gpt-5.5
gpt-5.5
openai美国网关12
0.4 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
115gpt-5.6-sol
gpt-5.6-sol
openai美国网关12
70 tok/s
吞吐 / 延迟
探测AAOR
查看佐证
116Kimi K3 (low)
aa/kimi-k3-low
Kimi中国12
34 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
117Kimi K3 (max)
aa/kimi-k3-max
Kimi中国12
35 tok/s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
118Mistral Large 3
aa/mistral-large-3
Mistral其他12
49 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
119North Mini Code
aa/north-mini-code
Cohere美国12
22 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
120Phi-4 Mini
aa/phi-4-mini
Microsoft12
44 tok/s
吞吐 / 延迟
AA快照站外对照
查看佐证
121Claude Sonnet 4.6 (Non-reasoning, Low Effort)
aa/claude-sonnet-4.6-non-reasoning-low-effort
Anthropic美国0
43.00s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
122Gemini 3.5 Flash (medium)
aa/gemini-3.5-flash-medium
Google美国0
180.00s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
123Gemini 3.5 Flash (minimal)
aa/gemini-3.5-flash-minimal
Google美国0
172.00s
吞吐 / 延迟
AA快照站外对照Arena
查看佐证
124Gemma 4 12B (Non-reasoning)
aa/gemma-4-12b-non-reasoning
Google美国0
104.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
125GPT-5.3 Codex (xhigh)
aa/gpt-5.3-codex-xhigh
OpenAI美国0
130.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
126gpt-oss-20b (low)
aa/gpt-oss-20b-low
OpenAI美国0
198.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
127Granite 4.0 H Small
aa/granite-4.0-h-small
IBM0
49.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
128Granite 4.1 8B
aa/granite-4.1-8b
IBM0
106.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
129Hermes 4 405B
aa/hermes-4-405b
Nous Research0
41.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
130Hermes 4 70B
aa/hermes-4-70b
Nous Research0
83.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
131Jamba 1.7 Large
aa/jamba-1.7-large
AI21 Labs美国0
59.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
132LFM2.5-8B-A1B
aa/lfm2.5-8b-a1b
Liquid AI0
337.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
133LFM2.5-VL-1.6B
aa/lfm2.5-vl-1.6b
Liquid AI0
381.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
134Llama 3.1 Nemotron 70B
aa/llama-3.1-nemotron-70b
NVIDIA美国0
105.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
135Llama 3.2 11B (Vision)
aa/llama-3.2-11b-vision
Meta美国0
48.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
136Llama Nemotron Super 49B v1.5
aa/llama-nemotron-super-49b-v1.5
NVIDIA美国0
107.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
137Llama Nemotron Ultra
aa/llama-nemotron-ultra
NVIDIA美国0
52.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
138Nemotron 3 Nano Omni 30B A3B Reasoning
aa/nemotron-3-nano-omni-30b-a3b-reasoning
NVIDIA美国0
309.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
139Nova 2.0 Lite
aa/nova-2.0-lite
Amazon美国0
143.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
140Nova 2.0 Lite (low)
aa/nova-2.0-lite-low
Amazon美国0
160.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
141Nova 2.0 Lite (medium)
aa/nova-2.0-lite-medium
Amazon美国0
156.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
142Nova Micro
aa/nova-micro
Amazon美国0
280.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
143Nova Premier
aa/nova-premier
Amazon美国0
33.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
144NVIDIA Nemotron Nano 12B v2 VL
aa/nvidia-nemotron-nano-12b-v2-vl
NVIDIA美国0
108.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
145NVIDIA Nemotron Nano 9B V2
aa/nvidia-nemotron-nano-9b-v2
NVIDIA美国0
225.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
146o3
aa/o3
OpenAI美国0
123.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
147Phi-4 Multimodal
aa/phi-4-multimodal
Microsoft0
18.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
148Qwen3 Omni 30B A3B
aa/qwen3-omni-30b-a3b
Alibaba中国0
99.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
149Qwen3.5 Omni Flash
aa/qwen3.5-omni-flash
Alibaba中国0
238.00s
吞吐 / 延迟
AA快照站外对照
查看佐证
150Qwen3.5 Omni Plus
aa/qwen3.5-omni-plus
Alibaba中国0
52.00s
吞吐 / 延迟
AA快照站外对照
查看佐证

启发式维度(中文/英文/OCR/软件等)在无官方公开 bench 时由厂商归属、模态与关联模型热度估算,仅供选型参考; 客观能力以 AA 智力/代码/Agent 与本站实测为准。交叉验证: 用量榜 · 模型目录 · 实验室

速度 · Public AI leaderboard | GrokCode · GrokCode 倍率榜