MODEL RANKINGS · 专项榜单
AI 模型首段响应延迟排行
哪些模型更快开始返回内容?
按 Artificial Analysis 公布的首段响应延迟由低到高排序,比较模型开始返回内容的速度。
North Mini Code 在本页排名第 1,秒 / 首段 为 0.38。本页收录 165 个模型;采集日期 2026-09-23。
查看完整排名完整排名
Artificial Analysis · 秒 / 首段 · 只收录公布了首段响应延迟的模型,按秒数升序排列。此指标与持续输出速度分别衡量响应体验。
显示 165 条结果
本页排名模型 / 开发机构秒 / 首段参考信息原榜名次
- 01North Mini Code Cohere0.38秒 / 首段智能指数 10输出 98 tok/s原榜 #169#169
- 02Command A+ Cohere0.41秒 / 首段智能指数 13输出 240 tok/s原榜 #136#136
- 03Granite 4.2 3B IBM0.46秒 / 首段智能指数 9输出 220 tok/s原榜 #178#178
- 04Nemotron 3 Nano Omni 30B A3B NVIDIA0.49秒 / 首段智能指数 10(估算)输出 269 tok/s原榜 #164#164
- 05CCeleris-1 Celeris0.59秒 / 首段智能指数 6输出 1492 tok/s原榜 #230#230
- 06Nemotron 3.5 Lightning NVIDIA0.61秒 / 首段智能指数 13输出 274 tok/s原榜 #139#139
- 07Claude 4.5 Haiku (Non-reasoning) Anthropic0.63秒 / 首段智能指数 15(估算)输出 88 tok/s原榜 #120#120
- 08Ministral 3 3B Mistral AI0.69秒 / 首段智能指数 5输出 225 tok/s原榜 #265#265
- 09GPT-6 Luna (Non-reasoning) OpenAI0.72秒 / 首段智能指数 18输出 140 tok/s原榜 #110#110
- 10Qwen3.5 4B Alibaba0.74秒 / 首段智能指数 13(估算)输出 21 tok/s原榜 #138#138
- 11Mistral Small 4 Mistral AI0.74秒 / 首段智能指数 11输出 170 tok/s原榜 #154#154
- 12Qwen3.5 9B (Non-reasoning) Alibaba0.75秒 / 首段智能指数 13(估算)输出 91 tok/s原榜 #134#134
- 13Mistral Small 4 (Non-reasoning) Mistral AI0.76秒 / 首段智能指数 9(估算)输出 151 tok/s原榜 #181#181
- 14Gemma 4 E4B (Non-reasoning) Google0.78秒 / 首段智能指数 7(估算)输出 47 tok/s原榜 #208#208
- 15Ministral 3 8B Mistral AI0.80秒 / 首段智能指数 5输出 82 tok/s原榜 #250#250
- 16gpt-oss-120b (low) OpenAI0.81秒 / 首段智能指数 10(估算)输出 181 tok/s原榜 #165#165
- 17gpt-oss-120b (high) OpenAI0.83秒 / 首段智能指数 12输出 196 tok/s原榜 #150#150
- 18Qwen3.5 4B (Non-reasoning) Alibaba0.83秒 / 首段智能指数 11(估算)输出 15 tok/s原榜 #161#161
- 19gpt-oss-20b (high) OpenAI0.83秒 / 首段智能指数 9输出 186 tok/s原榜 #183#183
- 20Grok 4.7 (high) xAI0.84秒 / 首段智能指数 46输出 53 tok/s原榜 #17#17
- 21Phi-4 Multimodal Microsoft0.84秒 / 首段智能指数 6(估算)输出 17 tok/s原榜 #244#244
- 22Llama 4 Scout Meta0.86秒 / 首段智能指数 8(估算)输出 104 tok/s原榜 #196#196
- 23Phi-4 Mini Microsoft0.86秒 / 首段智能指数 6(估算)输出 45 tok/s原榜 #231#231
- 24Nova Micro Amazon0.86秒 / 首段智能指数 6(估算)输出 270 tok/s原榜 #242#242
- 25Grok 4.7 (xhigh) xAI0.88秒 / 首段智能指数 46输出 39 tok/s原榜 #16#16
- 26Granite 4.2 8B IBM0.88秒 / 首段智能指数 11输出 102 tok/s原榜 #157#157
- 270.91秒 / 首段智能指数 21输出 78 tok/s原榜 #98#98
- 28Llama 4 Maverick Meta0.91秒 / 首段智能指数 10(估算)输出 111 tok/s原榜 #166#166
- 29gpt-oss-20b (low) OpenAI0.92秒 / 首段智能指数 10(估算)输出 224 tok/s原榜 #168#168
- 30GPT-6 Sol (Non-reasoning) OpenAI0.93秒 / 首段智能指数 28输出 109 tok/s原榜 #67#67
READING GUIDE
怎么读这份榜单
排序与收录
只收录公布了首段响应延迟的模型,按秒数升序排列。此指标与持续输出速度分别衡量响应体验。
适合怎么用
按首段响应秒数升序排列,适合比较对话开始时的等待时间。
解读时注意
该指标不表示整个回答完成得更快;长回答还要看持续输出速度。
榜单由公开评测数据整理;名次随来源更新,缺失指标不推算。核对原榜
