MODEL RANKINGS · 专项榜单
AI 模型输出速度排行
哪些模型持续输出内容更快?
按 Artificial Analysis 公布的输出速度中位数排序,比较模型的生成速度。
Celeris-1 在本页排名第 1,Token / 秒 为 1492。本页收录 165 个模型;采集日期 2026-09-23。
查看完整排名完整排名
Artificial Analysis · Token / 秒 · 只收录公布了输出速度中位数的模型,按 Token / 秒降序排列;速度会随部署环境变化。
显示 165 条结果
本页排名模型 / 开发机构Token / 秒参考信息原榜名次
- 01CCeleris-1 Celeris1492Token / 秒智能指数 6每任务成本 $0.05原榜 #230#230
- 02Mercury 2 Inception AI755Token / 秒智能指数 14(估算)每任务成本未公布原榜 #129#129
- 03Gemini 3.5 Flash-Lite Google367Token / 秒智能指数 22每任务成本 $0.12原榜 #93#93
- 04ILing 3.0 Flash InclusionAI333Token / 秒智能指数 25(估算)每任务成本未公布原榜 #84#84
- 05ATrinity Large Thinking Arcee AI327Token / 秒智能指数 11每任务成本 $0.35原榜 #160#160
- 06Gemini 3.8 Flash (high) Google287Token / 秒智能指数 41每任务成本 $1.24原榜 #33#33
- 07Nemotron 3.5 Lightning NVIDIA274Token / 秒智能指数 13每任务成本 $0.1原榜 #139#139
- 08Nova Micro Amazon270Token / 秒智能指数 6(估算)每任务成本未公布原榜 #242#242
- 09Nemotron 3 Nano Omni 30B A3B NVIDIA269Token / 秒智能指数 10(估算)每任务成本未公布原榜 #164#164
- 10Command A+ Cohere240Token / 秒智能指数 13每任务成本 $0原榜 #136#136
- 11237Token / 秒智能指数 45每任务成本 $1.37原榜 #21#21
- 12DeepSeek V4.1 Flash (max) DeepSeek232Token / 秒智能指数 39每任务成本 $0.27原榜 #38#38
- 13Qwen3.5 Omni Flash Alibaba231Token / 秒智能指数 12(估算)每任务成本未公布原榜 #143#143
- 14DeepSeek V4 Flash Vision (max) DeepSeek227Token / 秒智能指数 35每任务成本 $0.31原榜 #46#46
- 15Ministral 3 3B Mistral AI225Token / 秒智能指数 5每任务成本 $0.04原榜 #265#265
- 16gpt-oss-20b (low) OpenAI224Token / 秒智能指数 10(估算)每任务成本未公布原榜 #168#168
- 17Muse Spark 1.3 (max) Meta223Token / 秒智能指数 48每任务成本 $1.6原榜 #13#13
- 18Granite 4.2 3B IBM220Token / 秒智能指数 9每任务成本 $0.01原榜 #178#178
- 19TInkling Small Thinking Machines199Token / 秒智能指数 28(估算)每任务成本未公布原榜 #69#69
- 20Step 3.7 Flash StepFun199Token / 秒智能指数 19(估算)每任务成本未公布原榜 #104#104
- 21gpt-oss-120b (high) OpenAI196Token / 秒智能指数 12每任务成本 $0.11原榜 #150#150
- 22188Token / 秒智能指数 6(估算)每任务成本未公布原榜 #243#243
- 23gpt-oss-20b (high) OpenAI186Token / 秒智能指数 9每任务成本 $0.01原榜 #183#183
- 24gpt-oss-120b (low) OpenAI181Token / 秒智能指数 10(估算)每任务成本未公布原榜 #165#165
- 25177Token / 秒智能指数 7(估算)每任务成本未公布原榜 #222#222
- 26Qwen3 Next 80B A3B Alibaba171Token / 秒智能指数 10(估算)每任务成本未公布原榜 #171#171
- 27Mistral Small 4 Mistral AI170Token / 秒智能指数 11每任务成本 $0.05原榜 #154#154
- 28Qwen3 Next 80B A3B (Reasoning) Alibaba167Token / 秒智能指数 11(估算)每任务成本未公布原榜 #155#155
- 29Nova 2.0 Lite (high) Amazon166Token / 秒智能指数 13(估算)每任务成本未公布原榜 #133#133
- 30164Token / 秒智能指数 9(估算)每任务成本未公布原榜 #188#188
READING GUIDE
怎么读这份榜单
排序与收录
只收录公布了输出速度中位数的模型,按 Token / 秒降序排列;速度会随部署环境变化。
适合怎么用
比较输出 Token/秒的中位数,适合关注长回答生成速度的场景。
解读时注意
首段出现得快不等于持续输出快;交互等待感也应看首段响应延迟。
榜单由公开评测数据整理;名次随来源更新,缺失指标不推算。核对原榜
