跳到主要内容
AIUtil

站内搜索

搜索模型、工具、文章或产品

导航
模型排名、AI 工具、开发文章和自有产品
全部天梯
当前数据AIUtil 能力天梯

模型 Agent 能力天梯

聚焦规划、工具调用与多步骤任务执行能力。

本次数据

收录 50模型

当前第一

Claude Opus 5 (Adaptive Reasoning, Max Effort)

最高分

55.3

入榜数量

50

最近发布

2026/07/24

前三名

领先梯队

1

Claude Opus 5 (Adaptive Reasoning, Max Effort)

Anthropic

能力得分

55.3

56 tok/s

输出速度

2

Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)

Anthropic

能力得分

54.5

52 tok/s

输出速度

3

GPT-5.6 Sol (max)

OpenAI

能力得分

54.0

64 tok/s

输出速度

分数对比

前十名能力差距

10 / 50
  1. 01Claude Opus 5 (Adaptive Reasoning, Max Effort)55.3
  2. 02Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)54.5
  3. 03GPT-5.6 Sol (max)54.0
  4. 04Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)52.8
  5. 05Claude Opus 5 (Adaptive Reasoning, High Effort)52.1
  6. 06GPT-5.6 Sol (xhigh)51.8
  7. 07Kimi K350.1
  8. 08GPT-5.6 Sol (high)48.5
  9. 09GPT-5.6 Terra (max)47.4
  10. 10Claude Opus 4.8 (Adaptive Reasoning, Max Effort)47.2

价格对比

能力与输出价格

越靠近左上角,代表更高能力与更低输出价格。

全部结果

完整排名

Artificial Analysis Agentic Index

排名模型厂商Artificial Analysis Agentic Index输出速度发布日期
#01

Claude Opus 5 (Adaptive Reasoning, Max Effort)

Anthropic55.356 tok/s
#02

Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)

Anthropic54.552 tok/s
#03

GPT-5.6 Sol (max)

OpenAI54.064 tok/s
#04

Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)

Anthropic52.874 tok/s
#05

Claude Opus 5 (Adaptive Reasoning, High Effort)

Anthropic52.155 tok/s
#06

GPT-5.6 Sol (xhigh)

OpenAI51.870 tok/s
#07

Kimi K3

Kimi50.133 tok/s
#08

GPT-5.6 Sol (high)

OpenAI48.560 tok/s
#09

GPT-5.6 Terra (max)

OpenAI47.4140 tok/s
#10

Claude Opus 4.8 (Adaptive Reasoning, Max Effort)

Anthropic47.259 tok/s
#11

Claude Opus 5 (Adaptive Reasoning, Medium Effort)

Anthropic47.150 tok/s
#12

Claude Sonnet 5 (Adaptive Reasoning, Max Effort)

Anthropic46.779 tok/s
#13

Grok 4.5 (high)

SpaceXAI45.764 tok/s
#14

GPT-5.6 Luna (max)

OpenAI45.6188 tok/s
#15

GPT-5.5 (xhigh)

OpenAI44.981 tok/s
#16

GPT-5.6 Terra (xhigh)

OpenAI44.7121 tok/s
#17

GPT-5.6 Sol (medium)

OpenAI44.558 tok/s
#18

Claude Opus 4.7 (Adaptive Reasoning, Max Effort)

Anthropic44.453 tok/s
#19

GPT-5.5 (high)

OpenAI43.574 tok/s
#20

GLM-5.2 (max)

Z AI43.1171 tok/s
#21

GPT-5.6 Luna (xhigh)

OpenAI42.9167 tok/s
#22

GPT-5.6 Terra (high)

OpenAI41.3121 tok/s
#23

GPT-5.4 (xhigh)

OpenAI41.1132 tok/s
#24

Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)

Anthropic40.847 tok/s
#25

GPT-5.6 Luna (high)

OpenAI40.1155 tok/s
#26

GPT-5.6 Sol (low)

OpenAI40.055 tok/s
#27

Claude Opus 5 (Adaptive Reasoning, Low Effort)

Anthropic39.855 tok/s
#28

Gemini 3.6 Flash (high)

Google38.7235 tok/s
#29

GPT-5.5 (medium)

OpenAI37.866 tok/s
#30

Muse Spark 1.1 (xhigh)

Meta37.5118 tok/s
#31

Gemini 3.5 Flash (high)

Google37.4183 tok/s
#32

GPT-5.6 Terra (medium)

OpenAI37.0113 tok/s
#33

DeepSeek V4 Pro (Reasoning, Max Effort)

DeepSeek36.468 tok/s
#34

MiniMax-M3

MiniMax35.480 tok/s
#35

GPT-5.6 Sol (Non-reasoning)

OpenAI34.954 tok/s
#36

JT-4.1 Flash 236B A21B

China Mobile34.90 tok/s
#37

Motif 3 (Beta)

Motif Technologies34.90 tok/s
#38

GLM-5.2 (Non-reasoning)

Z AI34.892 tok/s
#39

DeepSeek V4 Pro (Reasoning, High Effort)

DeepSeek34.467 tok/s
#40

Claude Sonnet 5 (Non-reasoning, High Effort)

Anthropic33.757 tok/s
#41

Inkling (xhigh)

Thinking Machines32.365 tok/s
#42

DeepSeek V4 Flash (Reasoning, Max Effort)

DeepSeek31.1120 tok/s
#43

GPT-5.6 Luna (medium)

OpenAI31.0157 tok/s
#44

Nex-N2-Pro

Nex AGI31.0132 tok/s
#45

Hy3

Tencent30.762 tok/s
#46

GPT-5.6 Terra (low)

OpenAI30.6103 tok/s
#47

Qwen3.7 Max

Alibaba30.6196 tok/s
#48

GPT-5.5 (low)

OpenAI30.466 tok/s
#49

Kimi K2.6

Kimi30.332 tok/s
#50

GPT-5.4 mini (xhigh)

OpenAI30.2178 tok/s