跳到主要内容
AIUtil

站内搜索

找行业 Agent、模型、文章或产品

导航
模型排名、工具资料和开发记录
全部天梯
当前数据AIUtil 能力天梯

模型 Agent 能力天梯

聚焦规划、工具调用与多步骤任务执行能力。

本次数据

收录 50模型

当前第一

Claude Opus 5 (Adaptive Reasoning, Max Effort)

最高分

55.3

入榜数量

50

最近发布

2026/08/05

前三名

领先梯队

1

Claude Opus 5 (Adaptive Reasoning, Max Effort)

Anthropic

能力得分

55.3

54 tok/s

输出速度

2

Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)

Anthropic

能力得分

54.5

55 tok/s

输出速度

3

GPT-5.6 Sol (max)

OpenAI

能力得分

54.0

64 tok/s

输出速度

分数对比

前十名能力差距

10 / 50
  1. 01Claude Opus 5 (Adaptive Reasoning, Max Effort)55.3
  2. 02Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)54.5
  3. 03GPT-5.6 Sol (max)54.0
  4. 04Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)52.8
  5. 05Claude Opus 5 (Adaptive Reasoning, High Effort)52.1
  6. 06GPT-5.6 Sol (xhigh)51.8
  7. 07Kimi K3 (max)50.1
  8. 08GPT-5.6 Sol (high)48.5
  9. 09GPT-5.6 Terra (max)47.4
  10. 10Claude Opus 4.8 (Adaptive Reasoning, Max Effort)47.2
015304560Artificial Analysis Agentic Index

价格对比

能力与输出价格

越靠近左上角,代表更高能力与更低输出价格。

48 个模型
每百万输出 Token 价格(美元,对数轴)Artificial Analysis Agentic Index
58.350.643.035.327.6$0.28$1.02$3.74$14$50

Claude Opus 5 (Adaptive Reasoning, Max Effort)

Anthropic

能力分55.3输出价格$25 / 1M
54 tok/s

全部结果

完整排名

Artificial Analysis Agentic Index

排名模型厂商Artificial Analysis Agentic Index输出速度发布日期
#01

Claude Opus 5 (Adaptive Reasoning, Max Effort)

Anthropic55.354 tok/s
#02

Claude Opus 5 (Adaptive Reasoning, Xhigh Effort)

Anthropic54.555 tok/s
#03

GPT-5.6 Sol (max)

OpenAI54.064 tok/s
#04

Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback)

Anthropic52.872 tok/s
#05

Claude Opus 5 (Adaptive Reasoning, High Effort)

Anthropic52.153 tok/s
#06

GPT-5.6 Sol (xhigh)

OpenAI51.863 tok/s
#07

Kimi K3 (max)

Kimi50.138 tok/s
#08

GPT-5.6 Sol (high)

OpenAI48.561 tok/s
#09

GPT-5.6 Terra (max)

OpenAI47.4125 tok/s
#10

Claude Opus 4.8 (Adaptive Reasoning, Max Effort)

Anthropic47.258 tok/s
#11

Claude Opus 5 (Adaptive Reasoning, Medium Effort)

Anthropic47.154 tok/s
#12

Muse Spark 1.2 (xhigh)

Meta46.80 tok/s
#13

Claude Sonnet 5 (Adaptive Reasoning, Max Effort)

Anthropic46.770 tok/s
#14

DeepSeek V4 Flash 0731 (Reasoning, Max Effort)

DeepSeek45.7103 tok/s
#15

Grok 4.5 (high)

SpaceXAI45.759 tok/s
#16

GPT-5.6 Luna (max)

OpenAI45.6178 tok/s
#17

GPT-5.5 (xhigh)

OpenAI44.976 tok/s
#18

GPT-5.6 Terra (xhigh)

OpenAI44.7116 tok/s
#19

GPT-5.6 Sol (medium)

OpenAI44.558 tok/s
#20

Claude Opus 4.7 (Adaptive Reasoning, Max Effort)

Anthropic44.451 tok/s
#21

GPT-5.5 (high)

OpenAI43.572 tok/s
#22

GLM-5.2 (max)

Z AI43.1150 tok/s
#23

GPT-5.6 Luna (xhigh)

OpenAI42.9164 tok/s
#24

GPT-5.6 Terra (high)

OpenAI41.3109 tok/s
#25

GPT-5.4 (xhigh)

OpenAI41.1125 tok/s
#26

Claude Sonnet 4.6 (Adaptive Reasoning, Max Effort)

Anthropic40.858 tok/s
#27

GPT-5.6 Luna (high)

OpenAI40.1163 tok/s
#28

GPT-5.6 Sol (low)

OpenAI40.061 tok/s
#29

Claude Opus 5 (Adaptive Reasoning, Low Effort)

Anthropic39.852 tok/s
#30

Gemini 3.6 Flash (high)

Google38.7188 tok/s
#31

GPT-5.5 (medium)

OpenAI37.869 tok/s
#32

Muse Spark 1.1 (xhigh)

Meta37.5213 tok/s
#33

Gemini 3.5 Flash (high)

Google37.4168 tok/s
#34

GPT-5.6 Terra (medium)

OpenAI37.0112 tok/s
#35

Kimi K3 (low)

Kimi37.038 tok/s
#36

DeepSeek V4 Pro (Reasoning, Max Effort)

DeepSeek36.463 tok/s
#37

MiniMax-M3

MiniMax35.482 tok/s
#38

GPT-5.6 Sol (Non-reasoning)

OpenAI34.960 tok/s
#39

JT-4.1 Flash 236B A21B

China Mobile34.90 tok/s
#40

Motif 3 (Beta)

Motif Technologies34.90 tok/s
#41

GLM-5.2 (Non-reasoning)

Z AI34.897 tok/s
#42

DeepSeek V4 Pro (Reasoning, High Effort)

DeepSeek34.464 tok/s
#43

Claude Sonnet 5 (Non-reasoning, High Effort)

Anthropic33.762 tok/s
#44

Inkling (xhigh)

Thinking Machines32.381 tok/s
#45

DeepSeek V4 Flash (Reasoning, Max Effort)

DeepSeek31.10 tok/s
#46

GPT-5.6 Luna (medium)

OpenAI31.0151 tok/s
#47

Nex-N2-Pro

Nex AGI31.0129 tok/s
#48

Inkling Small

Thinking Machines30.8136 tok/s
#49

Hy3

Tencent30.765 tok/s
#50

GPT-5.6 Terra (low)

OpenAI30.6106 tok/s