TOP 1OpenAI Codex
OpenAI Codex:面向自主编码 Agent的行业头部 AI 工具
综合分95.8
在自主编码 Agent的证据综合中,OpenAI Codex 位列 Top 1。Artificial Analysis v1.3 将 DeepSWE 113 项、Terminal-Bench v2 84 项和 SWE-Atlas-QnA 124 项等权合成;Codex GPT-5.6 Sol 得分 67,平均任务时间约 10.2 分钟、API 成本约 US$7.08,但页面提示该 endpoint 的内容安全过滤率上升。
- 使用规模
- 96.0
- 实际结果
- 97.0
- 投入价值
- 92.0
- 可信度
- 96.0
适合
- 自主编码 Agent核心工作流
- 希望优先评估行业头部方案的团队
限制
- 公开证据综合而非 AIUtil 亲自实测
- 67 分带安全过滤提示
- API 单任务成本不等于订阅实际成本
- 未测私有仓库回归和人工返工。
