Claude Opus 5 在智能基准中以 61 分的成绩领先,成本比 Fable 5 低 26%

根据 Artificial Analysis 最新基准测试,Claude Opus 5 在智能指数中取得 61 分,险胜 Fable 5 的 60 分。GPT-5.6 Sol 得分为 59,Kimi K3 得分为 57。

Opus 5 的平均每任务成本为 2.03 美元,比 Fable 5 的 2.75 美元低 26%。该模型在 GDPval-AA v2 以及 AA-Briefcase 知识工作测试中表现第一,并在与 Claude Code 配对时位列编程 Agent 指数第一。它在 Terminal-Bench v2.1 上取得 89%,几乎与 GPT-5.6 Sol 持平。

免责声明:本页面信息可能来自第三方,仅供参考,不代表 Gate 的观点或意见,亦不构成任何财务、投资或法律建议。数字资产交易风险较高,请勿仅依赖本页面信息作出决策。具体内容详见声明
评论
0/400
暂无评论