Opus 5以微弱优势登顶智能榜,单任务成本比Fable 5低26%

币界网消息,人工智能评测机构Artificial Analysis公布Claude Opus 5成绩,得分61,微弱领先Fable 5的60分。GPT-5.6 SOL得59分,Kimi K3得57分。Opus 5每项任务平均成本为2.03美元,比Fable 5的2.75美元低26%。在gdpval-aa v2和aa-briefcase两项知识工作评测中,Opus 5登顶,搭配Claude Code后并列拿下编程Agent指数第一。Terminal-bench v2.1得分89%,接近GPT-5.6 SOL。Opus 5的幻觉率在aa-omniscience测试中升至50%,比Opus 4.8高14个百分点,低推理档位性价比仍略逊于GPT-5.6系列。
SOL-2.26%
此页面可能包含第三方内容,仅供参考(非陈述/保证),不应被视为 Gate 认可其观点表述,也不得被视为财务或专业建议。详见声明
  • 赞赏
  • 评论
  • 转发
  • 分享
评论
请输入评论内容
请输入评论内容
暂无评论