Anthropic发布Claude Opus 5,性能对标Fable 5且成本减半

7月25日 08:58
该模型在57天内完成Claude系列全线升级,以每百万Token输入5美元、输出25美元的定价,在软件工程与科学任务中实现接近旗舰的性能表现。

Anthropic公司正式推出新一代人工智能模型Claude Opus 5,旨在通过优化成本结构提供接近其旗舰产品Fable 5的处理能力。此次发布是该公司在57天内对Claude系列四条主要产品线进行升级的关键一环,其中Opus 5与Fable 5的间隔发布时间仅为45天。新模型定位为高性价比方案,试图打破大模型领域“高价即高性能”的传统市场认知,通过密集迭代策略确立技术优势并拓展商业应用场景。

在具体的性能指标与价格参数方面,Opus 5的输入定价为每百万Token 5美元,输出定价为每百万Token 25美元,与上一代Opus 4.8保持一致,而Fable 5的对应价格分别为10美元和50美元。评测数据显示,在Frontier-Bench v0.1软件工程测试中,Opus 5得分较前代提升超过一倍,且任务完成成本降低;在CursorBench 3.2最高档位测试下,其与Fable 5的得分差距不足0.5%,但单次任务成本仅为后者的一半。此外,该模型在ARC-AGI 3测试中得分达到第二名模型的三倍,展现出处理陌生问题的自适应能力;在OSWorld 2.0电脑操作测试中,以约三分之一的成本超越Fable 5的最佳成绩。生命科学领域的专项评测表明,其在有机化学分子结构推断准确率上提升10.2个百分点,蛋白质功能预测精度提高7.7个百分点。

从行业背景来看,此次发布标志着Anthropic在产品策略上的显著调整,即通过提供“准旗舰”性能的中端模型来应对开源模型及性价比竞争。此前该公司已推出Haiku 4.5和Opus 4.5等轻量化或降价版本,而Opus 5进一步将旗舰级能力下放至中端价格带。尽管在部分网络安全漏洞识别任务中表现略逊于Fable 5,但其在多轮对话记忆、跨领域知识迁移及自动化流程(AutomationBench)中的通过率显著优于竞争对手,显示出向企业数字化办公与复杂工程任务深度渗透的意图。

Conflicts detected