公司美股

Anthropic发布Claude Opus 5模型,同步部署AMD Instinct MI450 GPU并获最高50亿美元战略投资

发布:更新:作者:

本文是 24TopNews 对公开财经信息完成重复合并后的事件分析,不是原始采访或证券推荐。

7月25日,Anthropic推出新模型Claude Opus 5,定位更务实:在复杂任务上更少遗漏步骤,主动验证中间结果,兼顾性能与成本,适合日常高频使用。Opus 5成为Claude Max默认模型,也是个人订阅用户可调用的最强模型;能力更高的Fable 5主要面向API与企业客户,个人订阅用户额度有限。Opus 5重点提升编程、知识工作和智能体任务效率,在多项软件工程、商业流程和电脑操作评测中位居前列;在最高思考档位下,部分成绩逼近甚至超过Fable 5。但在高风险场景中,受限的Mythos 5仍更强。Opus 5提供可调节的effort(思考档位),档位越高处理复杂问题能力越强但速度更慢、Token消耗更多。

Opus 5已在全平台上线,API价格为每百万Token输入5美元、输出25美元,与Opus 4.8持平,约为Fable 5的一半。Anthropic上线两项Beta功能:动态调整工具与自动回退,用于降低Agent任务因缓存失效抬升成本、或因安全拦截中断的风险。在Frontier-Bench v0.1测试中,Opus 5超过所有参测模型,成绩相比Opus 4.8提高一倍以上,单项任务成本更低。在CursorBench 3.2测试中,开启max effort后,成绩与Fable 5相差不到0.5%,每项任务成本约为后者一半。在Zapier AutomationBench测试中,按相同单项任务成本计算,Opus 5通过率约为Fable 5的1.5倍。

在OSWorld 2.0测试中,它仅用Fable 5单项任务成本的略多于三分之一,超过后者最好成绩。ARC-AGI 3测试中,Opus 5得到30.2%,此前榜首是GPT-5.6 Sol的7.8%。在Anthropic公布的十余项对比中,Opus 5有四项落后其他模型。第三方榜单方面,截至7月25日,Artificial Analysis智能指数榜单上,Opus 5 max以61分排在第一位,仅高于Fable 5一分。用户反馈方面,正面评价集中在编程和可交互内容生成。代码审查平台CodeRabbit测试结论是Opus 5更适合写代码而非独立承担全部代码审查。独立开发者李默形容Opus 5为“做事靠谱,但略有个性的同事”,调试能力很强,但工作流和提示词需要调整。

Anthropic近期加快模型更新速度:5月29日发布Opus 4.8;6月10日发布Fable 5和Mythos 5;7月1日上线Sonnet 5;7月25日发布Opus 5。7月16日,月之暗面发布开放权重模型Kimi K3。Opus 5发布当天,英伟达、Meta、微软等25家公司联合发表公开信,呼吁美国政府不要过早限制开放权重模型,OpenAI、Anthropic和Google未签署。Anthropic更强调闭源、分级开放和风险控制。6月12日美国政府对Fable 5和Mythos 5实施管制后,Fable 5恢复公开服务,Mythos 5仍只向部分获批机构开放。Opus 5发现源代码漏洞能力接近Mythos 5,将漏洞转化为攻击工具能力较弱。

Opus 5发布前两天,Anthropic宣布将部署最高2吉瓦规模的AMD Instinct MI450系列GPU和Helios机架级系统,首批1吉瓦计划2027年上半年部署。AMD承诺未来向Anthropic进行最高50亿美元战略股权投资。

受影响行业