Anthropic正式推出Claude Opus 5——这是Opus系列自4.5版本以来最具突破性的升级。新模型在自我校验、多步推理与闭环迭代能力上实现质变,展现出接近人类工程师的审慎性与主动性:它不再急于输出代码,而是在编写前深入规划、预判逻辑漏洞,并持续验证直至任务真正达成。
实测表现令人瞩目:在Frontier-Bench中,面对无直接图像接口的机械图纸重建任务,Opus 5自主构建端到端视觉处理管线,从像素级特征提取出发,精准复现3D模型,五次重复全部成功;而竞品模型五次尝试全军覆没。针对开源包管理器中的深层缺陷,它不仅定位根本成因,更修复了社区补丁遗漏的关键边缘场景;相比之下,其他模型仅掩盖表象即宣告完成。某交易公司工程师曾用Opus 5单次会话完成全新交易所数据接入模块开发——在缺乏实时验证环境的情况下,模型主动构建专用测试套件,确保解析逻辑万无一失。
行业领袖评价高度一致:Cognition CEO Scott Wu指出其在Devin平台中根因分析能力远超前代;Zapier CEO Wade Foster证实,Opus 5以零额外Token消耗登顶AutomationBench榜首,完整执行客户健康度分析、风险账户标记、责任人通知及留存报告生成全流程;Lovable联合创始人Fabian Hedin直言这是‘Opus家族迄今最显著的进化’;JetBrains IDE AI负责人Denis Shiryaev则强调其‘规划即验证’的思维范式,标志着解题能力从响应式迈向前瞻性。
安全维度同样严谨:Opus 5延续不参与网络攻防训练的伦理原则,但在漏洞识别能力上已逼近Mythos 5;而在漏洞利用(exploitation)层面仍刻意保持克制,OSS-Fuzz评估显示其相关得分显著低于攻击型模型。自动化行为审计中,Opus 5在非对齐行为指标上仅得2.3分,为当前主流模型最低值。
价格策略保持稳定:输入$5/百万Token、输出$25/百万Token,与Opus 4.8完全一致。开发者可通过API调用claude-opus-5;启用Fast模式后推理速度提升至2.5倍,费用为基准价的2倍。
来源:智东西
