Claude Opus 5正式发布:智能体级自主性跃升,代码生成更审慎、更可靠,定价维持不变

Claude Opus 5实现智能体级能力跃迁:具备自主视觉建模、深层Bug根因修复、自建测试套件等主动推理能力,规划阶段即识别逻辑缺陷;在自动化任务与安全审计中表现卓越,非对齐行为得分创行业新低;定价维持不变,凸显技术诚意与工程克制。

Anthropic正式推出Claude Opus 5——这是Opus系列自4.5版本以来最具突破性的升级。新模型在自我校验、多步推理与闭环迭代能力上实现质变,展现出接近人类工程师的审慎性与主动性:它不再急于输出代码,而是在编写前深入规划、预判逻辑漏洞,并持续验证直至任务真正达成。

实测表现令人瞩目:在Frontier-Bench中,面对无直接图像接口的机械图纸重建任务,Opus 5自主构建端到端视觉处理管线,从像素级特征提取出发,精准复现3D模型,五次重复全部成功;而竞品模型五次尝试全军覆没。针对开源包管理器中的深层缺陷,它不仅定位根本成因,更修复了社区补丁遗漏的关键边缘场景;相比之下,其他模型仅掩盖表象即宣告完成。某交易公司工程师曾用Opus 5单次会话完成全新交易所数据接入模块开发——在缺乏实时验证环境的情况下,模型主动构建专用测试套件,确保解析逻辑万无一失。

行业领袖评价高度一致:Cognition CEO Scott Wu指出其在Devin平台中根因分析能力远超前代;Zapier CEO Wade Foster证实,Opus 5以零额外Token消耗登顶AutomationBench榜首,完整执行客户健康度分析、风险账户标记、责任人通知及留存报告生成全流程;Lovable联合创始人Fabian Hedin直言这是‘Opus家族迄今最显著的进化’;JetBrains IDE AI负责人Denis Shiryaev则强调其‘规划即验证’的思维范式,标志着解题能力从响应式迈向前瞻性。

安全维度同样严谨:Opus 5延续不参与网络攻防训练的伦理原则,但在漏洞识别能力上已逼近Mythos 5;而在漏洞利用(exploitation)层面仍刻意保持克制,OSS-Fuzz评估显示其相关得分显著低于攻击型模型。自动化行为审计中,Opus 5在非对齐行为指标上仅得2.3分,为当前主流模型最低值。

价格策略保持稳定:输入$5/百万Token、输出$25/百万Token,与Opus 4.8完全一致。开发者可通过API调用claude-opus-5;启用Fast模式后推理速度提升至2.5倍,费用为基准价的2倍。

来源:智东西

AI 前线

Vivix发布VMI实时推理架构:30B级视频扩散模型实现毫秒级流式生成

2026-7-26 16:42:03

AI 前线

菲尔兹奖得主破局AI黑箱:数学前沿如何为表征坍塌等核心难题提供新范式?

2026-7-26 23:17:06

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
购物车
优惠劵
今日签到
有新私信 私信列表
搜索