首页
学习
活动
专区
圈层
工具
发布

Anthropic 推出 Claude Opus 5:重塑商用大模型性价比标尺

当地时间 7 月 24 日,Anthropic 正式推出新一代旗舰级模型Claude Opus 5。这款模型最受行业关注的特点在于,综合智能水平接近定位更高的 Claude Fable 5,调用成本仅为后者一半,主打面向开发者、企业高频业务场景落地。目前 Opus 5 已经成为 Claude Max 默认运行模型,同时也是 Claude Pro 订阅用户可使用的最强模型。

Claude系列模型性能对比表

在专业评测层面,Opus 5 刷新多项行业基准纪录。面向软件工程的 Frontier-Bench、面向复杂知识工作的 GDPval-AA 两项测试中,模型表现位居第一梯队;尤其在智能体编程任务上,相比前代 Opus 4.8 实现性能翻倍。在 CursorBench 测试最高推理档位下,Opus 5 成绩与 Fable 5 峰值水平仅相差 0.5%,却能够以一半成本完成同等任务量。

从场景落地能力来看,Claude Opus 5 优势集中在三大方向:编程开发、商业自动化、计算机自主操作。在代码场景,模型支持多文件项目重构、代码调试、自动化测试脚本生成,适合软件开发团队用于辅助项目迭代;商业自动化方向,能够完成多步骤业务流程串联、数据整理、报表生成、跨平台工具调用;计算机操作能力适配智能体持续操控桌面程序、网页操作等长流程任务,适合企业搭建各类自动化数字员工。

编程任务性能-成本曲线

为适配不同业务需求,Opus 5 新增可调的Effort(推理强度)档位。使用者可以自由权衡速度、成本与推理深度:低档位追求快速响应、节省 Token;最高档位开启深度思考与自主结果校验,应对高复杂度专业任务。即便最低档位,综合能力依旧全面超越上一代 Opus 4.8,给予企业更加灵活的算力预算选择空间。

定价策略是本次发布极具行业信号意义的一环。Opus 5 延续 Opus 4.8 原有定价(输入 5 美元 / 百万 Token,输出 25 美元 / 百万 Token),相比 Fable 5(输入 10 美元 / 百万 Token,输出 50 美元 / 百万 Token)成本直接减半。这一定位清晰区分产品线:Fable 5 面向极少数超长周期、超高难度前沿实验任务;Opus 5 作为日常主力机型,承接绝大多数企业常态化 AI 开发、自动化、知识处理需求。

放在当前行业环境观察,Opus 5 的发布是闭源头部厂商应对市场变化的关键布局。伴随开源模型持续迭代、各类垂直领域小模型快速普及,企业客户越来越重视单位成本对应的实际产出,不再一味追求单纯的 “参数天花板”。“接近旗舰性能、中端定价” 的产品思路,恰好击中大量开发团队、中小企业的真实痛点,降低复杂智能体、AI 应用规模化部署的资金门槛。

当然,性能均衡不代表全场景通吃。官方测评同时提到,在网络安全相关专项任务上,Opus 5 表现仍弱于 Mythos 5;面对极限超长时序、持续数小时的复杂智能体任务,顶级旗舰 Fable 5 依旧保有独特优势,企业选型仍需要结合自身业务场景综合判断。

长期来看,Claude Opus 5 进一步拉高商用通用大模型的性价比标准。对于开发者、AI 应用创业者而言,更低成本的高阶模型意味着可以尝试更多复杂智能体项目;对于行业整体趋势,本次更新也预示竞争重心正在从单纯跑分比拼,转向真实场景效能、单位成本产出的全方位较量。

随着大模型不断迭代,AI 应用开发、智能体搭建、业务自动化相关岗位需求持续扩张。掌握主流大模型的选型、提示词工程、智能体工作流搭建,已经成为技术人才必备能力。持续跟进 Claude、Gemini 等主流模型更新,理解不同模型能力边界与成本差异,能够帮助从业者更好完成项目落地。

  • 发表于:
  • 原文链接https://page.om.qq.com/page/O7nvu1XzbTz3aQJ8DaFJIPNg0
  • 腾讯「腾讯云开发者社区」是腾讯内容开放平台帐号(企鹅号)传播渠道之一,根据《腾讯内容开放平台服务协议》转载发布内容。
  • 如有侵权,请联系 cloudcommunity@tencent.com 删除。
领券