欢迎您访问欢迎来到沄森网,沄森智能旗下资讯平台!今天是:2026年07月25日 星期六 农历:丙午(马)年-六月-十二
您现在的位置是:首页 > 热点

Claude Opus 5:智能打折,危险上锁

创始人2026-07-25 11:26:48
Anthropic 正式发布了 Claude Opus 5,全平台同步上线

Anthropic 正式发布了 Claude Opus 5,全平台同步上线。发布前三个小时内,X 上传播最快的不是它的跑分,而是一个「AGI moment」导致的 AI 生图错误:官方对比表里,FrontierCode v1.1 那一行把 Opus 5 的 53.4% 加粗高亮成了最优,旁边一格却写着 53.5%。眼尖的开发者第一时间截图传开。乌龙传得快,因为 Anthropic 这次给新模型定的核心卖点是「会自己核对工作」。不过玩笑归玩笑,Opus 5 和自家旗舰 Fable 5 的差距已经小到连制图的人都会搞错谁赢了,而它的价签只有前者的一半。

Claude Opus

Opus 5 的定价和前代 Opus 4.8 一致:每百万 token 输入 5 美元、输出 25 美元,作为参照,Fable 5 是 10 美元和 50 美元。成绩单显示,在软件工程基准 Frontier-Bench 上,它超过所有模型,成绩比 Opus 4.8 翻了一倍还多,单任务成本反而更低。在解新题的 ARC-AGI 3 上,得分是第二名的三倍。模拟电脑操作的 OSWorld 2.0 上,它花大约三分之一的成本,超过了 Fable 5 的最好成绩。Cursor 公布的最新榜单上,Fable 5 开到 Max 档跑出 70.5%,每任务 17.32 美元;Opus 5 同档 70.0%,每任务 8.23 美元。落后半个百分点,价格不到一半,token 用量还少了 40%。低一档更能说明问题,Opus 5 的 Extra High 全面超过 Fable 5 同档,每任务还便宜 4 美元。不开到顶配的话,便宜的反而是更强的那个。产品端的待遇也说明定位:Claude Max 订阅的默认模型换成了它,Pro 用户能摸到的最强模型也是它。想更快,还有 2.5 倍速的 Fast 模式,价格翻倍。

Claude Opus 5:智能打折,危险上锁

发布本身没什么悬念。7 月 9 日,一个叫「Honeycomb」的陌生代号在 Cursor 的模型列表里一闪而过,几小时后被撤下。当时社区认出它的关键线索,是它的回退链指向 Opus 4.8。现在回头看,那条回退链不只是泄露的破绽,它就是这套产品逻辑的入口。

Claude Opus 5:智能打折,危险上锁

Opus 5 把 Fable 5 逼平了,后者还卖给谁——答案藏在发布博客的安全章节里。官方的说法是,Opus 5「没有推进高风险两用能力的前沿」:生物研究和攻击性网络任务,它都明确落后于 Mythos 5。这不是没做到,是没打算做到——Anthropic 延续上一代的做法,刻意没在网络攻击类任务上训练它。效果体现在一个叫 OSS-Fuzz 的内部测试里:找漏洞,Opus 5 的成绩已经接近 Mythos 5;但把漏洞写成可用的攻击代码,它被远远甩在后面。它看得见漏洞,却被刻意教得不会把漏洞变成武器。模型本身「不危险」,护栏反而可以松。官方预计,Opus 5 安全分类器的拦截频率会比 Fable 5 低 85% 左右。被分类器拦下的请求,不再收到一句冷冰冰的拒绝,而是自动回退给 Opus 4.8 接着干活。生物类请求在 Fable 5 上被拦的,现在改道给 Opus 5。API 上还同步开了「自动回退」测试版——请求永远落在一个可用的模型上。安全不再是聊天框里一句「我帮不了你」,而是被做进了架构:训练时少教一点,运行时就能少拦一点,真拦下来也不是死路,是改道。数据政策是另一条分界线。Fable 5 上线时带着 30 天数据保留要求、没有零保留选项,不少企业客户为此犹豫;Opus 5 延续 Opus 系的老规矩,普通接入不要求保留数据。把这些放在一起看,Anthropic 产品线的分层逻辑已经变了。过去 Haiku、Sonnet、Opus 是按聪明程度排队;现在 Opus 5 和 Mythos 5 之间隔着的不是智商,是风险与合规。

Claude Opus 5:智能打折,危险上锁

发布博客里篇幅最大的部分,其实不是跑分,是 Anthropic 官方测试的行为案例。最典型的一个:测试给了 Opus 5 一张机械零件图纸,要求用代码重建三维模型——但故意不给它「看图」的能力。它自己写了一条计算机视觉流水线,从原始像素里把几何结构抠出来,再完成建模。同样条件下,没有一个对手模型在五次尝试内做出来。一位参与早期测试的工程师提到的细节也被 Anthropic 放进了发布博客:他坚持推自己的设计方案,模型没有顺从,而是把反对意见收窄到一个具体的设计问题,再给出一个保留他想法优点的折中方案。Cursor 联合创始人 Sualeh Asif 的总结可能更直白一点:接近 Fable 5 的智能,Opus 的速度和成本。配上内部行为审计「历代最低」的不良行为得分(2.3 分),Anthropic 想卖的东西已经很清楚:agent 时代,模型比拼的正在从「有多聪明」,挪向「敢不敢放手让它干」。但到目前为止,大多数还是之前参与内测的厂商口径,跑分图画得再好看,都不及普通用户的真实体验,因此真实成色还是要等接下来几周,开发者用工作流投票。何况那张图本身就是 AI 翻的车,已经先让全球网友帮着核对过一回了。Fable 5 发布还不到两个月,位置已经被自家兄弟顶得有些尴尬。但 Anthropic 大概很乐意接受这种尴尬局面的出现:当模型真的被放进工作流,「能被信任的那一个」,可能比「最强的那一个」更值钱。

Claude Opus 5:智能打折,危险上锁

Claude Opus 5:智能打折,危险上锁

所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。

举报邮箱:1002263188@qq.com

相关标签:ClaudeOpus