post cover

Simon Willison:Anthropic 发布 Claude Opus 5——前沿智能半价可得,安全能力引发热议(2026-07-25)


本文为翻译/转载,原文使用 CC BY-NC-SA 4.0 协议发布。 原文作者:Simon Willison 原文标题:Introducing Claude Opus 5 原文链接:https://simonwillison.net/2026/Jul/24/introducing-claude-opus-5/ 原文发布:2026-07-24 本博客不参与任何商业变现(含 ads / 付费 / affiliate),本译文遵循 CC BY-NC-SA 4.0 条款发布。

【译者按】

就在今天,Anthropic 正式发布了 Claude Opus 5——一个定位在 Fable 5 之下、Opus 4.8 之上的新模型。Simon Willison 在第一时间撰写了这篇博客点评,核心信息令人瞩目:Opus 5 在 Artificial Analysis 智能排行榜上甚至超过了 Fable 5,定价却与 Opus 4.8 持平,“快模式”也保留了下来。更值得注意的是,Anthropic 在安全方面采取了明确的取舍——模型在漏洞发现能力上大幅提升(接近 Mythos 5 水平),但故意未训练漏洞利用能力。这一策略直接回应了美国政府日益收紧的出口管制压力,也在 HN 上引发了 959 条评论的激烈辩论。对于中文读者,这篇文章的价值在于:它揭示了当前前沿模型安全策略的核心矛盾——越强大,越受限;越受限,越安全?

【正文】

Anthropic 发布 Claude Opus 5

我今天大部分时间都在和海獭一起划皮划艇,所以还没机会好好测试 Anthropic 的新模型 Claude Opus 5。但口碑是积极的——Anthropic 将其描述为”一个深思熟虑且主动的模型,智能水平接近 Claude Fable 5 但价格仅为其一半”,听起来很有希望。目前它已经在 Artificial Analysis 排行榜上领先,甚至超过了 Fable 5。

它的定价与 Opus 4.8 相同,并且继续提供”快模式”(成本为基础模型的两倍)。

基于发布帖中的这个趣闻,它看起来可能具有 relentless proactivity(不达目的不罢休的主动性)的特征:

在 Frontier-Bench 的一项任务中,Opus 5 被给了一张机器零件的图纸,要求编写代码将其重建为 3D FreeCAD 模型。然而,该任务有意不让模型直接查看图纸。Opus 5 的回应是——自己编写了一个计算机视觉管线来从原始像素中提取几何信息,然后完整重建了机器零件。

它在发现漏洞方面更强了,但故意没有被训练如何利用漏洞。希望这意味着美国政府不会把它关停!

与其前代 Opus 4.8 一样,我们有意识地避免在 Opus 5 上训练与网络安全相关的任务。然而,由于模型整体能力的提升,它在这类任务上的表现仍然大幅提高,在发现网络安全漏洞方面已接近 Mythos 5 的水平。然而,在利用这些漏洞方面——即将漏洞转化为实质性网络威胁——它仍然远落后于 Mythos 5。

Anthropic 已经发布了 Claude Opus 5 提示工程指南。Thariq Shihipar 也撰写了《Claude 5 代模型上下文工程的新规则》

【译者注】

  1. Relentless Proactivity:Simon Willison 提出的概念,指 Claude Fable 级别的模型在面对目标时的”不达目的不罢休”特性。之前 Simon 就报道过 Fable 5 在他的笔记本上自主启动 Web 服务器、部署 CORS hack 来调试 CSS 问题的案例。Opus 5 延续了这一特性——在前述 FreeCAD 任务中,模型在没有被明确要求的情况下,自主编写了计算机视觉管线来提取图纸信息。
  2. Mythos 5:Anthropic 最强模型系列,定位在 Opus 之上。根据 Anthropic 的安全报告,Mythos 5 是目前漏洞利用能力最强的模型,因此其使用受到严格限制。
  3. Fast Mode(快模式):Anthropic 推理模型的特殊模式,以更高成本换取更快响应速度。Opus 4.8 引入该模式后广受好评,Opus 5 保留了这一选项。
  4. 安全策略的矛盾:Anthropic 的明确策略是——模型越强,漏洞发现能力越强;但同时刻意不训练利用能力。这种”有能力发现但没能力利用”的组合是否可持续,以及是否会被用户通过 fine-tuning 绕过,是当前安全社区关注的核心问题。
  5. 美国政府的监管压力:Simon 在文中调侃”希望美国政府不会把它关停”,指向美国出口管制政策对前沿模型部署的限制。此前 Anthropic 因合规压力在 Fable 5 中实施了严格的内容政策,引发大规模用户抗议。

【延伸阅读】