Newsroom
AIEII

Claude Opus 5 发布:Anthropic 一边冲 IPO,一边表态开放权重

Anthropic 正式推出新一代旗舰 Claude Opus 5,同期官方发布开放权重模型立场声明。在 IPO 倒计时的节点上,这家最强调安全的实验室为什么要谈开源,本文拆解发布节奏、能力信号与商业算盘。

2026年08月10日

Claude Opus 5 发布:Anthropic 一边冲 IPO,一边表态开放权重

96%。这是第三方跑分站点汇总的 Claude Opus 5 在 SWE-bench Verified 上的成绩,比上一代 Opus 4.8 的 88.6% 高出近 8 个百分点。

定价却没有变:每百万输入 token 5 美元,每百万输出 token 25 美元,和 Opus 4.8 完全一致。

三天后,Anthropic CEO Dario Amodei 发了一篇立场声明,标题是《我们对开放权重模型的立场》。一家把安全挂在嘴边最久的公司,选在旗舰模型刚发完、IPO 路演窗口打开的节骨眼上谈开源,这个时间点不像巧合。


一、Opus 5 到底强在哪

Opus 5 于 2026 年 7 月 24 日发布,模型 ID claude-opus-5,现在是 Claude Max 的默认模型,也是 Claude Pro 里最强的选项。Anthropic 官方发布页给出的说法是:这是一个"能接近前沿智能、但价格只要一半"的模型,暗指对标的是自家更贵的旗舰 Fable 5。

官方公布的跑分没有把 SWE-bench 放在标题位置,反而主推几个新基准:

基准Opus 5 表现对比对象
Frontier-Bench v0.1超越所有竞争模型是 Opus 4.8 的两倍多
ARC-AGI-3断层领先是次优模型的三倍
CursorBench 3.2(最高努力设置)逼近旗舰与 Fable 5 相差仅 0.5%
Zapier AutomationBench通过率明显领先约为次优模型的 1.5 倍
OSWorld 2.0超越所有竞争模型
GDPval-AA v2最佳表现

Anthropic 在发布文案里写道,Opus 5 “更擅长核查自己的工作,并且能耐心迭代直到成功”,同时是安全对齐评估里"迄今为止最对齐的模型"。

SWE-bench Verified 的 96%(对比 Opus 4.8 的 88.6%)来自 morphllm.com、claude5.ai 等第三方跑分聚合站,不是 Anthropic 官方发布页的头条数字。这个反差本身值得注意,有评测博客的标题直接叫"Anthropic 没有拿出来讲的那些数字"。合理猜测是:SWE-bench Verified 这类经典基准已经卷到接近满分,区分度不够,Anthropic 更想用 Frontier-Bench、ARC-AGI-3 这类新指标讲一个"断层领先"的故事。

其他硬指标:

  • 上下文窗口 1M token,标准 API 价格内包含,没有长上下文附加费
  • 最大输出 128,000 token
  • 对标模型除了 Opus 4.8,还有 Sonnet 5(性价比款)和 Mythos 5(网络安全专用)
curl https://api.anthropic.com/v1/messages \
  -H "x-api-key: $ANTHROPIC_API_KEY" \
  -H "anthropic-version: 2026-07-24" \
  -d '{
    "model": "claude-opus-5",
    "max_tokens": 4096,
    "messages": [{"role": "user", "content": "..."}]
  }'

一句话概括:Opus 5 不是"最强模型"(那个位置还是 Fable 5),而是"最强性价比旗舰",价格锁死在上一代水平,把差距做在能力上。


二、开放权重声明说了什么,没说什么

7 月 27 日,也就是 Opus 5 发布三天后,Amodei 在 anthropic.com/news/position-open-weights-models 发文,明确表态:

“To summarize my and Anthropic’s position, we have not and are not advocating for a ban on open-weights models as a category."(我们从未主张、现在也不主张全面禁止开放权重模型这个类别。)

背景是英伟达创始人黄仁勋当周牵头发了一封公开信,联合 Hugging Face、Meta、Microsoft、Mistral 等公司,呼吁政策制定者不要对开放权重 AI 施加"过早的限制”。Anthropic 不在这份联署名单上,所以外界普遍把 Amodei 这篇文章解读为对这封信的直接回应。

声明的核心主张分三层:

层面表态
开放权重本身没有危险能力的开放权重模型是"公共利益",不主张按类别禁止
真正该管的把先进芯片挡在威权政权手里,打击工业级模型蒸馏
安全测试所有"足够强"的模型,无论开放还是闭源,都应强制安全测试

值得注意的是声明没说的部分:全文没有一句提到 Anthropic 自己会不会发布开放权重模型。文章通篇在讲"别人的开源该不该管",不涉及"我们自己要不要开源"。Amodei 表达的担忧焦点也很明确,是"威权政权用蒸馏拿到能力相当但更便宜的模型",矛头基本对着中国的开源大模型生态。

三、为什么是现在:IPO 前的叙事管理

把三件事按时间线摆在一起看:

  • 2026-06-01:Anthropic 向 SEC 秘密递交 IPO 文件
  • 2026-07-24:Claude Opus 5 发布
  • 2026-07-27:开放权重立场声明发布
  • 2026-08 至 09:机构路演窗口(目标 10 月纳斯达克上市)

据报道,此次发行由高盛、摩根大通、摩根士丹利主承销,目标募资规模超过 600 亿美元,公司估值锚定在 2026 年 5 月 H-1 轮的 9650 亿美元,年化营收(截至 2026 年 4 月)约 300 亿美元。路演阶段正好落在 Opus 5 发布和开放权重表态之后的一到两个月。

这个节奏对一家准备上市的公司来说不是随便安排的:

  • Opus 5 负责证明"技术还在领先"。IPO 招股故事的核心支撑是"我们的模型比对手强、还能持续领先",跑分数字直接服务于这条叙事线。
  • 开放权重声明负责回应"闭源是不是路线错误"的质疑。行业里 Meta、Mistral 都在打开源牌,英伟达带头呼吁监管不要管太严,如果 Anthropic 完全沉默,容易被解读成"既要安全又要垄断"。Amodei 站出来说"我们不反对开源,我们反对的是没有安全测试的强模型",等于把公司立场从"反开源"重新定义成"重安全",这是一个更容易被投资人和监管者接受的叙事。
  • 两件事都不涉及财务承诺,不会在静默期前触发额外的信息披露风险,却都能被媒体和分析师引用进 IPO 报道里。

一家公司在递交 IPO 文件后的头两个月里做的每一次公开发声,本质上都是给招股书做注脚。技术发布证明增长, 政策声明证明合规,两者合在一起讲的是同一个故事:我们又强又安全,值这个估值。

四、对开发者的实际影响

如果你已经在用 Opus 4.8,迁移到 Opus 5 的决策其实不复杂,因为价格没变,成本模型不需要重新算。

维度Opus 4.8Opus 5
输入价格$5 / M tokens$5 / M tokens(不变)
输出价格$25 / M tokens$25 / M tokens(不变)
上下文窗口1M(部分场景需附加费)1M(标准价格内含)
最大输出更低128,000 tokens
SWE-bench Verified88.6%约 96%(第三方汇总)

什么时候该换:

  • 重度代码/Agent 场景:Frontier-Bench 和 SWE-bench 的提升幅度都不小,尤其是需要模型"自己核查、自己迭代"的长任务流程,Opus 5 的收益最直接。
  • 长文档/大代码库分析:1M 上下文不再额外收费,之前因为长上下文费用绕开 Opus 系列的场景,现在值得重新评估。
  • 纯问答、轻量任务:Sonnet 5 的性价比仍然更高,没必要为了跑分升级到 Opus 5。
  • 需要绝对最强能力:Fable 5 依然是 Anthropic 目前的性能天花板,Opus 5 只是"逼近"而不是"超过"它。

迁移成本主要在验证阶段:如果你的 pipeline 里有基于 Opus 4.8 输出格式做的下游解析,建议先在测试环境跑一轮回归,而不是直接切生产环境的 model 参数。价格不变降低了"用了发现不划算"的下行风险,这也是这次升级相比同行动辄涨价 20% 到 30% 的发布,比较少见的一点。


写在最后

Opus 5 本身是一次扎实的迭代,跑分提升可信,定价克制。真正值得记住的是它和开放权重声明之间的时间关系:三天间隔,一个证明技术领先,一个回应路线质疑,都发生在 IPO 静默期前后最需要塑造公众叙事的窗口。等到 10 月真正敲钟,这两件事大概率都会出现在招股书引用的新闻稿列表里。

参考资料

广告合作联系
立即联系 →
加入会员申请
了解详情 →
← OpenAI 拟向美政府出让 5% 股权:这笔交易换来了什么 … AI 周刊 #26:DeepSeek V4 Flash 静默 … →
💬 Comments
6 min read