Skip to content
Go back

Anthropic 放大招:Claude Opus 4.5 今日上线,编程能力登顶,价格狂降 67%

Updated:

Claude Opus 4.5 官方发布

11 月 25 日,Anthropic 推出了 Claude Opus 4.5。这是继 Google Gemini 3 和 OpenAI GPT-5.1 之后,AI 大战中的又一次出牌。

这次发布的策略很明确:性能登顶 + 价格腰斩,两手一起抓。

编程能力:真的是第一

先说数据。

Claude Opus 4.5 在 SWE-bench Verified 测试中拿到了 80.9% 的成绩,超过了 GPT-5.1-Codex-Max(77.9%)、自家 Sonnet 4.5(77.2%)和 Gemini 3 Pro(76.2%)。

这个测试不是让 AI 做编程题,而是去解决 GitHub 上真实存在的软件工程问题。80.9% 意味着在 100 个真实 bug 里,Opus 4.5 能解决 80 个。

更细的数据:在 SWE-bench Multilingual(多语言编程测试)中,Opus 4.5 在 8 种编程语言里拿了 7 个第一。

对开发者来说,这不只是跑分。我自己用 Claude Sonnet 4.5 写过不少自动化脚本,已经觉得够用了。如果 Opus 4.5 在复杂代码重构、多文件联动修改上能更进一步,确实能解决更多实际问题。

价格:67% 的降幅

但真正让人意外的是价格。

Claude Opus 4.5 的 API 定价是 $5(输入)/$25(输出)per million tokens。对比之前的 Opus 4:$15/$75。

直接降了 67%。

这意味着什么?如果你是企业用户,原来每月花 1 万美元调用 Opus 4,现在用 Opus 4.5 只需要 3300 美元,还能拿到更强的性能。

横向对比:这个价格比 GPT-4 Turbo($10/$30)便宜,跟 Gemini 2.0 Flash($0.075/$0.3)没法比,但那是定位完全不同的轻量级模型。

Anthropic 的意图很明显:旗舰模型不再只给少数人用。

三个独特功能:Opus 4.5 不只会写代码

除了编程,Opus 4.5 这次还带来了三个比较特别的功能:

1. Infinite Chats(无限对话)

以前大模型都有上下文长度限制,对话太长就会「失忆」。Opus 4.5 的解法是:自动总结历史对话,然后继续聊。

你不用手动整理聊天记录,也不用担心超过 token 上限。这对需要长时间交互的任务(比如多轮代码调试、长篇内容创作)很有用。

2. Effort 参数

这是 Opus 4.5 独有的功能。你可以通过一个参数,控制模型在回答时投入多少「计算资源」。

简单任务可以设置低 effort,快速响应、省钱;复杂任务设置高 effort,模型会花更多时间思考,给出更准确的答案。

这等于把「速度 vs 质量」的选择权交给了开发者。

3. 电脑操作能力(OSWorld 66.3%)

Opus 4.5 在 OSWorld 测试中拿到了 66.3% 的成绩,这是一个测试 AI 操作真实电脑界面的 benchmark。

具体来说,它能:

Anthropic 还给它加了一个「zoom」功能,可以放大屏幕特定区域,识别小字体或复杂界面。

这对企业用户来说很实用。你可以让 Claude 自动化处理一些重复性的 GUI 操作,比如批量填表、数据录入、跨软件的信息同步。

同步发布的两个新工具

这次发布还带来了两个配套工具:

  1. Claude for Chrome:现在面向所有 Max 用户开放。直接在浏览器里调用 Claude,做网页总结、表单填写等操作。

  2. Claude for Excel:扩大 Beta 测试,Max、Team、Enterprise 用户都能用。在 Excel 里直接调用 AI 分析数据、生成报表。

这两个工具的时机很微妙。它们不是「锦上添花」,而是在说:Opus 4.5 不只给程序员用,它要进入更广的办公场景。

这次发布意味着什么?

AI 大模型的竞争,已经从「比智力」进入「比性价比」阶段。

去年这时候,大家还在讨论谁的模型更聪明、谁的 benchmark 更高。现在?GPT-5.1、Gemini 3、Opus 4.5 在很多任务上已经接近,差距在缩小。

这时候,价格 和 生态 变得更重要。

Anthropic 的打法:

对用户来说,这是好事。竞争越激烈,我们拿到的工具越好用、越便宜。

谁应该第一时间试试?

三类人:

  1. 开发者:尤其是做代码审查、重构、多语言项目的。Opus 4.5 的多语言能力和编程准确率,值得实测。

  2. 企业用户:如果团队在用 Claude API,可以直接切换到 Opus 4.5。成本降 67%,性能还提升。

  3. AI 工具重度用户:Max 订阅用户可以试试 Claude for Chrome 和 infinite chats,看看长对话的体验有没有质的变化。

获取方式:

2025 年底,AI 工具在加速

11 月的 AI 圈有点热闹。Gemini 3、GPT-5.1、Opus 4.5 接连发布,每家都在拿出自己的杀手锏。

但我更关心的是:这些工具最终能不能真正融入工作流,解决实际问题。

跑分很重要,但更重要的是,当你在凌晨改 bug、在会议前赶报表、在多个项目间切换时,AI 能不能帮你省下那 20%~30% 的时间。

Opus 4.5 给出了它的答案。接下来,看实战。


信息来源:


Share this post on:

上一篇文章
Chrome 插件 TabMagnet
下一篇文章
前飞书产品经理:一篇文章教会你用多维表格

留言区

加载留言中…

发表留言

?