Anthropic 推出 Opus 5:企業 AI 成本大幅降低,效能媲美頂級模型

上周五,Anthropic 正式發布了其最新的 AI 模型 Claude Opus 5,這款模型以其一半的成本,提供了接近頂級模型 Claude Fable 5 的前沿智慧。在企業面臨 AI 代幣成本日益高漲的背景下,Opus 5 的推出無疑是一大福音。

性能躍升,成本下降

根據 Anthropic 的數據,Opus 5 在與前代 Opus 4.8 相同的成本基礎上,實現了跨越式的效能提升。這使得 Opus 5 成為了 Claude 平台的新預設模型,並且在 Claude Pro 方案中,成為性價比最高的選擇。Opus 5 的定價策略大幅降低了開發者的使用門檻,並與市場上的其他競爭產品形成了激烈的競爭。

具體來說,Claude Fable 5 的成本為輸入 10 美元/輸出 50 美元,而 Opus 5 則降至輸入 5 美元/輸出 25 美元。然而,評估模型成本不能只看單價,根據人工分析的智力指數任務加權平均成本,完成同一項任務的實際花費依次為 Fable 5(2.75 美元)、Opus 5(2.03 美元)、GPT-5.6 Sol(1.04 美元)和 Kimi K3(0.95 美元)。

多項評測展現驚人實力

Opus 5 被設計為一款能夠勝任日常複雜知識工作和軟體工程的模型,在多項權威評測中展現了驚人的實力。例如,在軟件工程(Frontier-Bench v0.1)測試中,Opus 5 的效能是前代 Opus 4.8 的兩倍以上,且單次任務成本更低。

此外,Opus 5 在問題解決(ARC-AGI 3)測試中,面對未見過的新問題,其得分是次佳模型的三倍。在商業自動化(Zapier AutomationBench)測試中,Opus 5 的端到端完成任務通過率是同等成本下次佳模型的 1.5 倍。而在電腦操作(OSWorld 2.0)測試中,Opus 5 在相同成本下超越了所有模型,甚至突破了 Fable 5 的最佳成績。

底層邏輯調整,提升效率

隨著模型能力的進化,Anthropic 調整了 Opus 5 的底層邏輯。工程師 Thariq Shihipar 指出,官方在最新版本中刪除了高達 80% 的 Claude Code 系統提示詞(System Prompts),並建議開發者使用 claude doctor 指令來自動優化現有的提示詞。

然而,企業用戶需要特別注意成本陷阱。Opus 5 預設的回應較前代更加冗長,由於輸出代幣的價格(25 美元)遠高於輸入(5 美元),過於囉嗦的回應會直接拉高使用成本。因此,官方強烈建議,若不需要長篇大論,用戶必須在提示詞中「明確限制回應長度」。

從產業面來看,Opus 5 的推出不僅大幅降低了企業的 AI 使用成本,還提高了模型的性價比和實用性。這將促使更多企業採用 AI 技術,加速數字化轉型的進程。同時,Anthropic 也通過不斷的技術創新,鞏固了其在 AI 領域的領導地位。

安全性和自動備援機制

在安全性與對齊度(Alignment)方面,Opus 5 是 Anthropic 迄今最安全的模型。它在网络安全与生物学任务的表现中呈现出精准的“防护区隔”。在 OSS-Fuzz 开源漏洞测试中,Opus 5 的发现率高达 80%,与主攻资安的 Mythos 5(79.4%)旗鼓相当。

虽然会找漏洞,但 Opus 5 将漏洞“武器化”的能力被严格限制(成功率仅 4/14),远低于 Mythos 5(13/14),并会阻挡二进制漏洞扫描与渗透测试生成。

为了解决过去模型因安全机制“过度拒绝”而导致开发中断的痛点,Anthropic 本次在 API 上推出了“自动备援(Auto-fallback)”功能。当用户的请求被判定对 Opus 5 或 Fable 5 来说过于敏感而触发安全分类器时,系统不会直接封锁,而是自动将请求降级,以确保工作流不会中断。

展望與影響

Claude Opus 5 的推出,不僅為企業帶來了更具成本效益的 AI 解決方案,也推動了整個 AI 行業的技術進步。隨著更多企業採用 Opus 5,預期將會加速 AI 技術的普及和應用,進一步促進數字化轉型。

對於開發者而言,Opus 5 的高效能和低成本,使其成為理想的開發工具。建議企業在導入 AI 技術時,考慮 Opus 5 的優勢,並結合自身的業務需求,進行合理的選擇。

本文改寫整理自公開新聞來源,原始報導由科技新報發布。

常見問題 FAQ

Opus 5 和 Fable 5 的主要差別是什麼?

Opus 5 的主要差別是其成本大幅降低,輸入 5 美元/輸出 25 美元,而 Fable 5 的成本為輸入 10 美元/輸出 50 美元。Opus 5 在多項評測中表現出色,效能接近 Fable 5。

Opus 5 的安全性如何?

Opus 5 是 Anthropic 迄今最安全的模型,其在網絡安全和生物學任務中表現出精準的“防護區隔”。在 OSS-Fuzz 開源漏洞測試中,Opus 5 的發現率高達 80%。

Opus 5 是否支持快速模式?

是的,Opus 5 支援預設速度 2.5 倍的“快速模式”,API 開發者可以在對話中途直接更改工具,而不會使提示快取失效。

※ 此篇文章由 AI 改寫或生成,內容僅供參考,可能存在錯誤或不準確之處。