Anthropic 发布 Claude Opus 5!性能逼近 Fable 5,价格却砍半,成为最新默认模型

知名人工智慧新創 Anthropic 於今(24)日正式发布全新模型 Claude Opus 5。該模型主打「顶級智力、平民价格」,不僅在程式设计与科研評估上創下新紀錄,其成本更只有前沿模型 Fable 5 的一半。Opus 5 即日起將成为 Claude Max 的新预设模型,为大眾帶来更高效的日常 AI 體验。
(前情提要:Anthropic 不再顯示 Claude 思考过程摘要,防止 Fable 5 被蒸餾)
(背景補充:Anthropic 衝刺 IPO!傳強制員工簽「10b5-1 自动卖股」计畫,防 9650 亿美元估值拋售潮)

本文目錄

Toggle

  • 程式与代理能力突破,低成本創最高效能
  • 最具对齐性,彈性放寬網路安全尋洞限制
  • 全新 Fast 模式上線,API 支援自动降級

在人工智慧(AI)模型迭代速度日益狂飆的当下,Anthropic 再度投下震撼彈。台北时间 7 月 24 日,Anthropic 官方宣布正式推出全新模型 Claude Opus 5。这款被定位为「深思熟慮且主动」的新生代模型,在整體智力表现上已逼近該公司最顶尖的前沿模型 Claude Fable 5,但其使用价格卻硬生生砍半,展现出極高的成本效益。

程式与代理能力突破,低成本創最高效能

Opus 5 在多項基準測試中达到了新的业界標準(state-of-the-art)。在软體工程任務方面,它不僅在 Frontier-Bench 測試中超越所有競爭对手,其每任務成本更大幅降低,將前代 Opus 4.8 的表现提升了超过一倍。在知识工作如 Zapier AutomationBench 的商业任務中,同等成本下的通过率是次佳模型的 1.5 倍。

此外,Opus 5 展现了強大的「代理能力(Agentic capabilities)」,能夠自主迭代与验证工作。例如,在未直接查看圖紙的情況下,它能憑藉程式碼建構出完整的 3D 幾何模型,或在單次对話中獨立为真实系统除错並建立验证框架,这些都是早期測試中競爭对手难以达成的成就。

最具对齐性,彈性放寬網路安全尋洞限制

在安全性与对齐(Alignment)方面,Opus 5 寫下了近期模型的最佳紀錄。根據自动化行为審计,其整體未对齐行为分數僅 2.3,不僅比前代 Opus 4.8 甚至 Fable 5 更遵守憲法,欺騙率也降至最低。

針对備受关注的網路安全(Cybersecurity)领域,Anthropic 选擇稍微放寬分類器限制,允許 Opus 5 協助在原始碼中「尋找漏洞」,预期分類器介入频率比 Fable 5 少约 85%。不过,为防止技術遭惡意利用,官方依然嚴格封锁漏洞掃描或漏洞利用(exploit)的生成。

全新 Fast 模式上線,API 支援自动降級

为了让企业与开发者更靈活地部署,Opus 5 即日起已成为 Claude Max 的新预设模型,同时也是 Claude Pro 方案中最強大的选擇。官方更同步推出了「Fast mode(快速模式)」,能以预设速度的 2.5 倍运行,价格則为基礎价格的两倍。

在开发者體验上,Claude Platform 新增了支援对話中途變更工具的功能,且不会使 prompt cache 失效。同时,API 也引进了「自动回退(auto-fallback)」机制,当请求被安全分類器標記时,系统会自动路由至其他模型(如 Opus 4.8),以確保服務流暢不中斷。

查看原文
此页面可能包含第三方内容,仅供参考(非陈述/保证),不应被视为 Gate 认可其观点表述,也不得被视为财务或专业建议。详见声明
  • 赞赏
  • 评论
  • 转发
  • 分享
评论
请输入评论内容
请输入评论内容
暂无评论