Claude Opus 5 完整解析:跑分、價格與 Effort 旋鈕實戰

Claude Opus 5 於 2026 年 7 月 24 日正式登場,是 Anthropic 目前定位最高的旗艦模型。它最讓人意外的不是跑分,而是「價格完全沒漲」——每百萬 input token 仍是 5 美元、output 25 美元,與前代 Opus 4.8 一模一樣。本文帶你一次看懂 Claude Opus 5 的跑分數據、價格結構、全新的 Effort 旋鈕,以及台灣使用者最該優先套用的 4 種實戰用法。

Claude Opus 5 是什麼?一句話定位

Claude Opus 5 是 Anthropic 在 Opus 產品線上的世代交替之作,官方形容它是「Opus 等級的一次階躍式改進(a step change improvement)」。相較於過去世代著重「講得更好」,這一代的重心明顯放在代理式工作(agentic work):它會自己驗證結果、發現錯誤後回頭修正,然後反覆迭代直到任務真的完成。

發表當天,Claude Opus 5 就同步上線到四個入口:Claude.ai 網頁與 App、Anthropic API、終端機工具 Claude Code,以及主打一般上班族的 Claude Cowork。換句話說,你不需要等待、也不必額外申請權限,訂閱方案內就能直接切換使用。

Claude Opus 5 跑分數據:哪些數字真的有意義?

官方公布的 Claude Opus 5 跑分相當密集,但對實務工作者而言,真正值得記住的是這幾項:

  • SWE-bench:96%——軟體工程實戰題庫的頂尖成績,代表它能真的把 bug 修好,而不只是產出看起來合理的程式碼。
  • Frontier-Bench v0.1:超越所有同期競品,且分數約為 Opus 4.8 的兩倍,成本卻更低。
  • CursorBench 3.2:與 Fable 5 的最高分差距在 0.5% 以內,但價格只有一半。
  • ARC-AGI 3:分數約為次佳模型的 3 倍,這是抽象推理與泛化能力的重要指標。
  • OSWorld 2.0:電腦操作(computer use)表現優於 Fable 5,成本僅約三分之一。
  • Zapier AutomationBench:自動化流程通過率為次佳模型的 1.5 倍。

科學與專業領域的進步幅度

除了寫程式,Claude Opus 5 在專業學科上的提升也相當具體:有機化學題目正確率較前代高出 10.2 個百分點,蛋白質序列預測則提升 7.7 個百分點。對需要處理研究文獻、實驗設計或技術白皮書的使用者來說,這比通用聊天品質的提升更有感。

另一個容易被忽略的升級是視覺化輸出能力。Opus 5 產出複雜圖表、互動式網頁與資料儀表板的成功率明顯提高,這對做簡報、寫報告的行銷與企劃人員特別實用。

Claude Opus 5 價格:為什麼「沒漲價」才是重點

Claude Opus 5 價格維持在 API 每百萬 input token 5 美元、每百萬 output token 25 美元,與 Opus 4.8 完全相同。在能力翻倍的前提下維持原價,實質上等同於單位智慧成本直接砍半。

另外還多了一個 Fast mode(快速模式):以 2 倍價格換取約 2.5 倍的執行速度。它適合的情境很明確——當你在等 AI 回覆才能繼續下一步(例如即時客服、互動式除錯)時,時間成本遠高於 token 成本;反之,批次處理、夜間跑的長任務就沒必要開。

項目Claude Opus 5
發表日期2026 年 7 月 24 日
Input 價格US$5 / 百萬 tokens
Output 價格US$25 / 百萬 tokens
Fast mode2 倍價格、約 2.5 倍速度
脈絡視窗1M tokens
可用平台Claude.ai/API/Claude Code/Claude Cowork

Effort 旋鈕怎麼用?這是本次最實用的新功能

如果只能記住 Claude Opus 5 的一項新設計,那就是 Effort 旋鈕(努力程度控制)。它讓你自己決定模型「要想多久、想多深」:調高,模型會花更多推理步驟反覆驗證;調低,它就直接給出簡潔答案。

這個設計的價值在於把成本控制權交回使用者手上。實測案例中,一家法律 AI 公司在調低 effort 後,token 消耗減少約 26%,輸出品質仍相當於 Opus 4.8 全力推理的水準;另一組金融建模團隊則回報工具呼叫次數減少 33%、整體耗時縮短約 60%

Effort 等級的實務對照建議

  • 低 effort:翻譯、改寫、摘要、格式轉換、簡單問答。
  • 中 effort:撰寫部落格文章、整理會議紀錄、一般程式碼修改。
  • 高 effort:跨檔案重構、複雜資料分析、需要多步驟驗證的研究任務。

對訂閱制使用者而言,這等於是額度管理工具:同樣的月配額,可以拿來跑十次高強度深度任務,也可以拆成五十次輕量快問快答。先想清楚任務性質再轉旋鈕,是 Opus 5 時代最值得養成的新習慣。

Claude Opus 5 怎麼用?4 個台灣使用者最有感的場景

  1. 長文件一次讀完:1M tokens 的脈絡視窗,足以塞進整份年報、完整判決書或數十份會議紀錄,不必再手動切段落。
  2. 交給它跑完整任務,而不是問一句答一句:Opus 5 會自我驗證與修正,適合下達「把這個專案的測試全部修到通過」這類目標型指令。
  3. 用 Claude Cowork 處理檔案雜務:整理雲端硬碟、批次改檔名、把 Excel 轉成簡報,這些不需寫程式的自動化最能體現代理能力。
  4. 做互動式圖表與網頁原型:視覺化輸出能力提升後,行銷與企劃可以直接請它產出可互動的 HTML 儀表板。

安全性與使用限制:先知道這幾件事

在對齊測試中,Claude Opus 5 取得近期模型中最低的失準行為分數(2.3),代表它較不容易出現偏離指令或投機取巧的行為。資安防護方面,官方也表示新的分類器介入次數較 Fable 5 減少約 85%,誤攔正常請求的情況明顯下降。

不過仍有幾點務必留意:第一,Opus 5 在原始速度上並不算快(約每秒 53 tokens),追求即時回應請搭配 Fast mode 評估。第二,官方尚未公開知識截止日期,涉及時事的內容仍應搭配網頁搜尋驗證。第三,跑分是實驗室環境下的結果,導入前務必用自己的真實任務做小規模 A/B 測試,再決定是否全面轉換。

常見問題 FAQ

Q:Claude Opus 5 何時推出?
A:Anthropic 於 2026 年 7 月 24 日正式發表 Claude Opus 5,並同步上線 Claude.ai、API、Claude Code 與 Claude Cowork。

Q:Claude Opus 5 價格比前一代貴嗎?
A:不貴。Claude Opus 5 價格維持每百萬 input token 5 美元、output 25 美元,與 Opus 4.8 完全相同,僅 Fast mode 為 2 倍計價。

Q:Effort 旋鈕是什麼?一定要調嗎?
A:Effort 旋鈕用來控制模型的推理深度與速度。不調也能用,但調低可省下約 26% token,調高則適合複雜多步驟任務。

Q:Claude Opus 5 的脈絡視窗多大?
A:官方文件標示為 1M tokens,足以一次處理整份長篇報告、程式碼庫或大量會議紀錄。

Q:不會寫程式也能用 Claude Opus 5 嗎?
A:可以。透過 Claude Cowork 或 Claude.ai 介面即可使用,不需任何程式基礎就能完成檔案整理與文件自動化。

結語:先轉旋鈕,再談換模型

Claude Opus 5 真正改變的,不只是跑分排行榜上的名次,而是「你能用同樣的錢做多少事」。SWE-bench 96%、1M 脈絡視窗與價格不變,讓它成為目前 CP 值最高的旗艦選項之一;而 Effort 旋鈕則把成本主導權交還給使用者。

今天就打開你手邊最花時間的一項工作,用低 effort 跑一次、再用高 effort 跑一次,親自比較差異。想更有系統地把 Claude 導入日常工作流嗎?歡迎追蹤星方向 AI 學院,我們持續更新 Claude 實戰教學與最新功能解析,帶你把 AI 真正變成生產力。

發表迴響

探索更多來自 星方向 AI 學院 - 部落格 的內容

立即訂閱即可持續閱讀,還能取得所有封存文章。

繼續閱讀