Claude Opus 5
Anthropic的旗艦Opus模型,2026年7月24日發布——用Claude Fable 5一半的價格提供接近前沿的智能,思考預設開啟,effort從low到max全檔可調。
1M tokens · Text / Vision / Code · Prompt cache
Claude Opus 5是Anthropic當前的旗艦Opus模型,2026年7月24日發布,接替Opus 4.8。它用一半的價格逼近Claude Fable 5的前沿智能,而在幾項程式設計和知識工作評測上——比如Frontier-Bench v0.1和GDPval-AA v2——它直接領先Fable 5。定價與Opus 4.8一致,每100萬token輸入$5、輸出$25,所以對已經跑在Opus檔上的智能體來說,它是可以直接替換的升級。
Claude Opus 5是什麼?
2026年7月24日發布 · Anthropic的旗艦Opus檔——絕對能力上限低於Fable 5,但在多項智能體和知識工作評測上反超,token價格只有一半。在Okou上,它是高難度智能體工作的預設選擇。
Anthropic於2026年7月24日在Claude API、Claude應用、Amazon Bedrock、Google Cloud和Microsoft Foundry上發布了Claude Opus 5;Okou在2026年7月25日把它加入內建模型。它以完全相同的價格接替Opus 4.8,Frontier-Bench v0.1成績大約翻了一倍,這也是核心賣點:同樣的單token成本,換來明顯更強的能力。
它的定位是智能體程式設計和企業知識工作的主力——多檔案功能開發、較大規模重構、長時間自主執行、端到端交付——而不是絕對的能力天花板。在更難的SWE-bench Pro題集和事實廣度上,Fable 5仍然領先;Opus 5贏在單次完成任務的成本,而當智能體流量漲起來之後,帳單上體現的正是這個數字。
相對Opus 4.8有兩處API行為變化。一是思考預設開啟,什麼都不配置的請求現在也會先推理再作答,而關閉思考只在effort為high或更低時才被允許。二是可快取提示詞的最低長度降到512個token,過去快取不了的短系統提示詞現在可以快取了。Opus 5還配備了更強的網路安全防護,屬於禁止或高風險領域的請求可能會收到拒答。
Claude Opus 5有什麼特別之處
架構與能力上的主要亮點。
Opus 5擁有100萬token的上下文視窗——最大值同時也是預設值——輸出最多128K token,知識截止到2026年5月。思考預設開啟,推理深度透過effort等級low、medium、high、xhigh、max設定;原始思維鏈從不暴露,只給出可讀的摘要。不支援助手訊息預填充,取樣參數(temperature、top_p、top_k)會被拒絕——想引導行為請改用提示詞。輸入涵蓋文字、高解析度視覺和程式碼。
規格速覽
Claude Opus 5基準測試
以下為Anthropic發布材料中公佈的廠商成績。第三方跟蹤站點在同一項測試上給出的數字會因資料集、effort設定和智能體腳手架而不同,所以這些頭條數字要當作與配置相關的結果來看。
Claude Opus 5價格
服務商標價,按每100萬token計。
Claude Opus 5實際用起來怎麼樣
來自生產環境智能體執行的實際觀察。
單次完成任務的成本
選Opus 5而不是Fable 5,最直接的理由是:智能體工作上效果相當,token價格卻大約只有一半。在Zapier的AutomationBench上,同樣的單任務成本下,它的透過率約為第二名模型的1.5倍;即便把effort調到最低一檔,它透過的任務數也比其他任何模型都多。
思考預設開啟
和Opus 4.8不同,省略thinking參數的請求現在也會先推理再作答。這一點要算進預算:max_tokens同時覆蓋思考和答案,按不開思考的工況調好的上限可能會被截斷。只有effort在high或更低時才允許關閉思考。
effort是主要的成本槓桿
這個模型上的low和medium強得出人意料,往往能達到上一代旗艦在最高檔才有的水平。先從high起步——最難的程式設計和智能體執行用xhigh——然後逐級往下試,保留評測仍能接受的最便宜那一檔。
會自己檢查成果
不用你提醒,Opus 5也會檢查自己的輸出,所以從舊模型沿用過來的驗證類指令往往只會帶來重複的檢查。它預設寫得也更長;與其調低effort,不如加一句簡短的精簡要求。
Claude Opus 5最適合的智能體任務
一次執行就落地的多檔案功能
把完整需求一次交代清楚,然後讓它跑。Opus 5相對Opus 4.8的提升,在高難度、多步驟的工程工作上最明顯——較大規模的重構、端到端的功能開發——在單輪小修改上最不明顯,所以把它對準你難度區間的上端。
可以放心掛一整夜的智能體
長時間自主執行正是價格差被放大的地方。質量接近Fable,token成本卻只有一半,一個每晚跑的工單分揀、遷移或調研智能體,單次完成任務的花費大約能省一半。
必須做完、而不只是回話的業務流程
帶工具、有真實終態的多步任務——提交工單、更新表格、對賬。Anthropic的AutomationBench和OSWorld結果指向同一件事:別的模型做到一半就撂挑子的端到端任務,它能做完。
Claude Opus 5與其他模型對比
Claude Opus 5對比Claude Opus 4.8
同樣的價格、同樣的檔位,能力卻明顯更強:Opus 5把Opus 4.8的Frontier-Bench成績大約翻了一倍,SWE-bench Verified再加七個百分點。遷移就是換一個模型id,外加重新調一遍提示詞——思考現在預設開啟,記得重新檢查max_tokens,並刪掉所有「驗證你的工作」之類的指令,它們現在只會導致重複檢查。
Claude Opus 5對比GPT 5.6 Sol
兩者都是頂級的智能體模型。Frontier-Bench上Opus 5領先Sol(43.3%對34.4%);DeepSWE v1.1上Sol領先(72.7%對68.8%)。在Okou上這是一個路由選擇,而不是採購決策——同一個智能體在兩邊各跑一遍,比一比就知道。
結論:你該用Claude Opus 5嗎?
Okou上的預設旗艦。Opus 5已經足夠接近Fable 5的上限,以至於大多數智能體工作上價格成了決定因素;對任何已經跑在Opus 4.8上的場景來說,它都是可以直接替換的升級。常規迴圈留給Sonnet 5,Fable 5則留給少數真正需要頂配的任務。
常見問題
Claude Opus 5是什麼時候發布的?
Anthropic在2026年7月24日發布了Opus 5,覆蓋Claude API和Claude應用,以及Amazon Bedrock、Google Cloud和Microsoft Foundry。Okou在2026年7月25日把它加入內建模型(模型id為claude-opus-5)。
Claude Opus 5比Claude Fable 5更好嗎?
在若干評測上確實更好:Frontier-Bench v0.1、GDPval-AA v2和SWE-bench Verified上,Opus 5都領先Fable 5。而在更難的SWE-bench Pro題集和事實廣度上,Fable 5仍然領先,最難的推理任務上它也依然是更高的上限。就大多數智能體工作而言,Opus 5贏在單次完成任務的成本。
Claude Opus 5預設開啟思考嗎?
是的。省略thinking參數的請求也會先推理再作答——這和Opus 4.8不同,那時不主動要求就不會思考。深度用effort控制(low到max),並且只有effort在high或更低時才能關閉思考。原始思維鏈不會返回,只有可讀的摘要。
從Opus 4.8遷移過來要改什麼?
先是模型id,然後是提示詞調優。思考預設開啟意味著max_tokens現在同時覆蓋推理和答案;驗證類指令應該直接刪掉而不是改寫,因為Opus 5會自檢;預設回答也更長,如果在意長度,就明確加一句精簡要求。
替代選擇
在Okou上使用Claude Opus 5
在Okou上使用Claude Opus 5的兩種方式
Okou既支援把Claude Opus 5作為Built-in模型使用、按Okou積分計費,也支援你用Anthropic API key自帶金鑰接入。Built-in這條路走的是Okou Managed路由和下文說明的價格檔;自帶金鑰這條路由上游服務商直接向你收費,完全跳過Okou的積分換算。
Okou的建議
Okou把Claude Opus 5定位為核心智能體模型,用於編排、涉及程式碼的工作,以及其他一旦答錯代價很高的環節。
積分與$$$價格檔
Okou給每個Built-in模型都定了四檔積分價格——$、$$、$$$、$$$$——它會作為標記出現在模型選擇器裡,也出現在zero model ls的price tier那一行。Claude Opus 5屬於$$$。這一檔決定你從Okou積分餘額里扣掉多少;上表裡的服務商標價,則是上游服務商在Okou把它換算成積分之前收取的費用。
自July 25, 2026起在Okou上可用。

