全部模型

Okou上的Claude Sonnet 4.6。預設的智能體模型

多數Okou智能體的預設選擇。工具路由準,長上下文表現好,也是積分的基準線。其他模型的價格都以Sonnet 4.6為參照。

1M tokens · Text / Vision / Code · Prompt cache

Claude Sonnet 4.6是Claude 4系列的主力,也是Okou上預設的Built-in模型。它挑對工具、傳對參數的可靠度高於任何更便宜的模型,在十萬token量級的對話裡也能保持連貫,多數生產環境的智能體——Slack工單分流、GitHub PR評審、客戶支援——從來都不需要往上升級。

服務商標價為每100萬token $3/$15,快取輸入降到每100萬token $0.30。只有在Sonnet明顯扛不住最難的推理時才動用Opus;單位成本壓倒一切時,再考慮Kimi K2.7 Code或GPT-5.4 Mini。

Claude Sonnet 4.6是什麼?

2026年2月(Claude 4.6代) · Claude 4系列的中端檔位。Anthropic的主力模型,位於省錢型模型和Opus之間。

Claude Sonnet 4.6位於Anthropic Claude 4系列的中間位置。它是為承接典型智能體工作全貌而設計的主力模型。多工具路由、程式碼修改、長時間對話、結構化輸出任務。而且沒有Opus那樣的成本溢價。

Sonnet 4.6支援Anthropic的提示詞快取,這對那些系統提示詞穩定、工具結構固定的Okou智能體來說差別很大。快取的輸入token按每100萬token $0.30計費,而不是$3。提示詞裡每輪都不變的那部分,成本直接降到十分之一。

Claude Sonnet 4.6有什麼特別之處

架構與能力上的主要亮點。

Sonnet 4.6按標準價提供100萬token的上下文視窗,自適應思考繼承自Opus 4.6,提示詞快取讓快取輸入只按輸入價的十分之一計費。它接受文字、視覺和程式碼的多模態輸入。

規格速覽

家族Claude 4系列
模態文字、視覺、程式碼
語言以英文為主,支援多語言
提示詞快取支援(Anthropic)
上下文視窗100萬token
最大輸出最高64K token
預設用於Okou Managed

Claude Sonnet 4.6基準測試

在Anthropic主打的編碼基準上,Sonnet 4.6落後Opus 4.6大約3到4個百分點,而服務商層面的價格便宜三到五倍。這就是Opus和Sonnet之間典型的取捨。

SWE-bench Verified廠商公佈
約77%
長上下文召回內部觀察
10萬token以上依然穩定

Claude Sonnet 4.6價格

服務商標價,按每100萬token計。

輸入$3.00
輸出$15.00
快取讀取$0.30
快取寫入$3.75

Claude Sonnet 4.6實際用起來怎麼樣

來自生產環境智能體執行的實際觀察。

工具路由

在這個價位上,工具路由準確度是同級裡最好的。在跨Slack、GitHub、Linear和Notion的多工具流程中,Sonnet 4.6挑對工具、傳對參數的可靠度高於任何×2以下的模型。

長上下文連貫性

在10萬token以上的記錄裡依然連貫。只有在最長、最刁鑽的執行中才會落後Opus 4.7。

速度

比Opus快,比Kimi K2.7 Code慢。對生產環境的智能體來說,這是合適的速度與質量平衡點。

成本可預測性

它的定價就是積分的基準線;對於系統提示詞固定的智能體,提示詞快取讓在Okou上的成本格外好預估。

Claude Sonnet 4.6最適合的智能體任務

知道東西都放在哪兒的Slack智能體

分流進來的問題,跟進卡住的會話,發布狀態更新,回答搜尋式的提問(「auth重構是誰在負責?」)。Sonnet的工具路由準確度意味著,即使請求本身含糊,第一次也能用對的參數調對的工具,所以這個智能體用起來是可靠的,而不是時靈時不靈。

不被噪音淹沒的PR評審智能體

Sonnet能扛下大部分和程式碼相關的工作——PR評審、測試腳手架、重構建議、bug二分定位——而不會留下一堆沒人想看的風格評論。100萬token的上下文視窗讓它在需要時把相關檔案和此前的評審一起讀進來,你只需要在Sonnet明顯吃力的補丁上升級到Opus 4.7。

連著呼叫20次工具的研究型智能體

GitHub加Linear加Notion再加網頁,跨二十多輪工具呼叫串起來,回答「這個客戶上季度為什麼流失了?」這類問題。Sonnet能在整個過程中始終盯住目標,成本卻只有Opus的一小部分,這才讓它撐得起日常研究,而不只是偶爾做一次深挖。

系統提示詞固定的客戶支援助手

長長的對話歷史,頻繁呼叫CRM的工具,每一輪都帶著同樣一大段系統提示詞和工具結構。Sonnet的提示詞快取讓這段固定字首在首次呼叫之後只佔輸入成本的一小部分,這正是量漲上去之後單次會話成本還能持平的原因。

什麼時候不該用Claude Sonnet 4.6

遇到最難的推理環節、Sonnet 4.6明顯開始漏掉指令時,別用它,升級到Opus 4.7;大批次的分類也別用它,GPT-5.4 Mini是更便宜的批次選項;對延遲敏感的短回覆同樣別用,Kimi K2.7 Code明顯更快。

Claude Sonnet 4.6與其他模型對比

Claude Sonnet 4.6對比Claude Opus 4.7

Sonnet 4.6是×1,Opus 4.7是×2。Sonnet能應付大多數智能體;當推理深度比吞吐更重要時,Opus才是那次升級。很多團隊讓Opus做規劃者,Sonnet做執行者。

Claude Sonnet 4.6對比GPT-5.4 Mini

GPT-5.4 Mini是OpenAI那邊更便宜的批次選項。工具路由可靠性更重要時用Sonnet;高頻的前置篩選和不需要Sonnet級路由的簡單環節用Mini。

結論:你該用Claude Sonnet 4.6嗎?

先從這裡開始。等你看過真實的生產表現、清楚該往哪個方向走,再往上換Opus 4.7,或者往下換Kimi K2.7 Code、DeepSeek V4 Pro。

常見問題

為什麼Okou Managed的預設模型是Sonnet 4.6?

在我們的陣容裡,它在推理質量、工具路由準確度和成本之間的平衡最好。新智能體幾乎不用額外調優就能在Sonnet上跑通。

Claude Sonnet 4.6的上下文視窗有多大?

100萬token,單次回覆最高輸出64K token。

Sonnet 4.6支援圖片輸入嗎?

支援。它是多模態的。文字、程式碼和圖片都行。

什麼時候該從Sonnet 4.6換走?

如果Sonnet在長時間的智能體流程裡明顯跑偏了目標,或者在難的程式碼修改上失敗,就換成Opus 4.7。高頻的簡單流程、成本壓倒一切時,換成Kimi K2.7 Code或GPT-5.4 Mini。

Sonnet 4.6和Sonnet 4.5是一回事嗎?

不是。4.6是Claude 4系列裡更新的一代,長上下文表現更好,還帶自適應思考。服務商的單token價格兩者相同。

替代選擇

在Okou上使用Claude Sonnet 4.6

在Okou上使用Claude Sonnet 4.6的兩種方式

Okou既支援把Claude Sonnet 4.6作為Built-in模型使用、按Okou積分計費,也支援你用Anthropic API key自帶金鑰接入。Built-in這條路走的是Okou Managed路由和下文說明的價格檔;自帶金鑰這條路由上游服務商直接向你收費,完全跳過Okou的積分換算。

Okou的建議

Okou把Claude Sonnet 4.6定位為核心智能體模型,用於編排、涉及程式碼的工作,以及其他一旦答錯代價很高的環節。

積分與$$價格檔

Okou給每個Built-in模型都定了四檔積分價格——$$$$$$$$$$——它會作為標記出現在模型選擇器裡,也出現在zero model lsprice tier那一行。Claude Sonnet 4.6屬於$$。這一檔決定你從Okou積分餘額里扣掉多少;上表裡的服務商標價,則是上游服務商在Okou把它換算成積分之前收取的費用。

自Available since launch起在Okou上可用。