
Claude Sonnet 5 評測:以 Sonnet 價格獲得接近 Opus 的效能?
- anthropic新Anthropic: Claude Opus 52026-07-2461智能78程式
- google新Google: Gemini 3.6 Flash2026-07-2150智能69程式
- google新Google: Gemini 3.5 Flash-Lite2026-07-2137智能49程式
- meta新Meta: Muse Spark 1.12026-07-1651智能71程式
- kimi新MoonshotAI: Kimi K32026-07-1557智能76程式
- openaiOpenAI: GPT-5.6 Luna2026-07-0951智能71程式
- openaiOpenAI: GPT-5.6 Terra2026-07-0955智能77程式
- openaiOpenAI: GPT-5.6 Sol2026-07-0959智能77程式
- grokxAI: Grok 4.52026-07-0854智能72程式
- tencentTencent: Hy32026-07-0641智能59程式
- obsidianQwen3.6 35B A3B Uncensored (Aggressive)2026-07-0232智能42程式
- obsidianGemma4 26B A4B Uncensored (Balanced)2026-07-0226智能39程式
- anthropicAnthropic: Claude Sonnet 52026-06-3053智能72程式
- klingKling: Kling 3.0 Turbo2026-06-1757智能52程式57數學
- z-aiZ.ai: GLM 5.22026-06-1651智能69程式60數學
- kimiMoonshotAI: Kimi K2.7 Code2026-06-1242智能61程式61數學
- anthropicAnthropic: Claude Fable 52026-06-0960智能77程式
- qwenQwen: Qwen3.7 Plus2026-06-0139智能56程式59數學
- minimaxMiniMax: MiniMax M32026-05-3144智能59程式59數學
- AnthropicAnthropic: Claude Opus 4.82026-05-2856智能74程式68數學
Anthropic的Sonnet系列一直是「快速又實惠」的層級——當旗艦Opus過於強大時,你會選用的模型。Claude Sonnet 5改變了這個局面。首次,一個Sonnet層級的模型在編碼和代理工作上的品質接近Opus水準,同時維持Sonnet層級的定價。
這篇評測回答的是多數團隊真正在問的問題:Sonnet 5 是否好到足以成為你的預設模型,以及哪些情況下仍值得為 Opus 4.8 付費?我們將涵蓋真正的新功能、實際成本(包含多數文章略過的 Token 計算陷阱)、它與 Opus 4.8 及前代 Sonnet 4.6 的比較,以及哪些人現在就該轉換。
快速判決
考慮一下 Claude Sonnet 5 如果你……
- 執行高容量生產工作負載,並希望以較低的每 token 成本獲得 Opus 的大部分品質
建立編碼代理或開發者工具——這是Anthropic在編碼與代理工作中最大的Sonnet躍進
- 需要大上下文窗口:{{1}}標準定價下的100萬個token,無長上下文溢價{{/1}}
- 正在從 Sonnet 4.6 升級,並希望獲得更強的指令遵循能力以及高解析度視覺
請暫緩(或繼續使用 Opus 4.8),如果你...
執行最困難的前沿推理或長期自主工作,其中每個品質點都至關重要。
- 將令牌預算調整至字節——Sonnet 5 的新令牌計算器對相同文本統計的令牌數量大約多出 30%。
依賴於 temperature/top_p 調整——非預設取樣值現在已被 API 拒絕。
什麼是 Claude Sonnet 5?
Anthropic 推出三個模型層級:Haiku(快速且便宜)、Sonnet(平衡)和 Opus(旗艦)。Claude Sonnet 5 是當前的 Sonnet 層級模型 — 模型 ID 為 `claude-sonnet-5` — 它今天已可透過 Claude API 普遍使用。它介於 Haiku 4.5 和 Opus 4.8 之間,Anthropic 將其定位為 Sonnet 層級中速度與智慧的最佳平衡。
這一代值得注意的是上限提升了很多。在編碼和自主任務上,Sonnet 5達到了過去Opus級別的品質——所以真正的決定不再是「Sonnet還是Opus?」,而是「哪些任務難到仍然需要Opus?」
Claude Sonnet 5 有什麼新功能?

接近Opus的編碼與代理品質。主要變化。Sonnet 5在編碼和工具使用/代理工作流程上大幅優於Sonnet 4.6,縮小了與Opus 4.8在大多數開發者實際工作上的差距。
預設啟用自適應思考,外加 `xhigh` 努力程度。Sonnet 5 預設執行自適應思考(除非你將其停用),且是首款支援 `xhigh` 努力程度的 Sonnet 層級模型——除了低、中、高、最高之外,`xhigh` 是編碼與代理任務的理想平衡點。
100萬 token 上下文,128K 輸出,無需高級版。一個完整的100萬 token 上下文視窗,以標準定價,每次回應最多輸出128K token。
高解析度視覺。 Sonnet 5 是首個 Sonnet 等級的支援高解析度圖像輸入的模型 — 長邊最高可達 2576px(從 1568px 提升)— 有助於處理螢幕截圖、文件和圖表。
新的 tokenizer(注意事項)。 Sonnet 5 使用新的 tokenizer,對於相同的文本,產生的 token 數量約比 Sonnet 4.6 多出 30%。每個 token 的價格不變,但你的有效成本與上下文窗口計算會隨之改變 —— 在假設同等之前請重新衡量。

定價:實際成本

標準定價是每百萬輸入代幣3美元,每百萬輸出代幣15美元——與Sonnet 4.6相同定價,且遠低於Opus 4.8的5美元/25美元。目前還提供一個入門折扣:每百萬代幣2美元/10美元,有效期至2026年8月31日,因此早期採用者能獲得真正的成本優惠。
這裡有一個需要注意的地方:由於新的分詞器對於相同的文本大約多計數30%的標記,因此在Sonnet 4.6上花費一定成本的工作負載,在Sonnet 5上不一定花費相同,即使每標記費率相同。努力程度也會影響花費——更高的努力(xhigh或max)意味著更多的思考標記。請使用`count_tokens`調用針對`claude-sonnet-5`來制定預算,而不是重複使用舊的估算。
評分
下面的分數是我們根據Anthropic發布的模型能力與行為說明所做的編輯評估,並非獨立的第三方基準測試。我們會在公開基準測試數據出爐後重新審視這些分數。

- 編碼: 9/10
- 代理/工具使用: 9/10
- 推理(最困难的任务): 8/10 — Opus 4.8 仍然领先
- 速度 / 日常生產力: 9/10
- 成本效益: 9/10
- 上下文與長文件: 9/10
總體評分:約8.7/10 — 一個出色的預設模型,Opus 4.8 則保留用於難度範圍的最高端。
優點
- 接近 Opus 的編碼和代理品質,價格卻是 Sonnet 級別——每個 token 比 Opus 4.8 更便宜
- `xhigh` 努力加上適應性思考,提供對成本/品質權衡的精細控制。
- 1M-token 上下文作為標準,無長上下文附加費
- 首款 Sonnet 级别的高分辨率視覺模型(2576px)
- 在遵循指令與編碼方面,明顯優於 Sonnet 4.6
缺點
- 新的分词器使 token 計數相較於 4.6 版本膨脹約 30%——你必須重新基準化成本與上下文預算。
- 非預設的 temperature/top_p/top_k 值會被拒絕 (HTTP 400) — 改為透過提示詞來引導行為
- 手動思考預算(`budget_tokens`)已消失——現在只有自適應思考 + 努力
- 在最困難的推理和最長期的自主工作方面仍落後於Opus 4.8
- 從4.6遷移需要一些提示詞重新調整 — Sonnet 5 更嚴格遵循指令
Claude Sonnet 5 如何比較

對比 Claude Opus 4.8. Opus 4.8 ($5 / $25) 仍是 Anthropic 最強大的模型——專為最困難的推理和長時間自主運行而設計。但 Sonnet 5 現已以更低的每次代幣成本,彌補了大部分編碼與自主能力的差距。實用原則:預設使用 Sonnet 5,僅在最高難度範圍才升級至 Opus 4.8.
对比 Claude Sonnet 4.6。 同樣的 $3 / $15 標價,但 Sonnet 5 在編碼與代理工作方面是真正的能力飛躍,新增了 `xhigh` 努力模式與高解析度視覺,並預設採用自適應思考。權衡之處在於新的分詞器(約多出30%的令牌)以及更嚴格的取樣參數規則。對於多數使用 4.6 的團隊而言,升級是值得的——只是請先重新評估您的成本基線。
此評論側重於Claude系列。如果您想將Sonnet 5與其他提供者的模型進行比較——或是在它們之間路由——請參閱下方的OrcaRouter章節。
誰應該使用 Claude Sonnet 5?
- 大量生產應用程式 — 大規模的聊天、萃取、摘要及分類,在這些場景中,Opus 過於強大而 Haiku 又不夠聰明
- 編碼代理與開發者工具 — 編碼/代理跳躍加上 `xhigh` 努力使其成為 IDE 助手和自主編碼的強力預設
- 長上下文和RAG工作負載 — 1M tokens 標準,無需高級版
- 從 Sonnet 4.6 升級的團隊 想要以相同標價獲得更高品質
誰應該堅持使用Opus 4.8?
- 前沿推理、深度研究以及長期自主智能體,其中最後幾個質量點證明了較高成本的合理性。
工作負載已針對 Opus 行為進行調整,其中切換風險大於節省的成本
Claude Sonnet 5 值得嗎?
對大多數團隊來說,是的。Sonnet 5 是新的明智預設:在人們實際執行的工作上——編寫程式碼、使用代理、日常生產——提供接近 Opus 的品質,卻只需 Sonnet 的價格,並附有持續至 2026 年 8 月的推出優惠。將 Opus 4.8 保留給最困難的任務,您就能兼得兩者之長,無需在日常工作上多花冤枉錢。
最終判決
Claude Sonnet 5 是 Anthropic 目前產品線中最超值的選擇——我們的評分:約 8.7/10。它沒有淘汰 Opus 4.8,但確實讓 Opus 成為一個專門工具,而不是顯而易見的預設選項。如果你還在用 Sonnet 4.6,請升級(請先重新檢查你的代幣成本)。如果你所有工作都依賴 Opus,請將例行工作移至 Sonnet 5,並保留 Opus 處理困難問題。
透過 OrcaRouter 使用 Claude Sonnet 5
因為明智的做法是「預設使用 Sonnet 5,最困難的任務則用 Opus 4.8」,你可能會需要在生產環境中使用多個模型——甚至可能來自其他供應商的模型。這就是 OrcaRouter 消除的摩擦。

OrcaRouter 為您提供一個 OpenAI 相容的端點,可呼叫 Sonnet 5、Opus 4.8 及其他領先模型 —— 具備智慧路由、自動容錯切換及零代幣加價。將成本低、高流量的任務路由至 Sonnet 5,將複雜推理升級至 Opus 4.8,並隨時準備備援模型,無需在每次更換模型時重寫整合程式。

常見問題
Claude Sonnet 5 現在可以使用了嗎?
是的。它目前已通過 Claude API 普遍可用,使用的模型 ID 為 `claude-sonnet-5`。
Claude Sonnet 5 的價格是多少?
$3 每百萬輸入 tokens 和 $15 每百萬輸出 tokens,在 2026 年 8 月 31 日前的優惠費率為 $2 / $10。
Sonnet 5 是否比 Sonnet 4.6 更好?
是的——尤其是在編碼和代理工作方面——它增加了`xhigh`努力和高解析度視覺。請注意新的分詞器(大約多出30%的代幣)以及遷移時更嚴格的取樣參數規則。
Claude Sonnet 5 與 Opus 4.8 — 我該使用哪一個?
預設使用 Sonnet 5 處理大部分工作;對於最困難的推理和長期自主任務,則升級到 Opus 4.8。
什麼是上下文視窗?
1M 個標記,每個回應最多可輸出 128K 個標記,按標準定價。
Sonnet 5 是否支援延伸思考?
它使用自適應思考(預設開啟),努力程度從低到最高,包括新的 xhigh。手動 `budget_tokens` 不再支援。
如果我從4.6切換,我的成本會改變嗎?
可能。新的 tokenizer 對相同文本的計數大約多出 30%,儘管每個 token 的價格相同,所以請用 count_tokens 重新測量。
我可以透過OrcaRouter使用Claude Sonnet 5嗎?
是的——透過一個 OpenAI 相容的端點呼叫 Claude Sonnet 5(以及 Opus 4.8,加上其他提供者的模型),並具備路由和自動故障轉移功能。
準備將 Claude Sonnet 5 投入生產嗎? 在幾分鐘內啟動 — 建立您的 OrcaRouter 帳戶 並透過一個 OpenAI 相容的端點呼叫 Sonnet 5、Opus 4.8 及所有其他模型。優惠定價窗口開放至 2026 年 8 月 31 日 — 現在正是開始的好時機。
