← 返回文章列表

Claude Sonnet 5 上任 Anthropic 預設模型,價格僅 Opus 四成

Nils Liu
Anthropic Claude Sonnet 5 Claude AI Agents LLM Pricing 新聞觀察

重點摘要

Claude Sonnet 5 在 2026 年 6 月 30 日上線,隔天就直接頂替所有 Free 與 Pro 用戶的預設模型位置,價格只要 Opus 4.8 的四成,agentic coding 分數卻只落後六個百分點。這波性價比升級,背後是真突破還是精算過的行銷折扣?

Claude Sonnet 5 上任 Anthropic 預設模型,價格僅 Opus 四成

Anthropic 在 2026 年 6 月 30 日推出 Claude Sonnet 5,隔天就把它扶正成 Free 與 Pro 方案的預設模型,Max、Team、Enterprise 用戶與 Claude Code、API 平台也同步開放。新模型的定價是每百萬輸入 token 2 美元、輸出 10 美元,這個優惠價格維持到 8 月 31 日,之後漲到 3 美元與 15 美元,旗艦模型 Opus 4.8 一輸入就要 5 美元、輸出 25 美元,Sonnet 5 大概只有它的四成。

我判斷這次發布的重點是一次精算過的定價卡位,技術突破反而是次要的。Sonnet 5 在 agentic coding 拿到 63.2 分,Opus 4.8 是 69.2 分,六個百分點的差距換來六成的價格折扣,對大多數企業客戶來說這筆帳一看就懂。如果你手上有獨立第三方的 benchmark 數字,非 Anthropic 自家跑出來的,跟這裡的 63.2 分兜不起來,我很想知道差在哪。

一天內從發布到預設,Anthropic 在賭什麼

Anthropic 官方公告列出的重點是,Sonnet 5 對比上一代 Sonnet 4.6,agentic reasoning、工具使用、程式撰寫都有提升,官方特別強調的是「不用明確提示也能自主完成任務」,還有幻覺率與諂媚傾向雙雙下降。Zapier 的 Daniel Shepard 給的早期回饋是,模型能把過去需要人工中途介入的多步驟任務直接跑完;Lovable 的 Fabian Hedin 則看重它拒絕不安全請求的一致性,這對開發工具型產品是關鍵指標。

TechCrunch 的報導把這次發布放進更大的脈絡:Sonnet 5 比 Opus 4.8、GPT-5.5、Gemini 3.1 Pro 都便宜,只有 Gemini 3.5 Flash 比它更低價。這個發布時間點也不是巧合,緊跟在 OpenAI 的 GPT-5.6 Sol 與 Google 的 Gemini 3.5 Flash 之後,三大實驗室幾乎在同一週把戰場從「誰的模型更強」搬到「誰的中階模型性價比更高」。

安全面向也做了調整。Sonnet 5 預設啟用網路安全防護,開發網路攻擊工具的能力被官方定位為「遠低於 Opus 4.8」,對抗提示注入與拒絕惡意請求的表現也優於上一代。不過官方同時承認,在對齊行為的整體指標上,Sonnet 5 還沒有追上 Opus 4.8 的水準。

數字背後的真相

先把 63.2 分這個數字放進脈絡裡看。這是 Anthropic 自家跑出來的 agentic coding 分數,跟 Opus 4.8 的 69.2 分、上一代 Sonnet 4.6 的 58.1 分放在同一張表比較,三個數字都出自同一家公司、同一套測試流程。分數本身沒有問題,但在有 LMSYS Arena 或第三方機構如 Artificial Analysis 的獨立驗證之前,這張表更接近一份設計精良的銷售資料,而不是中立的效能報告。

值得追問的是這次進步的來源。Sonnet 4.6 到 Opus 4.8 中間隔了 11 個百分點,Sonnet 5 把跟 Opus 的差距縮小到 6 個百分點,同時價格只要 Opus 的四成。這種「效能逼近、成本砍半以上」的曲線,比較像是把大模型的能力透過蒸餾或訓練優化壓進小模型架構,而不是底層出現了全新的架構突破。如果真的是架構級的創新,很難解釋為什麼價格結構會剛好卡在 Opus 的四成這個位置,這個數字更像是產品定價會議算出來的,不是實驗室裡跑出來的。

換算成實際成本會更有感覺。一個中型 agent 任務假設處理 100 萬個 token,用 Sonnet 5 大約花 12 美元,換成 Opus 4.8 要 30 美元,省下六成價格卻只犧牲 63.2/69.2,也就是約 91% 的相對效能。對一家月跑 10 億輸出 token 的企業客戶,Sonnet 5 的月費大概是 1 萬美元,Opus 4.8 則要 2.5 萬美元,一個月省下 1.5 萬美元。這種算法才是 Sonnet 5 能在一天內就被扶正成預設模型的真正理由,財務長看到這張成本表,比看到效能提升六個百分點更容易點頭。

VentureBeat 的報導點出另一層動機:Anthropic 正在為一場備受矚目的 IPO 鋪路,用更低的邊際成本服務更多用戶,同時把毛利結構做得更好看,是上市前很自然的財務操作。定價策略跟資本市場敘事綁在一起,這一點在解讀「為什麼現在推出」時,重要性不亞於任何一個 benchmark 分數。

接下來值得觀察的指標

第一個指標是獨立驗證。三到六個月內,如果 LMSYS Arena 或 Artificial Analysis 這類第三方平台公布的 Sonnet 5 排名,跟官方宣稱的 63.2 分落差不大,這次的效能主張就站得住腳;如果落差明顯,代表官方數字有經過挑選對比條件的嫌疑。

第二個指標是 8 月 31 日之後的漲價會不會如期發生。從 2 美元/10 美元漲到 3 美元/15 美元是 50% 的漲幅,如果屆時 OpenAI 或 Google 剛好祭出更低價的中階模型,Anthropic 有沒有膽子照原計畫漲價,會是一個訊號。

第三個指標是企業客戶的實際遷移速度。Zapier、Lovable 這類早期測試者的正面回饋要轉換成大規模採用,通常需要幾個月的實戰驗證,值得追蹤 Claude Code 與 API 平台上 Sonnet 5 對 Opus 4.8 的呼叫量比例變化。

第四個指標是這次發布跟 Anthropic IPO 進度的時間關聯。如果接下來幾個月內 S-1 文件有更新進展,跟這次「性價比優先」的定價策略擺在一起看,會更清楚看出這是不是一次為上市財報做準備的產品動作。

如果這篇對你有幫助,訂閱電子報 可以第一時間收到 AI PM 實戰洞察與 GenAI 落地案例。


相關閱讀:

訂閱最新分享

加入電子報,第一時間獲取關於金融 AI Agent 實戰與架構設計的最新文章。不訂閱你會慢別人一個週期!

絕不發送垃圾信。隨時皆可取消訂閱。