Claude Sonnet 5 上任 Anthropic 預設模型,價格僅 Opus 四成
重點摘要
Claude Sonnet 5 在 2026 年 6 月 30 日上線,隔天就直接頂替所有 Free 與 Pro 用戶的預設模型位置,價格只要 Opus 4.8 的四成,agentic coding 分數卻只落後六個百分點。這波性價比升級,背後是真突破還是精算過的行銷折扣?
Anthropic 在 2026 年 6 月 30 日推出 Claude Sonnet 5,隔天就把它扶正成 Free 與 Pro 方案的預設模型,Max、Team、Enterprise 用戶與 Claude Code、API 平台也同步開放。新模型的定價是每百萬輸入 token 2 美元、輸出 10 美元,這個優惠價格維持到 8 月 31 日,之後漲到 3 美元與 15 美元,旗艦模型 Opus 4.8 一輸入就要 5 美元、輸出 25 美元,Sonnet 5 大概只有它的四成。
我判斷這次發布的重點是一次精算過的定價卡位,技術突破反而是次要的。Sonnet 5 在 agentic coding 拿到 63.2 分,Opus 4.8 是 69.2 分,六個百分點的差距換來六成的價格折扣,對大多數企業客戶來說這筆帳一看就懂。如果你手上有獨立第三方的 benchmark 數字,非 Anthropic 自家跑出來的,跟這裡的 63.2 分兜不起來,我很想知道差在哪。
一天內從發布到預設,Anthropic 在賭什麼
Anthropic 官方公告列出的重點是,Sonnet 5 對比上一代 Sonnet 4.6,agentic reasoning、工具使用、程式撰寫都有提升,官方特別強調的是「不用明確提示也能自主完成任務」,還有幻覺率與諂媚傾向雙雙下降。Zapier 的 Daniel Shepard 給的早期回饋是,模型能把過去需要人工中途介入的多步驟任務直接跑完;Lovable 的 Fabian Hedin 則看重它拒絕不安全請求的一致性,這對開發工具型產品是關鍵指標。
TechCrunch 的報導把這次發布放進更大的脈絡:Sonnet 5 比 Opus 4.8、GPT-5.5、Gemini 3.1 Pro 都便宜,只有 Gemini 3.5 Flash 比它更低價。這個發布時間點也不是巧合,緊跟在 OpenAI 的 GPT-5.6 Sol 與 Google 的 Gemini 3.5 Flash 之後,三大實驗室幾乎在同一週把戰場從「誰的模型更強」搬到「誰的中階模型性價比更高」。
安全面向也做了調整。Sonnet 5 預設啟用網路安全防護,開發網路攻擊工具的能力被官方定位為「遠低於 Opus 4.8」,對抗提示注入與拒絕惡意請求的表現也優於上一代。不過官方同時承認,在對齊行為的整體指標上,Sonnet 5 還沒有追上 Opus 4.8 的水準。
數字背後的真相
先把 63.2 分這個數字放進脈絡裡看。這是 Anthropic 自家跑出來的 agentic coding 分數,跟 Opus 4.8 的 69.2 分、上一代 Sonnet 4.6 的 58.1 分放在同一張表比較,三個數字都出自同一家公司、同一套測試流程。分數本身沒有問題,但在有 LMSYS Arena 或第三方機構如 Artificial Analysis 的獨立驗證之前,這張表更接近一份設計精良的銷售資料,而不是中立的效能報告。
值得追問的是這次進步的來源。Sonnet 4.6 到 Opus 4.8 中間隔了 11 個百分點,Sonnet 5 把跟 Opus 的差距縮小到 6 個百分點,同時價格只要 Opus 的四成。這種「效能逼近、成本砍半以上」的曲線,比較像是把大模型的能力透過蒸餾或訓練優化壓進小模型架構,而不是底層出現了全新的架構突破。如果真的是架構級的創新,很難解釋為什麼價格結構會剛好卡在 Opus 的四成這個位置,這個數字更像是產品定價會議算出來的,不是實驗室裡跑出來的。
換算成實際成本會更有感覺。一個中型 agent 任務假設處理 100 萬個 token,用 Sonnet 5 大約花 12 美元,換成 Opus 4.8 要 30 美元,省下六成價格卻只犧牲 63.2/69.2,也就是約 91% 的相對效能。對一家月跑 10 億輸出 token 的企業客戶,Sonnet 5 的月費大概是 1 萬美元,Opus 4.8 則要 2.5 萬美元,一個月省下 1.5 萬美元。這種算法才是 Sonnet 5 能在一天內就被扶正成預設模型的真正理由,財務長看到這張成本表,比看到效能提升六個百分點更容易點頭。
VentureBeat 的報導點出另一層動機:Anthropic 正在為一場備受矚目的 IPO 鋪路,用更低的邊際成本服務更多用戶,同時把毛利結構做得更好看,是上市前很自然的財務操作。定價策略跟資本市場敘事綁在一起,這一點在解讀「為什麼現在推出」時,重要性不亞於任何一個 benchmark 分數。
接下來值得觀察的指標
第一個指標是獨立驗證。三到六個月內,如果 LMSYS Arena 或 Artificial Analysis 這類第三方平台公布的 Sonnet 5 排名,跟官方宣稱的 63.2 分落差不大,這次的效能主張就站得住腳;如果落差明顯,代表官方數字有經過挑選對比條件的嫌疑。
第二個指標是 8 月 31 日之後的漲價會不會如期發生。從 2 美元/10 美元漲到 3 美元/15 美元是 50% 的漲幅,如果屆時 OpenAI 或 Google 剛好祭出更低價的中階模型,Anthropic 有沒有膽子照原計畫漲價,會是一個訊號。
第三個指標是企業客戶的實際遷移速度。Zapier、Lovable 這類早期測試者的正面回饋要轉換成大規模採用,通常需要幾個月的實戰驗證,值得追蹤 Claude Code 與 API 平台上 Sonnet 5 對 Opus 4.8 的呼叫量比例變化。
第四個指標是這次發布跟 Anthropic IPO 進度的時間關聯。如果接下來幾個月內 S-1 文件有更新進展,跟這次「性價比優先」的定價策略擺在一起看,會更清楚看出這是不是一次為上市財報做準備的產品動作。
如果這篇對你有幫助,訂閱電子報 可以第一時間收到 AI PM 實戰洞察與 GenAI 落地案例。
相關閱讀:
相關文章
Claude Opus 5 每百萬輸入 token 收 5 美元:Anthropic 把代理模型的競爭拉回成本
Anthropic 於 2026 年 7 月 24 日推出 Claude Opus 5,API 定價維持每百萬輸入 token 5 美元、輸出 25 美元,並以代理工作、較少安全攔截與自動降級功能爭取日常企業負載。
Claude Code 將 Auto mode 設為預設:1,053 人測試攔下 89% 危險指令
Anthropic 將從 August 14, 2026 起,讓 Pro、Max 與 Team 方案的新 Claude Code 工作階段預設使用 Auto mode;測試數據優於人工核准,但研究環境與實際事故率仍有限制。