
在 AI 軍備競賽白熱化的 2026 年初,Anthropic 再次投下震撼彈。就在旗艦模型 Opus 4.6 發布僅兩週後,該公司於2026年2月17日正式推出 Claude Sonnet 4.6。這款定位為「高效能工作馬」的新模型,不僅在編碼與複雜推理上展現了驚人的進步,更以極具破壞力的性價比,挑戰企業自動化工作流的極限。
超越前代的「智慧」升級:不只是速度
根據 Anthropic 釋出的官方系統卡(System Card),Claude Sonnet 4.6 並非僅是 4.5 版本的微幅更新,而是針對編碼(Coding)、電腦操作(Computer Use)與代理規劃(Agent Planning)進行了架構級的優化。
最引人注目的是,Sonnet 4.6 在企業文檔理解測試(OfficeQA)中,性能已逼近兩週前才發布的旗艦模型 Opus 4.6。這意味著企業用戶可以用更低的成本,獲得接近頂級模型的推理能力。
開發者的福音:Bolt CEO 盛讚「最佳 iOS 代碼」
在實際應用層面,Sonnet 4.6 展現了強大的「即戰力」。Bolt 執行長 Eric Simons 在早期測試後表示:「Claude Sonnet 4.6 生成了我們在 Rakuten AI 測試中見過的最佳 iOS 代碼。」他指出,該模型特別擅長處理需要跨多個檔案搜索的大型代碼庫修復工作,這是過去模型常遇到的瓶頸。
關鍵技術規格:100 萬 Token 與「上下文壓縮」
為了滿足法律、金融與科研領域的需求,Sonnet 4.6 引入了兩項關鍵技術突破:
- 100 萬 Token 上下文窗口 (Beta):這讓模型能一次性消化數百份研究論文或整個軟體代碼庫。
- 上下文壓縮 (Context Compaction):這是一項針對長對話優化的新功能。當對話接近長度限制時,模型會自動摘要舊資訊,從而延長有效記憶長度,這對於需要長期運行的 AI 代理(Agents)至關重要。
此外,Sonnet 4.6 支援「自適應思考 (Adaptive Thinking)」,模型能自行判斷何時需要進行深度推理,何時可以快速回應,從而在成本與品質間取得最佳平衡。
基準測試:在 OSWorld 中展現「類人」操作能力
根據《經濟時報》(The Economic Times)的報導,Sonnet 4.6 在 OSWorld 基準測試中取得了顯著進展。這項測試專門評估 AI 在真實電腦環境中的操作能力。早期測試者回報,該模型在導航複雜電子表格、完成多步驟網頁表單填寫,以及跨瀏覽器標籤協作任務上,表現出接近人類的水準。
數據顯示,Sonnet 4.6 在代理金融分析(Agentic Financial Analysis)等任務上的表現甚至超越了競爭對手的頂級模型。
定價策略:高階性能,中階價格
儘管性能大幅提升,Anthropic 選擇維持極具競爭力的定價策略:
- 輸入:$3 / 百萬 Token
- 輸出:$15 / 百萬 Token
相較於旗艦版 Opus 4.6 的 $5(輸入)/ $25(輸出),Sonnet 4.6 的定價顯然是為了搶佔大規模企業部署的市場份額。Anthropic 明確表示,對於大多數「生產級」應用,Sonnet 4.6 提供了目前市場上最佳的性能價格比。
產業背景:300 億美元融資後的野心
此次發布正值 Anthropic 的關鍵時刻。該公司剛完成由 GIC 和 Coatue 領投的 300 億美元 G 輪融資,估值達到驚人的 3,800 億美元,年營收運行率(Run-rate revenue)已突破 140 億美元。
與競爭對手紛紛轉向廣告變現不同,Anthropic 在 2 月 4 日的公告中重申了「無廣告」承諾,強調廣告激勵機制與「真正有益的 AI 助手」存在本質衝突。這項堅持,配合 Sonnet 4.6 的強大性能,顯示出 Anthropic 意圖成為企業最值得信賴的 AI 基礎設施供應商。
