Anthropic 發布 Claude Opus 4.6:以「自主代理」與百萬 Token 視窗重塑企業 AI 版圖

Anthropic 發布 Claude Opus 4.6:以「自主代理」與百萬 Token 視窗重塑企業 AI 版圖
YouTube thumbnailYouTube icon
影片來源:Anthropic

Anthropic 於2026年2月5日正式投下震撼彈,宣布推出其最強大的旗艦模型—Claude Opus 4.6。這款新模型不僅在編碼與推理能力上超越了前代 Opus 4.5,更首度在 Opus 等級模型中引入 100 萬 Token 上下文視窗(1M Context Window) 的 Beta測試版,並同步登陸 Microsoft Foundry 與 Amazon Bedrock 平台。分析師指出,此舉是對 OpenAI GPT-5.2 與 Google Gemini 3 Pro 的直接反擊,但也引發了軟體服務(SaaS)市場的劇烈波動。

技術大躍進:從「聊天機器人」到「數位同事」

根據 Anthropic 的官方公告,Claude Opus 4.6 的核心升級在於其「代理能力(Agentic Capabilities)」。與過去僅能回應單一指令的模型不同,Opus 4.6 被設計為能夠執行長時程、多步驟的複雜任務。

1. 突破性的記憶力與檢索

Opus 4.6 最引人注目的特點是其 100 萬 Token 的上下文視窗。在針對大海撈針(Needle-in-a-Haystack)測試的 MRCR v2 基準評估中,Opus 4.6 展現了驚人的準確度:

  • Claude Opus 4.6 得分: 76%
  • Claude Sonnet 4.5 得分: 18.5%

這意味著企業用戶可以上傳整個程式碼庫或數年的財務報告,模型不僅能「讀完」,還能精準提取並關聯散落在不同文件中的微小細節。

2. 「Cowork」功能引發市場恐慌

Anthropic 此次推出了一項名為 “Cowork” 的新功能,允許 Opus 4.6 在無人監督的情況下自主拆解任務、並行運作子代理(Sub-agents)來完成工作。

  • 應用場景: 根據微軟 Azure 的部落格文章,Opus 4.6 能夠處理跨監管文件的金融分析,得出傳統分析師需耗時數天才能完成的結論。
  • 編碼能力: 在 GitHub Copilot 的早期測試中,Opus 4.6 展現了自我修復(Self-healing)代碼的能力,能主動捕捉並修正自己的錯誤。

然而,這種高度的自動化也引發了資本市場的擔憂。隨著 “Cowork” 功能的發布,包括 Sage、Relx 在內的傳統軟體與數據服務公司股價出現顯著下跌,投資人擔心 AI 將直接取代這些垂直領域的軟體服務。

企業級部署:微軟與亞馬遜的雙重押注

不同於過去僅強調 API 存取,Opus 4.6 的發布伴隨著大規模的雲端整合,顯示 Anthropic 正全力進攻企業市場。

  • Microsoft Foundry: 這是 Opus 4.6 的一大亮點。微軟宣布 Opus 4.6 即日起可用於 Microsoft Foundry,這是一個專為企業代理與自動化工作設計的互操作平台。
  • Amazon Bedrock: AWS 同步宣布支援 Opus 4.6,強調其在網路安全與複雜推理上的應用,特別是能夠識別微小的攻擊模式。

基準測試與競爭格局

在與競爭對手的直接較量中,Opus 4.6 宣稱在多個關鍵領域取得了領先地位。

評測項目領先優勢競爭對手
經濟價值知識工作 (GDPval-AA)高出 ~144 Elo 分OpenAI GPT-5.2
代理編碼 (Terminal-Bench 2.0)最高分Google Gemini 3 Pro
跨學科推理 (Humanity’s Last Exam)榜首(未具名)

資料來源:Hindustan Times

定價與可取得性

儘管性能大幅提升,Anthropic 選擇維持極具競爭力的定價策略,這被視為加速企業採用的關鍵。

  • 輸入 (Input): 每百萬 Token $5 美元
  • 輸出 (Output): 每百萬 Token $25 美元
  • 優惠: 使用 Prompt Caching 可節省高達 90% 成本;批次處理(Batch processing)可節省 50%。

目前,開發者已可透過 Anthropic API、Amazon Bedrock、Google Vertex AI 以及 Microsoft Foundry 存取該模型。

進一步閱讀
  1. Anthropic 發布 Claude Sonnet 4.6:以「中階」價格提供頂級編碼與代理能力,重新定義 AI 性價比