產業動態

Claude Fable 5.1 發表:快取讀取降至四分之一,長時程代理工作是這次的主軸

2026-09-03 | 約 8 分鐘 | MAQ 技術團隊

Anthropic 於 2026 年 9 月 1 日發表 Claude Fable 5.1,並同步釋出一支 85 秒的官方影片。輸入與輸出價格與前一代 Fable 5 相同,快取讀取則降至四分之一。這次改版的主軸是長時程的代理式工作——能夠中途離開、回頭再繼續,且不會在第 40 步崩解的那一種。

Anthropic 官方影片「Introducing Claude Fable 5.1」,85 秒,2026 年 9 月 1 日發布。全片為旁白搭配畫面,未出示任何基準測試數據或價格。

影片的主張。第 2 步的小錯,不會毀掉第 40 步。

影片以一句話定義這次的升級:「無論已經交給 Claude 的是什麼,它都能承接更多,並把最難的部分做得更好。」隨後點名三類工作——複雜的財務模型、冗長的數學證明、以及帶有數百處交叉引用的合約。

接著是全片最具體的一句:這些任務的特性是「第 2 步的一個小錯誤,會在第 40 步造成整體失敗」,而 Fable 5.1 能一路維持到最後。這是對長鏈推理穩定性的宣稱,不是對單次回答品質的宣稱,兩者是不同的能力。

軟體工作方面,影片列出程式碼審查、效能調校,以及橫跨整個程式庫的功能開發。另有兩項與工作方式直接相關的描述:工作階段可以中途離開、稍後再回來接續;遇到障礙時,模型會說明自己嘗試過什麼、卡在哪裡。

影片並未止於程式。交付一個開放式問題,回來的是可供審閱的成品——研究、試算表、備忘錄、簡報,且「數字與出處都攤開來,供人查核」。科學研究則描述為閱讀文獻、提出假說、設計實驗三個步驟。

規格。100 萬 token 脈絡,快取讀取降至四分之一。

Claude API 的模型代號為 claude-fable-5-1,Amazon Bedrock 上為 anthropic.claude-fable-5-1,Google Cloud 與 Microsoft Foundry 則沿用前者。發布日為 2026 年 9 月 1 日,官方承諾的最早退役時間為 2027 年 9 月 1 日。

脈絡視窗為 100 萬 token,單次最大輸出 128K token,可靠知識截止為 2026 年 6 月。思考模式為恆常開啟的自適應思考,effort 參數預設為 high;相對延遲在現行陣容中標示為較慢。

價格方面,輸入為每百萬 token 10 美元、輸出 50 美元,與 Fable 5 相同。真正的變動在快取:讀取由前代的每百萬 token 1 美元降至 0.25 美元。Anthropic 估計此一調整可使典型工作負載成本下降約 25%,高度代理式的工作負載最多可降低約 45%。

官方文件同時給出選型建議,措辭相當明確:多數工作負載應先採用 Claude Opus 5(輸入每百萬 token 5 美元、輸出 25 美元);Fable 5.1 適用於高難度推理與長時程代理工作,或在 Opus 5 提高 effort 後評測仍不足時。

基準測試

以下為 Anthropic 公布的 Fable 5.1 與 Fable 5 對照,均為官方自行量測。

評測項目Fable 5.1Fable 5性質
Terminal-Bench-Science 0.1
52.6%24.7%科學研究終端任務
Terminal-Bench 4.0
55.8%42.0%終端代理任務
AutomationBench
31.4%17.1%自動化流程
OSWorld 2.0
partial/strict
77.9%/41.7%72.9%/36.1%電腦操作
CursorBench 3.2.0
73.4%70.5%程式編輯
Humanity's Last Exam
無工具/有工具
60.9%/65.0%57.8%/63.8%跨領域知識推理
GDPval-AA v2
18531723分數制,非百分比
Terminal-Bench-Science 0.1
52.6%(Fable 5:24.7%)
科學研究終端任務
Terminal-Bench 4.0
55.8%(Fable 5:42.0%)
終端代理任務
AutomationBench
31.4%(Fable 5:17.1%)
自動化流程
OSWorld 2.0
partial 77.9%、strict 41.7%(Fable 5:72.9%/36.1%)
電腦操作
CursorBench 3.2.0
73.4%(Fable 5:70.5%)
程式編輯
Humanity's Last Exam
無工具 60.9%、有工具 65.0%(Fable 5:57.8%/63.8%)
跨領域知識推理
GDPval-AA v2
1853(Fable 5:1723)
分數制,非百分比

幅度最大的兩項是 Terminal-Bench-Science 0.1(24.7% 至 52.6%)與 AutomationBench(17.1% 至 31.4%),兩者皆屬需要連續執行多個步驟的代理式評測,與影片強調的長鏈穩定性方向一致。知識型的 Humanity's Last Exam 則僅有 3.1 與 1.2 個百分點的變動,屬同一量級。

另有一款 Claude Mythos 5.1,規格與價格與 Fable 5.1 相同,差異在於安全防護的寬鬆程度,僅開放給受邀的信任存取計畫參與者。其 Terminal-Bench 4.0 為 60.9%。

三項破壞性變更

既有以 Fable 5 呼叫 API 的系統,升級前須先確認三件事。其一,強制工具使用(forced tool use)不再支援,改為回傳錯誤。其二,思考區塊與產生它的模型綁定,較早的模型無法讀取 Fable 5.1 的思考區塊。其三,編輯較早的對話輪次會使思考區塊失效。

另有五項為新增功能,不影響既有呼叫:對話中途調整 effort(beta)、以輪次為範圍的系統訊息(beta)、工具呼叫之間可讀的進度更新(display: "updates",beta)、較低的快取讀取價格,以及內容來源標記。

這對硬體採購的意義

Fable 5.1 是雲端模型,無法在本機執行,其能力與顯示卡的顯示記憶體容量無關。真正被這次改版改變的,是執行代理程式那一端的需求。

影片描述的使用方式——工作階段可以離開、回來、繼續——意味著代理程式需要一台長時間穩定運行的機器,而非一次性的互動。這類工作的資源特性是網路連線、常駐行程與本機檔案系統,運算主要發生在雲端。MAQ 的 AI Agent PC 即為此用途配置:預載 Claude Code、n8n、LangGraph、CrewAI 與 Ollama,以內顯搭配安靜低耗電的機構,適合常時運作。

需要模型在自有 AI 伺服器內執行、資料完全不出公司網路的情境,走的是另一條路線:本地開放權重模型與對應的顯示記憶體容量。該層對照整理於 AI 硬體選購指南。兩者並非替代關係,實務上多為並行——雲端模型處理最難的推理,本地模型處理不宜外送的資料。

延伸閱讀:Claude Opus 5 發布,與同日的開放權重聯署信Claude Cowork 登陸手機與網頁大型企業如何治理 AI coding agent

資料來源:Anthropic 官方影片「Introducing Claude Fable 5.1」(YouTube,2026 年 9 月 1 日,85 秒),影片引述均取自官方英文字幕之中譯;規格、價格、模型代號與退役時程取自 Claude Platform Docs「Claude Fable 5.1」模型頁;基準測試數據與成本降幅估計取自 Anthropic 公告「Introducing Claude Fable 5.1 and Claude Mythos 5.1」。所有基準測試均為 Anthropic 自行量測,評測方法與版本以官方公布為準,實際表現依工作負載而異。成本降幅為官方估計值,非保證值。本文未使用任何未經官方公布之效能數據。本文非受任何公司委託或贊助,亦未收受對價;MAQ 從事 AI 工作站與代理式 AI 電腦之銷售與系統整合,於本題具有商業利益。Claude、Claude Code、Anthropic 為 Anthropic PBC 之商標;Amazon Web Services、Amazon Bedrock 為 Amazon.com, Inc. 之商標;Google Cloud 為 Google LLC 之商標;Microsoft Foundry 為 Microsoft Corporation 之商標;其餘產品名稱為各自所有者之商標。

常見問題

Claude Fable 5.1 可以在自己的電腦上執行嗎?

不行。Fable 5.1 為雲端模型,僅透過 Claude API、Amazon Bedrock、Google Cloud、Microsoft Foundry 與 Claude 各應用程式提供,Anthropic 未釋出權重。需要模型在自有 AI 伺服器內執行、資料完全不出公司網路者,須改用開放權重模型,並依模型大小與量化格式回推所需的顯示記憶體容量。

Fable 5.1 與 Opus 5 應該選哪一個?

Anthropic 官方文件的建議相當明確:多數工作負載應先採用 Claude Opus 5(輸入每百萬 token 5 美元、輸出 25 美元)。Fable 5.1(輸入 10 美元、輸出 50 美元)適用於高難度推理與長時程代理工作,或在 Opus 5 提高 effort 參數後評測結果仍不足時。兩者脈絡視窗同為 100 萬 token、最大輸出同為 128K token。

這次價格有調整嗎?

輸入與輸出價格與 Fable 5 完全相同,分別為每百萬 token 10 美元與 50 美元。變動在提示快取:讀取由每百萬 token 1 美元降至 0.25 美元,為前代的四分之一。Anthropic 估計此調整可使典型工作負載成本下降約 25%,高度代理式的工作負載最多可降低約 45%。5 分鐘快取寫入為 12.5 美元、1 小時為 20 美元,Batch API 輸入與輸出均為五折。

既有以 Fable 5 呼叫 API 的系統,升級前要注意什麼?

有三項破壞性變更。其一,強制工具使用不再支援,改為回傳錯誤。其二,思考區塊與產生它的模型綁定,較早的模型無法讀取 Fable 5.1 的思考區塊。其三,編輯較早的對話輪次會使思考區塊失效。另有五項為新增功能,不影響既有呼叫,包含對話中途調整 effort、以輪次為範圍的系統訊息、工具呼叫之間的進度更新,以及內容來源標記。

要跑 Claude Code 這類代理程式,需要什麼樣的電腦?

運算發生在雲端,與本機顯示卡的顯示記憶體容量無關。實際需要的是網路連線、常駐行程與本機檔案系統,也就是一台能長時間穩定運行的機器。MAQ 的 AI Agent PC 即為此用途配置,以內顯搭配安靜低耗電的機構,出廠預載 Claude Code、n8n、LangGraph、CrewAI 與 Ollama。

Claude Mythos 5.1 是什麼?

規格與價格與 Fable 5.1 相同,差異在於安全防護的寬鬆程度,用於支援資訊安全與生命科學領域的工作。開放對象僅限受邀的信任存取計畫參與者,取得方式須聯繫 Anthropic、AWS 或 Google Cloud 的客戶團隊。其 Terminal-Bench 4.0 為 60.9%。

AI Agent 代理 PC

MAQ 的 AI Agent PC 出廠預載 Claude Code、n8n、LangGraph、CrewAI 與 Ollama,可直接串接 Claude API 或本地模型,適合常時運作的代理式工作流。