Anthropic 推出 Claude Fable 5.1:科學編碼分數翻倍,密集工作流成本最多降四成半

Key takeaway

2026 年 9 月 1 日,Anthropic 於官方新聞稿〈Introducing Claude Fable 5.1 and Claude Mythos 5.1〉宣布推出 Claude Fable 5.1,定位為編碼、知識工作與長程代理式(agentic)任務的新一代模型,並同步公布受限取用的 Claude Mythos 5.1。經核對 Anthropic 新聞稿、Claude 平台文件(模型總覽、What's new)及定價表後,來源真實性已驗證。本文整理其機制、技術含義、對開發與企業採購的含義,以及香港在資料主權與《個人資料(私隱)條例》(PDPO)下的取捨。

Anthropic 推出 Claude Fable 5.1:科學編碼分數翻倍,密集工作流成本最多降四成半

Anthropic 推出 Claude Fable 5.1:科學編碼分數翻倍,密集工作流成本最多降四成半

2026 年 9 月 1 日,Anthropic 於官方新聞稿〈Introducing Claude Fable 5.1 and Claude Mythos 5.1〉宣布推出 Claude Fable 5.1,定位為編碼、知識工作與長程代理式(agentic)任務的新一代模型,並同步公布受限取用的 Claude Mythos 5.1。經核對 Anthropic 新聞稿、Claude 平台文件(模型總覽、What's new)及定價表後,來源真實性已驗證。本文整理其機制、技術含義、對開發與企業採購的含義,以及香港在資料主權與《個人資料(私隱)條例》(PDPO)下的取捨。

一、核心事件:同一底價,長程代理變便宜、科學編碼明顯躍升

Fable 5.1 並非另開一檔「更貴的頂級價」。官方文件寫明:輸入/輸出單價與 Claude Fable 5 相同,分別為每百萬 token 10 美元與 50 美元;真正改動的是快取讀取(cache reads)——由其他 Claude 模型常見的「輸入價 10%」降至「輸入價 2.5%」,即每百萬 token 0.25 美元,較 Fable 5 的 1.00 美元少 75%。Anthropic 以 2026 年 8 月四周實測用量估算:一般工作負載約便宜 25%;高度代理、上下文密集的工作流最高可約便宜 45%。

同日公布的評測中,最醒目的是代理式科學研究基準 Terminal-Bench-Science 0.1:Fable 5.1 取得 52.6%,對照官方同一套件下的 Fable 5 為 24.7%、Opus 5 為 29.0%、GPT-5.6 Sol 為 22.4%。官方註明標準誤差約 ±3.5 至 4.5 個百分點,公開排行榜(每題三試、Claude Code harness)上 Opus 5 與 Fable 5 分別為 30.0% 與 21.4%,其內部重跑結果落在誤差範圍內。換言之,「科學編碼分數接近翻倍」是相對 Fable 5 的官方數字,不宜當成跨實驗室的絕對排名。

CursorBench 3.2.0(代理式編碼)官方表列 Fable 5.1 為 73.4%,Fable 5 為 70.5%,Opus 5 為 70.0%,GPT-5.6 Sol 為 67.2%。這是溫和領先,不是翻倍;本文封面與標題所稱「翻倍」僅對應 Terminal-Bench-Science 0.1。Terminal-Bench 4.0 上 Fable 5.1 為 55.8%,Mythos 5.1 為 60.9%,對照 Fable 5 的 42.0%。

Fable 5.1 已於 2026 年 9 月 1 日上線。官方模型識別碼為 claude-fable-5-1,平台包括 Claude API、Amazon Bedrock(anthropic.claude-fable-5-1)、Google Cloud、Microsoft Foundry,以及 Claude Platform on AWS。Claude Mythos 5.1 與 Fable 5.1 為同一底層模型、不同安全護欄,僅向受審核的 Project Glasswing/可信取用計劃(網絡防禦核證計劃 CVP、生命科學核證計劃 LSVP)開放。本文不以第三方傳聞宣稱其已內建於特定 IDE;CursorBench 是基準名稱,不等於產品上架聲明。

技術細節(已對照官方文件)

依 Claude 平台模型總覽與 What's new:

  • 上下文視窗 100 萬 token(預設即上限),最大輸出 12.8 萬 token;知識截止 2026 年 6 月。
  • 思考模式為自適應(adaptive),一律開啟;以 effort 調節深度,API 預設 high。官方指 Claude Code 預設 High,Claude Cowork 與 Claude.ai 預設 Medium。
  • 快取寫入不變:5 分鐘快取寫入每百萬 token 12.50 美元,1 小時 20 美元;可快取最短提示仍為 512 token。批次 API 輸入/輸出半價(5/25 美元)。
  • 三項破壞性變更:不支援強制工具呼叫(tool_choiceany 或指定工具名稱會 400);較舊模型讀不到 Fable 5.1 的 thinking blocks;改寫較早輪次會使 thinking 失效。
  • 五項附加能力:對話中途改 effort(beta)、單輪系統訊息(beta)、工具呼叫之間的進度更新 display: "updates"(beta)、較低快取讀取價,以及輸出內容出處標記(歐盟 AI 法要求的統計浮水印;圖像/影片經 Files API 可帶 C2PA)。
  • 資料留存:Fable 5.1/Mythos 5.1 預設 30 日留存;零留存須 Anthropic 明示授權。企業前沿護欄(Enterprise Frontier Safeguards, EFS)把資料存在客戶自控雲端,官方稱等同零留存私隱效果,秋季起分階段推出;EFS 就緒前,合資格客戶可用 Fable 5.1 的零留存。

二、技術原理深度解析

1. 快取讀取降價,改變的是「長對話經濟學」

長程代理會反覆把同一系統提示、工具定義與歷史前綴送回模型。快取命中後,舊價仍按輸入價 10% 計;Fable 5.1 改為 2.5%。官方圖表把「高度代理工作流」中快取讀取畫成成本主體:同一實測工作流由 100 降至約 55(相對 Fable 5)。這不是模型「自己變便宜」,而是把長會話裡重複閱讀的那一段,從接近輸入價的稅,改成接近免費的索引費。對香港團隊的含義很具體:若你的 agent 每步都重傳整份倉庫說明與工具表,Fable 5.1 的帳單改善會遠大於單次問答。

2. 自適應思考 + 中途改 effort:把算力用在難步

官方強調 Fable 5.1 在 Low/Medium effort 已可接近或超過 Fable 5 高 effort 的結果,但預設仍偏高。What's new 允許在同一對話中途改 effort 而不使提示快取失效(beta 標頭 mid-conversation-output-config-2026-07-01)。工程上,這接近「難步驟加預算、例行步驟降預算」,與快取降價疊加:前綴繼續命中,只有當前步的思考深度在變。

3. Thinking 綁定:對話必須近乎只追加、不改寫

Fable 5.1 把 thinking block 綁在產生它的對話前綴上。改系統提示、改工具表、插入又刪除提醒句、甚至讓圖片 URL 在後續請求回傳不同位元組,都會使後續 thinking 失效或報 400(The block is bound to a different conversation)。官方建議:歷史當 append-only;單輪提醒改用 clear_at: "next_user_message" 的系統訊息;修剪上下文用伺服器端 compaction,而不是客戶端改寫舊輪。這是為堵住把思考內容抽出再蒸餾的常見手法,也會打斷「每輪把狀態塞進歷史再刪掉」的自製 agent。新帳戶(官方寫 2026 年 8 月 31 日起)強制檢查;舊帳戶須自行設定 prefix_mismatch_behavior

4. 護欄更精準,但雙用途網絡工作仍會改道

官方稱網絡安全誤報干預較以往少約 60%,並允許 Fable 5.1 用於「找出軟件漏洞」這類防禦性識別;滲透測試、漏洞利用生成、基於二進位的漏洞掃描仍會改道到 Opus 系列。生物學方面,基礎與醫療常識誤報據稱減少 85%,但生命科學研發相關查詢仍指向 Opus;進階能力放在 Mythos 5.1 的生命科學核證計劃,並與美國政府合作。本文只陳述官方產品邊界,不討論任何攻擊或生物武器程序。

5. 科學能力是「工具迴圈」,不是單一聊天分數

新聞稿以三類實驗室例子說明長程研究:以開源蛋白質設計/摺疊工具產生高親和力結合劑並送外驗;用麥哲倫雷達影像訓練網絡、產出金星約三分一表面的更高解析度高程圖並以 CC 授權公開;為七個開源蛋白質/基因組模型寫自訂 GPU kernel,在 NVIDIA H100 上最高加速約 2.5 倍。這些例子的共同結構是:模型長時間呼叫工具、修正錯誤、對實驗或計算結果閉環——與 Terminal-Bench-Science 的設定一致。企業不應把「52.6%」直接讀成「可無人值守做新藥」;它量的是在受控基準裡走完計算研究工作流的比例。

四、日常應用場景

1. 開發者與技術團隊

適合已在用 Claude Code/自建 agent 做多檔重構、長時除錯、跨倉審查的團隊。遷移清單(官方):改模型 ID;移除強制 tool_choice;把對話當只追加;重新調 effort;在 agent 迴圈觀察是否由一次多工具變成每輪單工具。價格上,輸入/輸出不變,省的是快取讀取——要量自己工作流裡快取命中佔比,而不是只看價目表。

2. 企業與隱私敏感行業

Fable 5.1 回應三項客戶投訴:價錢、資料留存、過度攔截。EFS 的設計是資料放在客戶雲、人審預設由客戶做,並稱將支援 Claude Code、Claude Enterprise、Claude Platform、Amazon Bedrock、Google Agent Platform 與 Microsoft Foundry。這對金融、醫療、法律與受 NDA 約束的企業有意義,但時程是「今秋分階段」;在 EFS 落地前,合資格客戶走零留存,其餘仍是 30 日留存。香港機構若不能接受資料出境或境外子處理者,雲端前沿模型(即使有 EFS)仍可能過不了內部政策。

3. 一般用戶

Claude.ai 與消費端應用會拿到 Fable 5.1 的一般能力(官方稱「今日在所有平台提供」),但 Mythos 5.1、生命科學進階能力、企業零留存/EFS 都不在個人帳號範圍。一般用戶也不應把基準分數理解成「保證寫對生產代碼」。

4. 香港與亞洲市場視角

香港金融、法律、醫療與政府供應商同時面對兩股拉力:一邊是長程編碼/研究代理的生產力,另一邊是 PDPO、跨境傳輸、客戶合約與金管局/證監會對資料處理者的要求。實務上可拆三層:

  • 不含客戶機密的工程任務(開源倉、公開文件、內部已脱敏代碼)可評估 Fable 5.1 的快取降價與長程能力。
  • 含客戶資料、病歷、交易或受 NDA 約束的推論,須先回答:資料是否離開香港?留存多久?誰做人審?子處理者在哪?
  • 若答案不能是「資料留在境內、契約與稽核可控」,較穩妥的路徑仍是私有模型:以自有數據做 Dataset → QLoRA/LoRA,再以私有 API 對接現有系統。

YSK Limited 的企業私有 LLM 全託管面向此類需求:年費 HK$88,000 起,Dataset 製作、微調、私有託管與 OpenAI 相容 API,強調 100% 數據不出境,適合受 PDPO 與 NDA 約束的法律、金融與醫療團隊做概念驗證與內網上線。見 https://ysk.hk/services/ai-automation

五、專業評價與潛在考量

優勢

  • 在官方同一套件下,科學代理基準相對上代接近翻倍,長程編碼與業務工作流(AutomationBench 31.4% 對 17.1%)亦有明顯差距。
  • 輸入/輸出標價不變,靠快取讀取降 75% 降低密集 agent 帳單,商業敘事與技術機制一致。
  • 文件對破壞性 API 變更、thinking 綁定、蒸餾防護寫得具體,方便工程團隊做遷移風險清單。
  • 企業護欄(EFS)直接回應「要前沿模型、又要類似零留存」的採購矛盾。

需要留意的地方

  • Terminal-Bench-Science 誤差帶不窄;公開排行榜與官方內部重跑數字並不完全相同,採購不應只引用 52.6% 一格。
  • CursorBench 僅溫和領先,不宜與「科學編碼翻倍」混為同一句行銷。
  • 延遲官方標為較慢;預設 high effort 可能把帳單與等待時間一併推高,必須在對話中途降 effort。
  • 30 日留存是預設;EFS 尚未全面供應。香港受規管行業不能把「秋季推出」當成今日合規控制。
  • 三項破壞性 API 變更會令改寫歷史的自製 agent 直接失敗。
  • Mythos 5.1 現階段以美國受審核機構為主,亞洲團隊不能假設很快可申請到較寬鬆護欄。

結語

Claude Fable 5.1 把「更會長跑的編碼與研究代理」和「密集工作流更便宜」綁在同一則產品更新裡:標價不動,快取讀取大減,科學代理基準相對上代接近翻倍。對香港開發團隊,這是一次值得重跑內部評測與快取命中率的版本;對不能把客戶資料送出境外的機構,它仍是雲端前沿模型,不是境內主權方案。若企業需要在香港完成私有微調與託管,可參考 YSK Limited 的企業私有 LLM 全託管(年費 HK$88,000 起,100% 數據不出境):https://ysk.hk/services/ai-automation


參考來源

  1. Anthropic, Introducing Claude Fable 5.1 and Claude Mythos 5.1(2026-09-01):https://www.anthropic.com/claude-fable-and-mythos-5-1
  2. Claude Docs, Claude Fable 5.1 overview:https://platform.claude.com/docs/en/models/fable-5-1/overview
  3. Claude Docs, What's new in Claude Fable 5.1:https://platform.claude.com/docs/en/models/fable-5-1/whats-new-fable-5-1
  4. YSK Limited, 企業私有 LLM 全託管:https://ysk.hk/services/ai-automation
  5. YSK Limited, llms.txt(公司公開事實):https://ysk.hk/llms.txt

Related services & products