AI News字數 3092閱讀時長8 分鐘

Anthropic 推出 Claude Fable 5.1,降低代理成本並提供受限的 Mythos 版本

Claude Fable 5.1 提供更強的代理式效能、快取讀取成本降低 75%,以及經修訂的安全防護措施,而 Mythos 5.1 仍受限使用。

文章目錄 · 12
  1. 一、Fable 5.1 針對長時程代理工作
  2. 二、Anthropic 報告廣泛的基準測試提升
  3. 三、Fable 與 Mythos 共享智能,但不共享存取權限
  4. 四、安全防護措施現時產生較少誤判
  5. 五、快取定價及企業資料控制改變部署經濟效益
  6. 常見問題
  7. Claude Fable 5.1 是否可普遍使用?
  8. Claude Mythos 5.1 是否另一個模型?
  9. 透過 API 使用 Fable 5.1 的費用是多少?
  10. 上下文及輸出限制是甚麼?
  11. Fable 5.1 可進行滲透測試嗎?
  12. 參考來源

Anthropic 於 9 月 1 日發布 Claude Fable 5.1,將其定位為目前最強、可普遍使用的模型,適用於長時間運行的編程、研究及知識工作代理。公司同時推出 Claude Mythos 5.1;這是同一底層模型的僅限受邀版本,為獲批准的網絡安全及生命科學機構提供較寬鬆的安全防護措施。

Fable 5.1 保持上一代的基本 API 定價:每百萬個輸入 token 為 $10,每百萬個輸出 token 為 $50。具影響力的定價變動是快取讀取成本降低 75%,由每百萬個 token $1 降至 $0.25。Anthropic 估計,這可令一般 Fable 工作負載的總成本降低約 25%,而高度代理式工作負載的成本最多可降低 45%。

此次發布亦修訂了原版 Fable 5 的安全防護措施;該等措施曾令部分正當的生物學及安全工作難以進行。Fable 5.1 現可識別原始碼中的漏洞,但滲透測試、漏洞利用程式生成、二進位漏洞掃描及高階生命科學研究,仍受限制或會被轉送至能力較低的模型。

一、Fable 5.1 針對長時程代理工作

Fable 5.1 接替 Fable 5;Anthropic 於 2026 年 6 月 9 日推出後者,用於可非同步運行數天的複雜任務。新模型保留這個重點,但在編程、電腦操作、科學研究、商業流程及跨學科推理方面提升了效能。

API 模型識別碼為 claude-fable-5-1。它可接受文字及圖片輸入,並產生文字輸出,具備一百萬個 token 的上下文視窗,以及最高 128,000 個 token 的輸出上限。自適應思考會一直啟用,而該模型記錄的可靠知識及訓練資料截止日期均為 2026 年 6 月。

Anthropic 將 Fable 5.1 描述為適合高要求推理及長時程代理的選項,而非每個應用程式的預設選擇。其模型選擇指引建議,大多數工作負載先由成本較低的 Claude Opus 5 開始;如在較高 Opus 努力程度下的評估結果仍不足,才改用 Fable 5.1。

該模型可透過 Claude 的 Pro、Max、Team 及 Enterprise 計劃使用。開發人員可經 Claude API、Amazon Bedrock、AWS 上的 Claude Platform、Google Cloud 及 Microsoft Foundry 存取。Anthropic 亦提供僅限美國的推論服務,輸入及輸出價格為標準價格的 1.1 倍。

Fable 5.1 在 Claude Code 中預設使用高努力程度,但在 Claude Cowork 及 Claude.ai 中則使用中等努力程度。Anthropic 表示,較低的努力程度設定可在較低成本下接近或超越 Fable 5 的效能,讓開發人員多一項控制延遲及 token 消耗的方法。

二、Anthropic 報告廣泛的基準測試提升

Anthropic 公布的評估顯示,在其發布比較中的每項基準測試上,Fable 5.1 均較 Fable 5 有所提升。這些結果由供應商自行報告,當中多項採用了最近修訂的測試,或 Anthropic 自己的評估配置。

在衡量終端機環境中代理式科學工作的 Terminal-Bench-Science 0.1 上,Fable 5.1 得分為 52.6%,相比之下 Fable 5 為 24.7%、Opus 5 為 29.0%、GPT-5.6 Sol 為 22.4%。Anthropic 報告每個模型的標準誤差介乎 3.5 至 4.5 個百分點。

Fable 5.1 在代理式編程基準 Terminal-Bench 4.0 上得分 55.8%。Mythos 5.1 在同一測試達到 60.9%,而 Fable 5 得分為 42.0%、Opus 5 為 52.3%、GPT-5.6 Sol 為 37.3%。由於 Fable 與 Mythos 使用相同的底層模型,Anthropic 將兩者結果的差距歸因於 Fable 的安全防護措施介入的任務。

在 CursorBench 3.2.0 上,Fable 5.1 得分為 73.4%,領先 Fable 5 的 70.5%、Opus 5 的 70.0% 及 GPT-5.6 Sol 的 67.2%。其 AutomationBench 分數由 Fable 5 的 17.1% 升至 31.4%。在啟用工具時,該模型在 Humanity’s Last Exam 亦達到 65.0%,相比 Fable 5 的 63.8% 及 Opus 5 的 63.6%。

Anthropic 在啟用其生產環境安全防護措施的情況下評估 Fable 5.1。當這些措施介入時,公司會在某些 OSWorld 任務中給予零分;而另一些被標記的網絡安全及生物學任務,則由備援 Opus 模型完成。因此,公司提醒,已公布的結果反映了底層模型及其已部署的路由系統。

三、Fable 與 Mythos 共享智能,但不共享存取權限

Claude Mythos 5.1 並非比 Fable 5.1 更強大的基礎模型。Anthropic 表示,兩者在模型層面完全相同;分別在於 Mythos 為經審核的機構採用較寬鬆的安全防護措施,讓其專業工作不會因而觸發 Fable 的限制。

Mythos 5.1 擁有相同的一百萬個 token 上下文視窗、128,000 個 token 的最高輸出、自適應思考,以及每百萬個輸入 token $10 和每百萬個輸出 token $50 的定價。其 API 識別碼為 claude-mythos-5-1,但僅限受邀使用,目前只向獲選的美國機構開放。

生命科學存取權正透過與美國政府共同開發的 Life Sciences Verification Program 組織安排。Anthropic 已招募首批機構,並表示計劃擴大招募範圍。該計劃會放寬獲批准研發工作的生物學限制,同時保留模型的其他安全防護措施。

Cyber Verification Program 目前讓合資格防禦人員可存取某些 Opus 及 Sonnet 級模型,並減少網絡安全限制。Anthropic 表示,Mythos 級別存取權將於不久後加入。公司的程式碼庫掃描產品 Claude Security 已在 Mythos 5.1 上運行。

這種雙層部署讓 Anthropic 能廣泛提供模型的一般編程及推理能力,同時將其限制最少的網絡及生物能力置於機構驗證之後。這亦表示,Mythos 的基準測試結果不能自動視為一般 Fable 用戶可取得的結果。

四、安全防護措施現時產生較少誤判

Fable 5 引入了對生物學及網絡安全異常嚴格的分類器。當請求觸發它們時,Claude 可能會改用 Opus 模型,而非以 Fable 完成任務。Anthropic 承認,原有實作阻擋了許多無害的醫療、教育及防禦性安全請求。

相較隨 Fable 5 推出的分類器,更新後的生物學安全防護措施對無害基礎生物學及醫療提示的介入頻率降低約 85%。因此,日常健康問題、臨床支援及生物學教育應會遇到較少模型替換。涉及病毒學、毒理學或分子設計等領域的研究,除非用戶符合 Mythos 存取資格,否則仍可能被路由至 Opus。

在網絡安全方面,預計 Claude Code 用戶每個工作階段遇到的安全防護措施介入將減少約 60%。Fable 5.1 可檢查原始碼以識別漏洞,但仍會轉送滲透測試、漏洞利用開發及基於二進位檔案的漏洞掃描。

Axios 獨立報道,這些介入已成為實際的客戶關注事項,部分開發人員因正當工作被中斷而尋求減少對 Claude 的依賴。因此,這些改動的影響不止於拒絕率:較少意外的備援切換,應令編程代理的行為及成本估算更可預測。

Anthropic 亦新增防蒸餾限制。新的 API 帳戶不可再編輯 Claude 較早的上下文,同時保留模型先前的思考記錄。現有帳戶初步獲豁免,但 Anthropic 表示該限制將隨未來模型發布套用至所有用戶,可能需要改動會重寫對話歷史的整合方案。

五、快取定價及企業資料控制改變部署經濟效益

標準輸入及輸出費率沒有下降,但對於反覆重用長指令、儲存庫上下文、工具結果或累積任務歷史的代理而言,快取讀取尤其重要。將該價格降至每百萬個 token $0.25,會使快取上下文佔大部分 token 消耗的長工作階段獲得不成比例的好處。

Anthropic 根據 2026 年 8 月四星期的實際使用情況,計算出其一般工作負載節省 25% 及高度代理式工作負載節省 45% 的估算。實際節省幅度將取決於應用程式重用快取上下文的頻率;以新輸入或生成輸出為主的工作負載,降幅會較小。

資料保留仍是另一項部署限制。Fable 及 Mythos 預設需要保留資料 30 天以作安全監察。Anthropic 表示,這項監察旨在偵測分散於多個工作階段或帳戶的濫用模式,而不是未經許可便使用企業資料訓練模型。

新的 Enterprise Frontier Safeguards 系統旨在協調該等監察與零資料保留要求。在 EFS 下,活動資料可保留於由客戶控制的雲端基礎設施中,使用客戶的加密金鑰、存取政策及稽核日誌。自動監察可標記可疑模式,而人工審核預設由客戶而非 Anthropic 進行。

EFS 與超過 100 間機構共同設計,並計劃於 2026 年秋季開始分階段推出。合資格客戶可在系統推出前,按零資料保留條款使用 Fable 5 及 Fable 5.1。Anthropic 不會就 EFS 另外收費,但客戶仍須負責雲端儲存及資料傳輸費用。

Fable 5.1 及 Mythos 5.1 亦引入不可見文字浮水印,以遵守歐盟對於 2026 年 8 月 2 日後發布模型的透明度規則。Anthropic 表示,浮水印會改變 token 選擇的隨機性,而不會加入隱藏字元、額外 token 或可識別用戶身分的資料。偵測功能初期會透過供合資格機構使用的私人預覽 API 提供。

常見問題

Claude Fable 5.1 是否可普遍使用?

是。它可透過付費 Claude 計劃、Claude API 及支援的雲端平台使用。API 模型識別碼為 claude-fable-5-1

Claude Mythos 5.1 是否另一個模型?

不是。Anthropic 表示 Fable 5.1 與 Mythos 5.1 使用相同的底層模型。Mythos 採用較寬鬆的安全防護措施,且僅限經審核的機構使用。

透過 API 使用 Fable 5.1 的費用是多少?

標準定價為每百萬個輸入 token $10,以及每百萬個輸出 token $50。快取讀取費用為每百萬個 token $0.25。

上下文及輸出限制是甚麼?

Fable 5.1 支援一百萬個 token 的上下文視窗,每個請求最多可輸出 128,000 個 token。

Fable 5.1 可進行滲透測試嗎?

其安全防護措施仍會轉送滲透測試、漏洞利用程式生成及基於二進位檔案的漏洞掃描。它可為防禦目的識別原始碼中的漏洞。

參考來源

Share

分享這篇文章