Anthropic 推出頂級旗艦模型 Claude Fable 5.1 與 Mythos 5.1
發布時間:
Anthropic 9 月 1 日推出最新 Claude Fable 5.1 模型,同時還發表對外開放的 Claude Mythos 5.1,這兩個模型權重相同,差別在於安全閥設定: Fable 給一般用戶和企業用,Mythos 則留給做資安或生命科學、而且已經通過審查的合作對象。Fable/Mythos 這條產品線六月才剛亮相; 當時 Fable 5 上線沒幾天就整批下架,七月才恢復,八月又因為生物相關問題擋得太兇,再調過一輪防護。三個月內修了三次,外界對價錢、資料要不要留在 Anthropic 伺服器,5.1 等於把這些問題一次解決。

在價格方面並沒有變化: 輸入每百萬 token 10 美元,輸出 50 美元,跟 Fable 5 相同,大約是 Opus 5 的兩倍。但 Fable 5.1 大幅降低了快取讀取成本,從每百萬 1 美元降到 0.25 美元。官方估算,普通工作大概少付四分之一,代理程式反覆讀同一份程式碼或長文件時,帳單有機會少到接近 45%。資料知識切在 2026 年 6 月,上下文一百萬 token,單次最多吐出 12.8 萬。思考模式預設開啟,深度用 effort 參數調。如果想把推論鎖在美國境內,輸入輸出再乘 1.1。
Anthropic 的官方測試數據中,最醒目的是科學代理測試 Terminal-Bench-Science 0.1。Fable 5.1 大約 52.6%,前代約 24.7%,OpenAI 的 GPT-5.6 Sol 約 22.4%。寫程式的 Terminal-Bench 4.0,Fable 5.1 約 55.8%,Mythos 5.1 約 60.9%,Fable 5 約 42%。第三方評測站 Vals 把 Fable 5.1 排在總榜第一,約 67.87%,略高於 Opus 5 和 Fable 5。LiveCodeBench、MMLU Pro、MMMU Pro 也多半領先或並列。法律代理人那項反而比前代差,所以不能把它寫成全面第一。媒體新創 Every 的執行長 Dan Shipper 試完後說,這是他們用過最能寫程式的模型,而且比較快、比較省 token,講話也比較像人。專門做程式審查的 CodeRabbit 測下來,已知問題抓得到的比例差不多,總評語少了約三成,碎念少了七成,單次審查卻更慢。Anthropic 文件裡自己也寫,多數日常工作先用 Opus 5 就夠,Fable 留給 Opus 把 effort 開高仍做不完的長任務。

在安全防護方面也有改進: 一般生物、醫學問題比較不容易被誤擋,找軟體漏洞可以幫忙,滲透測試、寫 exploit、掃二進位仍會被導去 Opus 或 Mythos。Fable 5.1 被歸成 Covered Model,預設可留存最多 30 天,並接受人工抽查。企業若不想資料出自己的雲,則要等秋天的 Enterprise Frontier Safeguards。產品宣稱有對齊歐盟 AI 法對生成內容標示的實務守則,浮水印和偵測 API 目前還在封閉預覽。
Anthropic 同時也開放 claude-fable-5-1 API。Claude.ai 的 Pro、Max、Team、Enterprise 都能選用,Amazon Bedrock、Google Cloud、Microsoft Foundry 即日起也可使用。但如果從從 Fable 5 直接改 model id 則可能會有不相容或指定工具報錯問題,主要是新模型的 thinking block 與舊模型不相容。
- Anthropic 發表頁
https://www.anthropic.com/claude-fable-and-mythos-5-1 - Claude 平台規格與更新說明
https://platform.claude.com/docs/en/models/fable-5-1/overview
https://platform.claude.com/docs/en/models/fable-5-1/whats-new-fable-5-1 - AWS Bedrock 上線說明
https://aws.amazon.com/blogs/machine-learning/introducing-claude-fable-5-1-on-aws/


