Claude Fable 5 正式發布:Anthropic 史上最強公開模型全解析(跑分、價格、對比 GPT-5.5)
Anthropic 於 6 月 9 日發布 Claude Fable 5:Mythos 級能力首次全面開放。SWE-Bench Pro 80.3% 碾壓 GPT-5.5,幻覺率不到對手一半。本文整理官方與第三方全部跑分對比、$10/$50 定價、6月22日免費窗口與安全機制。
Claude Fable 5 正式發布:Anthropic 史上最強公開模型全解析(跑分、價格、對比 GPT-5.5) - AI 资讯 - 一站式VPN开发平台2026年6月9日,Anthropic 正式發布 Claude Fable 5 —— 這是該公司有史以來公開提供的最強 AI 模型。它與同日發布的受限版 Claude Mythos 5 系出同源:同一個 Mythos 級底層模型,Fable 5 是「加上安全護欄、面向所有人開放」的版本,而 Mythos 5 僅透過 Project Glasswing 向美國政府與受信任機構定向開放。

Fable 5 是什麼?和 Mythos 5 什麼關係?
簡單說:一個模型,兩種發行方式。
Claude Fable 5(公開版):能力即 Mythos 級,但在網絡安全、生物/化學、模型蒸餾等高風險領域內置攔截 —— 觸發時會自動回退到 Claude Opus 4.8 來回答。Anthropic 稱這類回退平均出現在不到 5% 的會話中,95% 以上的會話全程由 Fable 5 本體回答。
Claude Mythos 5(受限版):在部分領域解除限制,號稱「全球網絡安全能力最強的模型」,目前僅向經審查的關鍵基礎設施機構與美國政府(Project Glasswing 合作框架)開放。
值得玩味的是發布時機:就在幾天前,Anthropic 還公開呼籲各大 AI 實驗室建立「前沿 AI 研發的協同剎車機制」,警告模型正在逼近遞歸自我改進的臨界點。一邊喊剎車、一邊放出史上最強公開模型,這也讓 Fable 5 成為本週科技圈爭議最大的發布。
跑分:對比 GPT-5.5 和 Gemini 3.1 Pro
Anthropic 官方與第三方(Vellum、Weights & Biases 等)公布的數據顯示,Fable 5 在幾乎所有能力基準上都是當前最強(SOTA):
軟件工程(最大亮點)
基準 | Fable 5 | Opus 4.8 | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|---|
SWE-Bench Pro(智能體編程) | 80.3% | 69.2% | 58.6% | 54.2% |
FrontierCode Diamond(高難編程) | 29.3% | 13.4% | 5.7% | — |
SWE-Bench Pro 領先 GPT-5.5 超過 21 個百分點;在 Cognition 的 FrontierCode 評測中即使開「中等推理力度」也是全場最高分。早期客戶 Stripe 的反饋是:「把數月的工程工作壓縮到了幾天」。

知識、推理與視覺
基準 | Fable 5 / Claude | GPT-5.5 | Gemini 3.1 Pro |
|---|---|---|---|
知識與推理綜合評分 | 1932 | 1769 | 1314 |
GDP.pdf(視覺理解,無工具) | 29.8% | 24.9% | 16.7% |
AA-Omniscience 幻覺率(越低越好) | 36.18% | 85.53% | 49.87% |
幻覺率是這次最被低估的數字:Claude 家族 36.18% 的幻覺率不到 GPT-5.5(85.53%)的一半,對金融、法律、醫療等「答錯要負責」的場景意義重大。Hebbia 的金融基準上 Fable 5 也拿下了所有模型中的最高分。

價格與可用性
API 定價:輸入 $10 / 百萬 token,輸出 $50 / 百萬 token(約為此前 Mythos Preview 的一半,但是 Opus 4.8($5/$25)的兩倍、GPT-5.5($5/$30)的兩倍上下)
最大輸出:單次最高 128k token
訂閱用戶:Pro / Max / Team / 按席位的 Enterprise 用戶 6月22日前免費使用;6月23日起改為積分(credits)計費
API 與企業平台:已全量開放(模型 ID:
claude-fable-5)
安全機制:1000 小時紅隊,無通用越獄
高風險領域(網絡攻擊利用、危險生物/化學研究、模型蒸餾)自動攔截並回退 Opus 4.8
外部紅隊累計 1000+ 小時測試,未發現通用越獄(英國 AISI 在初步測試窗口內「有所進展」)
Mythos 級模型流量統一保留 30 天,僅用於安全目的,不用於訓練
需要注意的取捨:約二十分之一的會話實際由 Opus 4.8 接管 —— 對絕大多數業務場景無感,但安全研究者已提醒「你以為在用的模型未必是真正在回答的模型」。
對開發者和企業意味着什麼?
編程智能體的代差出現了。80.3% 的 SWE-Bench Pro 意味着大量真實工程任務可以端到端交給模型,「AI 結對程序員」正在變成「AI 工程師」。
貴,但單位產出未必貴。$10/$50 的價格是 GPT-5.5 的兩倍,但如果一次做對、少返工,綜合成本可能反而更低 —— 特別是配合 128k 輸出做大型重構。
6月22日是個時間窗口。訂閱用戶當前可免費用滿 Mythos 級能力,想評估的團隊應抓緊這兩週完成 PoC。
Neuronicx 平台已同步關注 Claude 全系產品動態,Claude Pro 會員、API 接口等數字產品可在商城直接選購,新模型相關產品上架會第一時間更新。