Fraud Blocker
AI 资讯

Claude Fable 5 正式發布:Anthropic 史上最強公開模型全解析(跑分、價格、對比 GPT-5.5)

Anthropic 於 6 月 9 日發布 Claude Fable 5:Mythos 級能力首次全面開放。SWE-Bench Pro 80.3% 碾壓 GPT-5.5,幻覺率不到對手一半。本文整理官方與第三方全部跑分對比、$10/$50 定價、6月22日免費窗口與安全機制。

Admin
2026年6月10日11 分鐘閱讀2118 次閱讀
Claude Fable 5 正式發布:Anthropic 史上最強公開模型全解析(跑分、價格、對比 GPT-5.5)Claude Fable 5 正式發布:Anthropic 史上最強公開模型全解析(跑分、價格、對比 GPT-5.5) - AI 资讯 - 一站式VPN开发平台

2026年6月9日,Anthropic 正式發布 Claude Fable 5 —— 這是該公司有史以來公開提供的最強 AI 模型。它與同日發布的受限版 Claude Mythos 5 系出同源:同一個 Mythos 級底層模型,Fable 5 是「加上安全護欄、面向所有人開放」的版本,而 Mythos 5 僅透過 Project Glasswing 向美國政府與受信任機構定向開放。

Claude Fable 5 發布主視覺

Fable 5 是什麼?和 Mythos 5 什麼關係?

簡單說:一個模型,兩種發行方式

  • Claude Fable 5(公開版):能力即 Mythos 級,但在網絡安全、生物/化學、模型蒸餾等高風險領域內置攔截 —— 觸發時會自動回退到 Claude Opus 4.8 來回答。Anthropic 稱這類回退平均出現在不到 5% 的會話中,95% 以上的會話全程由 Fable 5 本體回答。

  • Claude Mythos 5(受限版):在部分領域解除限制,號稱「全球網絡安全能力最強的模型」,目前僅向經審查的關鍵基礎設施機構與美國政府(Project Glasswing 合作框架)開放。

值得玩味的是發布時機:就在幾天前,Anthropic 還公開呼籲各大 AI 實驗室建立「前沿 AI 研發的協同剎車機制」,警告模型正在逼近遞歸自我改進的臨界點。一邊喊剎車、一邊放出史上最強公開模型,這也讓 Fable 5 成為本週科技圈爭議最大的發布。

跑分:對比 GPT-5.5 和 Gemini 3.1 Pro

Anthropic 官方與第三方(Vellum、Weights & Biases 等)公布的數據顯示,Fable 5 在幾乎所有能力基準上都是當前最強(SOTA):

軟件工程(最大亮點)

基準

Fable 5

Opus 4.8

GPT-5.5

Gemini 3.1 Pro

SWE-Bench Pro(智能體編程)

80.3%

69.2%

58.6%

54.2%

FrontierCode Diamond(高難編程)

29.3%

13.4%

5.7%

SWE-Bench Pro 領先 GPT-5.5 超過 21 個百分點;在 Cognition 的 FrontierCode 評測中即使開「中等推理力度」也是全場最高分。早期客戶 Stripe 的反饋是:「把數月的工程工作壓縮到了幾天」。

FrontierCode 評測:Fable 5 領先各前沿模型

知識、推理與視覺

基準

Fable 5 / Claude

GPT-5.5

Gemini 3.1 Pro

知識與推理綜合評分

1932

1769

1314

GDP.pdf(視覺理解,無工具)

29.8%

24.9%

16.7%

AA-Omniscience 幻覺率(越低越好)

36.18%

85.53%

49.87%

幻覺率是這次最被低估的數字:Claude 家族 36.18% 的幻覺率不到 GPT-5.5(85.53%)的一半,對金融、法律、醫療等「答錯要負責」的場景意義重大。Hebbia 的金融基準上 Fable 5 也拿下了所有模型中的最高分。

Claude Fable 5 官方基準對比表

價格與可用性

  • API 定價:輸入 $10 / 百萬 token,輸出 $50 / 百萬 token(約為此前 Mythos Preview 的一半,但是 Opus 4.8($5/$25)的兩倍、GPT-5.5($5/$30)的兩倍上下)

  • 最大輸出:單次最高 128k token

  • 訂閱用戶:Pro / Max / Team / 按席位的 Enterprise 用戶 6月22日前免費使用;6月23日起改為積分(credits)計費

  • API 與企業平台:已全量開放(模型 ID:claude-fable-5

安全機制:1000 小時紅隊,無通用越獄

  • 高風險領域(網絡攻擊利用、危險生物/化學研究、模型蒸餾)自動攔截並回退 Opus 4.8

  • 外部紅隊累計 1000+ 小時測試,未發現通用越獄(英國 AISI 在初步測試窗口內「有所進展」)

  • Mythos 級模型流量統一保留 30 天,僅用於安全目的,不用於訓練

需要注意的取捨:約二十分之一的會話實際由 Opus 4.8 接管 —— 對絕大多數業務場景無感,但安全研究者已提醒「你以為在用的模型未必是真正在回答的模型」。

對開發者和企業意味着什麼?

  1. 編程智能體的代差出現了。80.3% 的 SWE-Bench Pro 意味着大量真實工程任務可以端到端交給模型,「AI 結對程序員」正在變成「AI 工程師」。

  2. 貴,但單位產出未必貴。$10/$50 的價格是 GPT-5.5 的兩倍,但如果一次做對、少返工,綜合成本可能反而更低 —— 特別是配合 128k 輸出做大型重構。

  3. 6月22日是個時間窗口。訂閱用戶當前可免費用滿 Mythos 級能力,想評估的團隊應抓緊這兩週完成 PoC。

Neuronicx 平台已同步關注 Claude 全系產品動態,Claude Pro 會員、API 接口等數字產品可在商城直接選購,新模型相關產品上架會第一時間更新。

參考來源