Anthropic 發佈 Claude Fable 5:性能翻倍但價格漲至 2 倍
核心要點
Anthropic 推出最強模型 Fable 5,代碼遷移效率提升數十倍,但定價較 Opus 4.8 翻倍,部分用戶需付費使用。
就在剛剛,Anthropic 正式宣佈推出其最新旗艦模型 Claude Fable 5。該名稱源自拉丁語'fabula',寓意'故事'或'傳說',象徵着其在人工智能領域的敘事能力。據官方披露,Claude Fable 5 在軟件工程、知識處理、視覺識別及科學研究等核心維度均展現出壓倒性優勢。與過往版本相比,該模型在處理長上下文任務時效率顯著提升,能夠連續處理數百萬條數據並維持高輸出質量,同時具備自我記錄以優化結果的能力。知名 AI 研究者 Karpathy 在體驗後評價稱,這一版本'非常令人興奮',其性能躍升幅度與去年 11 月發佈的 Claude 4.5 相當,堪稱一次重大的版本迭代。
儘管性能卓越,但出於安全考量,Claude Fable 5 引入了動態降級機制。當模型檢測到特定高風險查詢或疑似被惡意利用時,會自動切換至 Claude Opus 4.8 模式進行響應。這一策略旨在平衡能力與安全,確保在 95% 的對話場景中模型性能不受影響。
與此同時,備受矚目的尖端模型 Claude Mythos 5 已通過'Project Glasswing'計劃向部分網絡安全專家和基礎設施提供商開放測試。午方 AI 梳理發現,這兩款新模型的價格策略均發生了顯著變化,雖然比預覽版低了一半以上,但定價仍是 Opus 4.8 的兩倍,且輸入成本比 GPT-5.5 高出 1.5 倍,輸出成本則高出 2/3。
在商業化落地方面,Claude Fable 5 即日起通過全渠道向所有用戶開放,而 Claude Mythos 5 目前僅限 Glasswing 合作伙伴訪問,未來將通過擴大的'可信訪問計劃'逐步推向公衆。對於 Pro、Max、Team 及按席位計費的 Enterprise 訂閱用戶,初期可免費使用 Claude Fable 5,無需額外付費。
然而,這一免費政策將於 6 月 23 日終止,屆時用戶需消耗相應額度才能繼續使用。Anthropic 表示,若資源允許,將延長免費期限,並計劃在未來資源充足時將其重新納入標準訂閱套餐。
基準測試數據進一步印證了 Anthropic 關於'最強模型'的宣稱。在軟件工程領域,Claude Fable 5 展現了驚人的效率,能夠將原本需數月完成的開發工作壓縮至幾天。例如,在一個包含 5000 萬行 Ruby 代碼的項目中,該模型僅用一天便完成了整個代碼庫的遷移,而人工完成此項任務需耗時兩個多月。在 Cognition 的 FrontierCode 評估中,該模型在中等難度設置下即取得最高分,證明了其卓越的數據處理效率。
午方 AI 注意到,在知識處理與視覺任務方面,Claude Fable 5 同樣表現突出。在 Hebbia 針對高級推理設計的金融基準測試中,該模型在所有參測模型中斬獲最高分,尤其在基於文檔的推理、圖表解讀及問題解決能力上顯著提升。視覺方面,它能從複雜的科學圖表中提取精確數據,甚至僅憑截圖即可重建網頁應用源代碼。
此外,其對輔助工具的依賴度大幅降低,例如在無需外部輔助的情況下,Claude Fable 5 幾乎能獨立完成《寶可夢紅寶石》遊戲,而前代模型即便有工具輔助也難以通關。
在科研與長程任務領域,該模型同樣展現出突破性進展。在記憶與上下文理解、藥物設計、分子生物學及基因組學等方面,Claude Fable 5 能夠處理數百萬條長序列數據。以紙牌遊戲'Slay the Spire'爲例,若提供持久化文件級存儲,其表現較 Claude Opus 4.8 提升三倍,進入最終關卡的頻率也顯著增加。利用 Claude Mythos 5,Anthropic 內部蛋白質設計專家將藥物設計環節效率提升了約 10 倍。作爲首個能持續提出新穎科學假設的模型,Mythos 5 在盲測中讓科學家在 80% 的情況下更傾向於選擇其提出的分子生物學假設,部分假設已進入實驗驗證階段,甚至關於大腸桿菌蛋白質新機制的假設也在獨立研究中得到證實。
面對大型語言模型自主學習速度加快引發的全球暫停 AI 發展呼聲,Anthropic 在最新報告中強調已設置限制措施,明確'限制 Claude 在高級大語言模型開發任務中的效果',以強化防護。
與此同時,市場傳言 OpenAI 的 GPT-5.6 也將在本週發佈,AI 巨頭間的新一輪技術較量即將拉開帷幕。
評論
暫無評論