美股

Anthropic推Claude Fable 5.1!AI不只會回答問題、蛋白質設計成功率近50%

鉅亨網新聞中心

人工智慧(AI)模型競爭正從單純比拚基準測試成績,逐步轉向實際解決複雜問題的能力。Anthropic於1日推出Claude Fable 5.1與Claude Mythos 5.1,強調新一代模型不只提供答案,也能進一步執行程式除錯、蛋白質設計、GPU效能最佳化及行星地圖繪製等工作。

cover image of news article
Anthropic推Claude Fable 5.1!AI不只會回答問題、蛋白質設計成功率近50%(圖:Shutterstock)

Anthropic在官方部落格指出,一家投資機構長期受到軟體崩潰問題困擾,工程師始終無法找出原因,甚至曾使用其他AI模型協助分析仍沒有結果。直到交由Fable 5.1處理後,才成功找出問題根源。


這也凸顯AI模型能力發展的方向正在改變:從過去以回答問題為主,進一步朝能夠自主處理複雜任務的方向發展。

Fable 5.1效能大幅提升 蛋白質設計成功率近50%

在Terminal-Bench-Science 0.1基準測試中,Fable 5.1拿下52.6%成績,較上一代提升超過一倍;在程式設計測試中的表現也提升13%。

Fable 5.1同時展現出跨領域的任務處理能力。Anthropic讓模型取得開源蛋白質設計工具的使用權限,要求其設計能夠高親和力結合特定標靶的蛋白質。模型提出的設計隨後交由兩家外部機構進行實驗驗證。

結果顯示,在3個標靶上,Fable 5.1設計的蛋白質結合親和力較此前蛋白質設計競賽中的最佳作品高出10倍以上,整體成功率接近50%,高於過去蛋白質設計典型約10%至15%的成功率。

Anthropic表示,針對12個標靶提出的設計,全部都經外部實驗室驗證為有效結合物。

在計算生物學方面,Fable 5.1也重新撰寫7個開源深度學習模型的GPU核心程式碼,使這些模型的推理速度最高提升2.5倍,同時維持完全一致的輸出結果。

由於相關模型在一般實驗中有時需要執行數千次,經過最佳化後,GPU成本可降低30%至60%。

Anthropic指出,過去這類效能最佳化通常需要性能工程團隊投入數週時間,Fable 5.1則僅花費數天,且只依靠公開原始碼完成。

AI重建金星地圖 解析度提升至23公里

Fable 5.1還將AI能力延伸至行星科學領域。

Anthropic讓模型利用NASA麥哲倫探測器30多年前取得的雷達影像資料,訓練神經網路並重新繪製金星表面約三分之一區域的高解析度地形圖。

此前已有涵蓋金星約五分之一範圍的地圖,但解析度約為10至20公里。Fable 5.1製作的新地圖則將細節提升至2至3公里,高度精度提高25%。

這份地圖以知識共享授權方式發布,可作為NASA即將進行的VERITAS任務及歐洲太空總署(ESA)EnVision任務的參考。

Fable 5.1全面開放 Mythos 5.1鎖定經審核機構

此次發布另一項值得注意的變化,是Anthropic同步推出兩個版本的模型。

Fable 5.1向所有使用者開放,Mythos 5.1則僅提供給通過審核的機構使用。兩者的模型能力相同,主要差異在於安全限制的嚴格程度。

Mythos 5.1放寬部分限制後,可以處理網路安全與生命科學領域的敏感任務。Anthropic並形容,Mythos 5.1是公司截至目前推出的模型中「網路能力最強」的一款。

Anthropic此次也調整安全機制。由於開發者過去經常反映安全護欄過於嚴格,導致部分無害請求遭到攔截,Fable 5.1針對生物與醫學相關任務的安全攔截率降低85%,網路安全領域的防禦性任務攔截則減少約60%。

企業客戶則將取得新的Enterprise Frontier Safeguards功能。企業可將資料留存在自有雲端環境,不必將資料存放於Anthropic伺服器;人工審查也預設由企業客戶自行執行,形成零資料保留的隱私方案,同時讓Anthropic持續具備偵測及阻止模型遭到濫用的能力。

這項功能由Anthropic與超過100家客戶,以及亞馬遜雲端科技、Google Cloud、Microsoft Azure等雲端合作夥伴共同開發,預計分階段推出。

Fable 5.1 API降價 複雜AI代理任務最高省45%

除了能力提升,Anthropic也同步調降Fable 5.1的使用成本。

其中,快取讀取費用降低約75%,每百萬token價格降至0.25美元。對一般任務而言,整體成本較Fable 5降低約25%;如果是大量使用AI代理(AI Agent)的複雜任務,成本降幅最高可達45%。

價格下降與Anthropic近期擴大算力基礎建設布局也有所關聯。

Anthropic在此次模型發布前一天,與雲端服務業者Lambda簽署350億美元算力租賃協議;幾天前則與Nscale簽署另一筆450億美元協議。兩筆交易將為Anthropic鎖定未來數年的大規模算力。

其中,Lambda提供給Anthropic的基礎設施將部署在美國德州Nueces縣一座正在興建的資料中心,由Hut 8 (HUT-US) 負責建設;輝達(NVDA-US) 也將持有該園區的租約。

Hut 8位於Nueces縣的園區總容量為1GW,其中704MW已出租給一家未具名客戶,後來確認租戶為輝達。

Anthropic出手防AI 封堵提取模型思考過程

Anthropic也針對模型蒸餾推出新的防禦措施。所謂模型蒸餾,是利用高階模型的輸出訓練成本較低模型的方法,但這項技術有時會遭到大規模濫用。

Anthropic表示,在新的防禦機制下,新建立的API帳戶將無法透過多輪對話編輯Claude的上下文歷史,以此提取模型的思考過程。

這種做法過去是常見的模型蒸餾手段,如今將受到限制。新措施將逐步推行,現有帳戶暫時不受影響,但未來將適用於所有使用者。

整體而言,Fable 5.1與Mythos 5.1的推出顯示,AI模型競爭正從基準測試分數進一步延伸至實際問題解決能力。同時,模型成本、安全機制、企業資料隱私,以及防止模型遭到濫用,也逐漸成為新一輪AI競爭的重要面向。


section icon

鉅亨講座

看更多
  • 講座
  • 公告

    Empty
    Empty