‌
‌
‌
‌
‌
快訊

一夜兩條路線:Opus5.5衝到第一,GPT-6把同檔成本砍半

BlockBeats 律動財經

動察 Beating AI 快訊,Artificial Analysis 完成對昨夜幾款新模型的第三方實測。Claude Opus 5.5 max 在 Intelligence Index v4.3 拿到 58 分,目前排名第一。GPT-6 Astra 和 Fable 5.1 都是 53 分,Opus 5 為 51 分。Opus 5.5 在 10 項評測裡拿下 6 項最高分。


但這個最高分也用了更多 token。Opus 5.5 max 每項任務平均輸出約 11.9 萬 tokens,比 Opus 5 的 7.3 萬多約 60%。靠 API 降價 20% 和快取讀取降價 60%,單任務成本最終為 5.98 美元,和 Opus 5 的 5.86 美元基本持平。更實用的 medium 檔拿到 51 分,已經追平 Opus 5 max,單任務成本只有 1.34 美元。

‌


OpenAI 走的則是另一條路。GPT-6 Sol 和 Luna 的 Intelligence Index 表現與 GPT-5.6 前代接近,但價格明顯下降。Sol max 每項任務成本從 1.99 美元降到 1.06 美元,Luna 從 0.18 美元降到 0.07 美元。編碼 Agent 評測裡,Sol 從 55 分升到 57 分,成本也下降約一半;Luna 從 43 分降到 41 分,但單任務成本低約 60%。


‌

兩家的路線已經開始出現分化:Opus 5.5 用更多推理把能力上限推到新高,GPT-6 Sol 和 Luna 則主要把原有能力做得更便宜。 在 Artificial Analysis 的效能/成本圖上,兩家的新模型都佔據了新的 Pareto 前沿。

原文連結

發佈者對本文章的內容承擔全部責任
在投資加密貨幣前,請務必深入研究,理解相關風險,並謹慎評估自己的風險承受能力。不要因為短期高回報的誘惑而忽視潛在的重大損失。

暢行幣圈交易全攻略,專家駐群實戰交流

▌立即加入鉅亨買幣實戰交流 LINE 社群(點此入群)
不管是新手發問,還是老手交流,只要你想參與加密貨幣現貨交易、合約跟單、合約網格、量化交易、理財產品的投資,都歡迎入群討論學習!

▶ 前往鉅亨買幣找交易所優惠

‌
section icon

鉅亨講座

看更多
  • 講座
  • 公告
    ‌
    Empty
    Empty
    ‌