OpenAI Astra是加速走向失控的「算力怪獸」?能自己操作電腦、思維鏈恐越來越難讀懂
鉅亨網新聞中心
OpenAI推出新一代旗艦模型GPT-6 Astra,主打讓AI直接操作電腦、執行複雜任務,被公司視為邁向「AGI時代」的重要一步;然而,Astra採用的新架構也引發AI安全疑慮,專家警告,當模型推理過程逐漸難以被人類讀懂,未來AI監控可能面臨更大挑戰。

根據《財富》報導,OpenAI在9月3日發布Astra,其中一項代表性功能為「電腦使用」(Computer Use),讓AI能像人類一樣操作電腦。
OpenAI展示的影片中,使用者透過語音下達指令,AI則完成電腦操作,整體互動過程相對流暢。
OpenAI共同創辦人暨總裁Greg Brockman表示,電腦使用能力是Astra眾多新功能中相當重要的一項,模型可以高速處理試算表、填寫表單及瀏覽網頁。
除了電腦操作外,OpenAI也強調Astra在數學運算、軟體工程與網路安全防禦方面的能力。公司公布的基準測試結果顯示,Astra在多項任務上的表現優於GPT-5.6 Sol及Anthropic的Claude Fable 5.1。
在ARC-AGI-3測試中,Astra得分98.6%,GPT-5.6 Sol為7.8%,Claude Opus 5則為30%;該測試主要用於評估模型面對未見情境時的推理能力。在網路安全挑戰ExploitBench中,Astra則取得滿分,高於GPT-5.6 Sol的78.5%。
Brockman認為,電腦使用能力可能被視為「AGI時代」的開端。他指出,若有人認為目前已經進入AGI時代,這種看法並非毫無道理;甚至將Astra視為第一個AGI,也有其合理性。
不過,AGI的定義至今仍存在爭議。OpenAI過去曾將AGI定義為,能在所有具經濟價值的工作中達到或超越人類水準的自動化系統。
Brockman則表示,AGI並非突然出現,而是逐步累積形成。
Astra初期限縮開放 網路安全能力受到管制
儘管Astra具備直接操作電腦的能力,但OpenAI並未立即全面開放所有功能。公司初期僅向部分企業客戶提供Astra,包括專注網路安全的Daybreak計畫客戶,並計畫在數日內向Plus、Pro及Enterprise用戶開放,同時透過OpenAI API及AWS提供。
OpenAI表示,提供給相關客戶的版本不具備高階網路安全任務能力。
OpenAI發言人指出,Astra屬於規模非常大的模型,初期限制使用範圍,主要是為了逐步擴充計算能力。
OpenAI研究副總裁Aidan Clark則表示,Astra開發涉及公司迄今最大規模的訓練,首次在德州Stargate資料中心使用超過10萬顆GPU進行預訓練。
Astra的推出也與網路安全事件有關。OpenAI在7月Hugging Face遭AI代理入侵事件後延後Astra發布,以增加額外安全措施。此後,公司強化監控並進一步隔離訓練環境,但外界仍質疑新增監控措施是否足夠。
依照美國AI安全框架相關條款,OpenAI在發布Astra前也將模型提交美國政府審查。不過,該框架屬於科技業與川普政府之間的自願性協議,具體內容尚未公開,也不是正式的公開審查程序。
Astra同時成為OpenAI首個達到「關鍵網路安全能力門檻」的模型。這項門檻來自OpenAI內部「準備框架」,公司將依模型可能帶來的風險採取不同安全措施。
OpenAI表示,在適當條件下,Astra能夠在沒有人工監督的情況下發現並利用過去未知的安全漏洞,因此最先進的網路安全能力目前僅向部分合作夥伴開放。
Astra新架構引發疑慮 AI思維鏈恐更難監控
相較於Astra能直接操作電腦所帶來的能力提升,AI安全專家更關注其模型架構可能造成的另一項影響:人類未來是否還能看懂AI究竟是如何進行推理。
Astra部分採用了「循環深度」或「循環Transformer」技術。這種架構可以減少模型處理指令所需的計算資源,提高AI運算效率。
但另一方面,循環式處理也可能讓模型的思維鏈,也就是推理步驟,不再完全以自然語言呈現,使人類難以監控其行為及動機。
這對AI安全而言尤其重要。現階段,思維鏈監控被視為觀察AI代理是否產生意外或未經授權行為的重要方法之一。若模型的推理過程逐漸變得難以閱讀,人類監控其行為與意圖的難度也可能隨之提高。
OpenAI首席科學家Jakub Pachocki表示,公司對思維鏈監控高度重視,自早期推理模型推出以來,OpenAI便持續投入相關研究。他也透露,公司對循環Transformer的使用有所限制,以維持推理過程的可讀性。
Pachocki承認,未來思維鏈監控可能面臨更大的挑戰,但他認為這不一定源自模型架構本身,OpenAI仍可採取措施強化監控,相關工作也是目前研究重點之一。
不過,AI安全領域仍出現反對聲音。
曾任OpenAI安全研究員、現任Guidelight AI Standards負責人的Stephen Adler認為,OpenAI此舉可能踩到AI產業少數重要的安全紅線。
華盛頓特區智庫AI政策網路政策總監Peter Wildford也警告,OpenAI採用循環深度技術可能帶來令人擔憂的後果。
Wildford指出,在7月Hugging Face遭AI代理入侵事件中,OpenAI及外部AI評估公司能夠透過包括讀取模型思維鏈在內的方法,重建部分事件經過。如果未來AI的思維鏈變得更加難以理解,人類可能因此失去重要的監控手段。
前OpenAI治理研究員Daniel Kokotajlo則警告,即使OpenAI未進一步採用讓思維鏈更難理解的架構,其他AI公司仍可能跟進。
他因此呼籲Pachocki推動制定業界通用的思維鏈可監控性標準,避免AI模型推理過程的透明度持續下降。
延伸閱讀
- OpenAI已造出「異星心智」?首席科學家:RSI真的來了、呼籲人類煞車
- 黃仁勳宣告「AGI已經到來」!OpenAI GPT-6 Astra訓練動用逾10萬套輝達系統
- AI多頭等待的突破終於來了?高盛:OpenAI Astra模型「脫穎而出」
- OpenAI又出事!AI代理爆「劫持」德國Wiki、逾1.8萬次編輯引發AI安全疑慮
- 講座
- 公告
上一篇
下一篇