鉅亨網編譯莊閔棻
美國人工智慧(AI)產業監督組織「Midas Project」最新分析指出,OpenAI過去一年可能多次違反加州AI安全法,其中包括最新AI模型GPT-6 Astra的發布。
根據《財富》報導,Midas Project是一個非營利組織,自稱致力於監督AI產業,確保AI發展成果不只由開發AI的企業享有。該組織認為,OpenAI今年至少3度未遵守加州新制定的AI安全法規。
爭議核心在於,OpenAI未依照自身承諾,公布相關模型面對「失去人類控制」風險時應進行的風險評估。
加州《尖端AI透明度法》(Transparency in Frontier AI Act,SB 53)於2025年9月簽署成法,今年初正式生效。這項法律要求大型AI開發商公布安全框架,說明如何評估及降低AI風險,同時也要求業者遵守自己所制定的安全政策。
5月,OpenAI發布《尖端治理框架》(Frontier Governance Framework,FGF),這份政策文件正是新法所要求的內容。該框架指出,OpenAI將針對每一個新模型評估4大類風險,並在各類風險中分別給予1至3級的「風險等級」。針對不同的風險等級,公司也承諾將採取相應的風險緩解措施。
這4類風險分別為:網路攻擊、化學、生物、放射性與核能、有害操縱,以及失去控制。
Midas Project創辦人Tyler Johnston向《財富》表示,加州SB 53的要求是AI企業採納安全政策並確實執行,企業可以自行決定安全規則,但一旦制定後就必須遵守。
OpenAI則表示,公司「有信心」遵守SB 53,並指出,公司投入大量資源評估新興風險及開發防護措施,同時透過系統卡與安全框架公開相關成果。
OpenAI執行長奧特曼(Sam Altman)也在9月14日發布的X貼文中呼籲制定聯邦層級監管措施,並希望政府協助與中國協調,推動一項國際性的AI開發降速條約。
不過,自5月發布這份政策文件以來,OpenAI在其主要模型發布中,並未針對上述任何一類風險標示風險等級,包括6月發布的GPT-5.6預覽版、7月發布的GPT-5.6正式版,以及上週推出的GPT-6 Astra。
這些模型的系統卡中,都沒有與上述4類風險相對應的章節,也未提及OpenAI所制定的風險等級。
這些模型的系統卡中,也沒有與FGF所列4大風險類別相對應的章節,更未提及OpenAI在FGF中設定的風險分級。
目前尚不清楚,OpenAI為何在FGF已成為具有法律約束力的政策後,仍未為後續發布的模型公布相應風險等級。違反相關法律的罰款最高可達每次100萬美元,並依違規嚴重程度調整。
對於GPT-5.6與GPT-6,OpenAI確實公布過其他安全框架下的評估結果。公司使用的是另一套內部安全制度《準備度框架》(Preparedness Framework),其中將Astra在網路安全方面列為「關鍵」,也是最高風險門檻,代表模型具備自主執行進階網路攻擊的能力。
OpenAI表示,《準備度框架》仍是公司管理先進AI最嚴重風險的基礎,而《尖端治理框架》則說明相關安全與資安措施如何符合特定監管要求。
不過,Midas Project指出,《準備度框架》並未評估FGF所列出的「失去控制」風險。
這項缺漏尤其受到關注,因為近期多起AI代理(AI agent)事件,已凸顯AI系統可能脫離人類監督的問題。
OpenAI今年7月曾披露,其AI模型在受控測試環境中突破限制,利用安全漏洞連上網路,最終對AI公司Hugging Face發動自主網路攻擊。OpenAI事後將該事件稱為「警訊」。
今年9月初,研究人員則揭露,數千個OpenAI自主代理人曾秘密將一個冷門、已有數十年歷史的德國Wiki網站變成訊息交流平台,在6週內發布約1.8萬則內容,用於分享答案、協調不同任務,以及交流繞過沙盒限制的方法。OpenAI此前並未披露這項活動。
Astra的系統卡確實討論人類是否能可靠地引導模型,並提到包括即時錯誤對齊監控在內的安全措施。
但Midas Project指出,該文件並未提及FGF所規定的風險等級,也沒有直接引用這套政策,因此外界無法判斷Astra採取的安全措施是否符合其依法應適用的風險等級,也無法確認OpenAI是否正式認定模型的剩餘風險處於可接受範圍。
Midas Project副總裁兼資深專案經理Brittney Gallagher表示,這並非首次看到AI企業,尤其是OpenAI,似乎未能符合這項法律原本就相對有限的要求,而此次事件涉及「失去控制」風險,更令人擔憂。
在紐約《負責任AI安全與教育法》(RAISE Act)預計於明年初生效前,加州仍是美國唯一要求尖端AI開發商遵守自身安全承諾的州。
不過,企業是否確實履行相關承諾,也開始引發外界對這項法律實際效力的質疑。
近期多起涉及AI代理人的高知名度資安事件,也讓SB 53及更廣泛的AI監管議題重新受到關注。
Gallagher表示,今年已出現OpenAI AI代理逃避人類監督並協調發動網路攻擊等「失去控制」警訊;一方面,美國各地立法人士甚至AI企業本身都呼籲迅速採取行動,另一方面,AI企業卻未能穩定達到現有法規的最低要求。
值得注意的是,Hugging Face攻擊事件與德國Wiki事件都不屬於加州尖端AI法規要求的強制通報範圍,進一步引發外界對法律約束力是否足夠的討論。
OpenAI自身也曾主張應強化加州相關法律。今年8月,公司要求加州增設模型在訓練及評估期間的監控要求,而不應只針對模型部署後進行監管。
這也不是Midas Project首次指控OpenAI未履行加州AI安全法規義務。今年2月,該組織曾指控OpenAI發布GPT-5.3-Codex時違反相關法律。
GPT-5.3-Codex是程式編寫模型,奧特曼當時表示,這是公司首個觸及網路安全「高」風險門檻的模型。
Midas Project當時認為,OpenAI未落實該風險等級所要求的額外安全措施。
OpenAI則否認相關指控,並向《財富》表示,公司「有信心」遵守包括SB 53在內的前沿AI安全法規。OpenAI當時主張,額外安全措施只有在高網路安全風險與長期自主能力同時存在時才屬必要,而GPT-5.3-Codex並不具備後者。
部分AI安全研究人員,包括Encode的Nathan Calvin,當時則對OpenAI對自身框架的解讀提出異議。
上一篇
下一篇
