誰來監管AI巨獸?OpenAI、Anthropic自訂遊戲規則掀「評估戰」

在缺乏聯邦強制監管下,美國AI巨頭由自願協議、外部評估與州法拼湊出「安全框架」。然而評估機構小、錢來自被審者、權限與獨立性未定,恐成另一次「華爾街式自律」實驗,AI風險誰負責仍無定論。

生成式AI狂飆之際,真正站在「殺手與法官」交界線上的,並不是政府,而是一群原本默默無聞的第三方評估機構。從非營利組織 Model Evaluation and Threat Research(METR) 到 Apollo Research、Vals AI,再到大型顧問公司 Accenture,這些原本被視為邊角角色的團隊,突然被推上「拯救AI安全」的舞台中心,卻得在充滿資金誘惑與權力不對等的環境中,想辦法扮演好監督者。

這股風向在過去幾個月急轉。當 Anthropic 執行長 Dario Amodei 高調呼籲放慢高階模型開發腳步,並承諾把外部評估員「嵌入」公司內部後,OpenAI 執行長 Sam Altman 隨即公開支持。更引人注目的是,美國前總統 Donald Trump 在白宮午宴上稱讚AI公司「自我約束非常了不起」,並提出一份僅一頁的「道德約束」協議,鼓勵各家企業與獨立外部評估者合作。Anthropic、Google(GOOGL)、Meta(META)、OpenAI、SpaceX、Nvidia(NVDA) 等領袖罕見地一同簽署,對外展示一場「業界自律」大秀。

然而,在缺乏具體法律條文與罰則的前提下,這種自願式承諾究竟有多大效力,學界與監管倡議者高度存疑。布朗大學(Brown University)電腦科學教授 Suresh Venkatasubramanian 直言,問題核心仍然是錢──誰來為這些評估機構買單?當 OpenAI、Anthropic 以及靠AI熱潮大賺基礎建設公司的支票,成為評估機構主要財源時,所謂「獨立」很容易被侵蝕。他形容,這就像要華爾街大銀行自行設計防金融危機規則,或讓藥廠繞過藥品審核直接上市一樣,天生存在利益衝突。

目前的評估生態系規模,相較AI實驗室掌握的資本與人力,可說極度不對稱。以 METR 為例,根據其官網,正式員工不到50人,卻要面對市值、融資規模動輒以「十億美元」計的AI巨頭。儘管如此,資金正快速湧入。非營利組織 Fathom 執行長 Andrew Freedman 指出,過去一年他從未見過哪個議題在不同政治光譜上推進得這麼快。METR 在今年八月前六個月就拿到約7,100萬美元承諾資金,遠高於先前年度總額13.6萬美元,顯示「AI安全」已成新興投資焦點。

市場熱度也反映在商業評估公司身上。獨立評估新創 Vals AI 執行長 Rayan Krishnan 表示,公司專門為產業客戶打造模型表現基準,今年員工從8人成長到約30人,並在八月完成4,000萬美元募資。另一邊,METR 今年受 OpenAI 委託,撰寫模型如何「逃出沙盒」、連上開放網路並入侵開源平台 Hugging Face 的事後報告,且對外強調未收取費用,顯示評估機構也在刻意切割金錢關係,以捍衛外界對其獨立性的信任。

但是,理論上的「嵌入式評估」落地時,摩擦已經出現。OpenAI 近期以違反機密資訊處理政策為由,解雇三名員工,其中兩人聲稱真正原因是他們與第三方評估者的溝通方式。當事人之一 Mikita Balesni 在X上發文指出,前同事對公司說法充滿困惑,更擔心私人手機遭檢查,導致員工不敢對外發聲,也可能讓公司在關起門來時,在安全議題上「偷工減料」。OpenAI 則否認此說法,並在聲明中重申正與外部安全評估機構簽約,強調合作是其安全策略核心之一。

Anthropic 則採取另一種策略:直接支付 Accenture 專業AI團隊費用,要求其進駐公司內部、測試防護機制、評估模型是否符合人類價值。Anthropic 在部落格中坦言,目前根本沒有共識標準,來界定嵌入式評估者能接觸哪些資料、如何回報發現,也沒有穩定的獨立資金來源,因此長期來看應由政府或共同基金池出資。但在制度尚未建立前,他們選擇先自行出錢,當作「概念驗證」。

為了避免評估機構變成「橡皮圖章」,Fathom 早在去年六月就提出「獨立驗證組織」(Independent Verification Organizations, IVOs) 市場框架,主張由政府發照,授權這些機構檢驗AI公司是否符合安全門檻。Freedman 強調,若沒有公權力介入,評估機構勢必仰賴大實驗室的案源過活,久而久之為求生存,恐淪為替客戶蓋章的外包單位,而非真正的監督者。

部分立法者已開始響應。例如美國聯邦眾議員 Lori Trahan 與 Jay Obernolte 推出的《FRONTIER Act》(Frontier Risk Oversight, National Transparency, Independent Evaluation, and Reporting Act),就把 IVO 制度納入核心條款,Fathom 也參與草擬技術內容。OpenAI 全球事務主管 Chris Lehane 透露,他已親自赴國會向提案議員表達對 IVO 條文的支持,顯示大型AI公司也意識到,若想說服社會放心讓更強大的模型落地,就必須接受某種程度的法定審查。

在聯邦遲未動手之際,各州率先上場。加州、康乃狄克與維吉尼亞等州陸續採取行動,其中加州州長 Gavin Newsom 近日簽署兩項與 IVO 相關法案,一項建立全美首個監管框架,另一項則設置州級AI稽核機構登錄制度。Anthropic 早在八月就表態支持,OpenAI 也在法案簽署同日正式背書。Lehane 在部落格中強調,他們仍偏好由聯邦統一訂定標準,但在華府遲疑不決前,加州可以先提供「交通規則雛形」。

另一方面,評估界也開始自訂最低規範。由 METR、AI Verification and Evaluation Research Institute(AVERI) 等組成的 AI Evaluator Forum,近期發表公開信〈Minimum Conditions for Embedding Evaluators〉,主張嵌入式評估員必須享有與公司內部高權限員工等級的存取權、能透明公開方法與發現、且不得因揭露負面結果遭報復。他們同時提醒,嵌入式評估只是補強措施,不能取代更廣泛、獨立於公司之外的監督制度。

面對外界質疑,OpenAI 與 Anthropic 也提出各自的「理想評估架構藍圖」。Anthropic 表示,將為評估員提供辦公桌、門禁卡、公司筆電與與內部風險團隊「大致相當」的權限,並以合約保障評估者有權公開主要發現,只在極少數涉及資安或機密資訊的情況下保留刪減權。OpenAI 則主張,評估工作應聚焦於事先約定範圍的具體技術主張,且評估者必須公開方法論、申報利益衝突,並證明具備相關技術專業。

然而,無論協議內容多麼漂亮,都無法改變一個根本現實:OpenAI 與 Anthropic 仍是彼此激烈競爭的商業公司,正朝估值破兆美元、甚至公開上市的目標邁進。賓大華頓商學院 Wharton Accountable AI Lab 負責人 Kevin Werbach 指出,兩家公司私底下彼此極度不信任,即便對外在評估必要性上說法一致,也難免被外界質疑,所謂自律是否只是延後更嚴格監管的策略。

對投資人與社會而言,眼前的問題是:當最有能力、也最有誘因繼續推進AI邊界的公司,掌握了大部分遊戲規則制定權,第三方評估是否真能成為安全閥,而不是另一種公關工具?在聯邦監管仍含糊、州法標準零散且評估產業尚未成熟的情況下,AI安全很可能在未來幾年持續停留在「半自律、半實驗」的狀態。究竟是這套新興的評估體系會先長大,還是AI風險會先引爆下一場信任危機,目前沒有人能給出確切答案。

點擊下方連結,開啟「美股K線APP」,獲得更多美股即時資訊喔!
https://www.cmoney.tw/r/56/9hlg37

免責宣言
本網站所提供資訊僅供參考,並無任何推介買賣之意,投資人應自行承擔交易風險。

文章相關標籤
喜歡這篇文章嗎?
歡迎分享,讓更多人可以看到!
  • facebook
  • line
作者文章
最新文章