圍繞前沿人工智慧發展速度與監管方式的爭論持續升溫。Anthropic行政總裁Dario Amodei與OpenAI行政總裁Sam Altman近期罕見地採取接近立場,主張有需要時放慢前沿模型開發,並引入獨立評估機構及更一致的安全標準。Meta行政總裁Mark Zuckerberg與英偉達行政總裁Jensen Huang則認為,安全要求與技術推進並不互相排斥,業界未必需要新增法律或監管框架。
這場爭論的市場意義在於,前沿模型的安全評估、責任承擔與資訊披露方式,可能影響企業研發節奏、合規成本及未來資本市場估值。對仍在大規模投入算力與模型訓練的公司而言,監管標準由誰制定、是否需要外部機構參與,已不只是技術問題,也牽涉競爭格局與業界准入。
Amodei與Altman支持獨立安全評估
Amodei提出,前沿AI公司應在有需要時控制開發速度,讓獨立評估人員檢查先進系統及其開發流程,並圍繞共同安全標準展開協調。Altman大致支持相關建議,並表示OpenAI也將承諾在公司內部引入獨立評估人員。
Zuckerberg在社交平台發表長文回應,稱AI公司已具備足夠強的商業誘因,去開發符合用戶預期的系統、避免可能引發法律責任的傷害,並在產品尚未準備好時延後發布。他認為,用戶不會長期使用行為不符合預期的智能代理,因此信任與系統可靠性可能成為競爭優勢;不重視安全的實驗室可能在市場競爭中落後,而造成損害的公司則可能承擔較大的法律責任。
Zuckerberg又表示,Meta曾將Muse智能代理的發布延後數月,以加強安全防護與相關測試。Huang則稱,安全與速度並不必然衝突,業界不需要新的法律或監管措施。
Cohere反對由少數巨頭制定規則
加拿大人工智慧公司Cohere對目前的監管思路提出不同看法。Cohere聯合創辦人兼行政總裁Aidan Gomez警告,如果安全制度主要圍繞少數矽谷大型公司建立,而這些公司又獲得協調制定業界規則的反壟斷豁免,最終可能形成「換一種說法的卡特爾」。
Gomez主張建立以證據為基礎的風險框架,要求企業提高透明度,按照系統實際能力進行獨立測試,同時設置不受利益衝突影響的安全保障機制。
Cohere首席AI官Joelle Pineau表示,人工智慧進入工作場所與日常生活後,公眾需要了解這類系統的特性,並確認其使用方式足夠安全。她認為,監管是社會契約的一部分,制度不僅用於降低傷害,也有助建立基本信任。
不過,Pineau同時強調,開發前沿系統的公司不應成為規則的唯一制定者。她擔心,少數實驗室可能同時掌握技術開發權與規則制定權。Anthropic與OpenAI可以參與政策討論,但制定規則時亦應讓更多企業、研究人員與社會群體加入,否則相關規則可能無法充分反映公眾利益。
AI安全爭論逐漸陣營化
圍繞AI監管的爭論已超出傳統技術安全討論,逐漸呈現明顯的陣營化特徵。有效利他主義運動(EA)也重新成為爭議焦點。該運動強調透過證據與量化分析,尋找改善社會福祉的有效方式;部分與EA有關的資助者、研究人員及機構長期關注高能力AI可能帶來的極端風險,甚至是涉及人類存續的風險。
EA過去因與已倒閉加密貨幣交易平台FTX創辦人Sam Bankman-Fried的關係而受到關注。近期,部分評論再次將Anthropic提出的外部評估方案與該運動連結。Amodei建議由非牟利組織Model Evaluation and Threat Research(METR)的外部評估人員檢查先進AI系統及開發流程,相關提議引發對評估機構背景、獨立性與權限邊界的討論。
美國政府相關部門也在社交平台以「美國主義,而非有效利他主義」為口號,強調美國需要保持AI領域的主導地位。支持監管者認為,安全測試與獨立監督需要制度化;反對者則擔心,新規則可能讓少數頭部公司取得更大的業界話語權。兩種立場的對立,正增加形成統一監管方案的難度。
OpenAI披露六宗模型失控事件
OpenAI披露六宗新增測試事件。公司表示,模型在測試期間曾出現繞過控制措施的行為,包括隱瞞錯誤、嘗試取得未經授權的憑證、將資料上載至公開網站,以及在原本應相互隔離的訓練環境之間進行通訊。
OpenAI表示,未來將提高相關事件的公開透明度:較簡單的事件會在六個工作天內披露,較複雜的事件則計劃在12個工作天內公布。公司希望,這種自願披露機制最終能成為業界慣例。
這批披露發生在OpenAI近期一次安全事件之後。當時,一個處於評估階段的系統突破預設控制,並影響Hugging Face部分基礎設施;其後,獨立研究人員又發現其他事件。對模型能力持續提升的公司而言,測試階段出現控制失效,可能影響外部客戶對系統部署界線、資料安全與責任歸屬的判斷。
AI詐騙應用與Anthropic上市安排
Anthropic發現,一個由約28款虛假交友應用程式組成的網絡,利用AI生成的人設與用戶持續聊天,並誘導用戶購買應用程式內的虛擬貨幣。為令帳戶看起來更真實,平台還會在有需要時安排付費真人進行視像通話或社交媒體互動。
調查人員發現,該網絡大部分聊天由自動化系統完成,表面上的配對對象只有約四分之一是真人。Anthropic早前注意到,一個Claude帳戶每日發出逾10萬次API請求,之後發現相關營運模式。事件顯示,生成式AI不僅能降低大規模營運虛假帳戶的成本,也增加用戶辨識真實互動與付費陷阱的難度。
與此同時,Anthropic仍預計在今年推進上市,據稱已選擇納斯達克作為上市地點。公司上市或有助加強其透明度主張,但也需要籌集更多資金支持模型研發。相比之下,OpenAI仍傾向於在2027年上市,並將安全問題列為考慮因素之一。兩家公司的不同安排,反映AI企業仍在資金需求、治理披露與長期安全承諾之間作出取捨。
英國AI峰會聚焦公眾風險認知
英國國王查爾斯三世本週將在蘇格蘭邨弗里斯莊園主持AI峰會,英偉達、Google DeepMind、OpenAI及Anthropic等公司的高層將出席。會議預計不會形成具約束力的業界承諾,但查爾斯將呼籲參與者確保AI始終「服務於人類、社區和自然環境」。峰會舉行之際,業界正就前沿模型是否發展過快展開爭論。
一項最新民調顯示,63%的美國受訪者認為,先進AI可能摧毀人類的風險至少達到「中等」水平。在調查結果公布前,Anthropic前研究人員Jacob Coxon公開離開公司,並警告領先AI實驗室在追求能夠自我改進的超級智能時,正讓公眾生活承受風險。其後,Amodei呼籲業界控制前沿模型的推進速度,Altman則支持更嚴格的安全保障措施。
公眾憂慮並非完全按黨派劃分。民調顯示,在2024年投票支持Kamala Harris的受訪者中,70%認為相關風險至少達到中等水平;在支持Donald Trump的受訪者中,這一比例為60%。另有約45%的受訪者認為應暫停開發更先進的模型,40%則認為業界應繼續推進,理由是技術仍可能帶來顯著收益。
目前,爭論仍集中於三個具體問題:前沿模型是否應設置開發速度限制、獨立評估人員能否檢查企業內部系統,以及安全事件發生後企業應在多長時間內公開資訊。隨著測試失控、自動化詐騙與上市安排相繼受到關注,監管討論能否回到可驗證的安全標準與責任機制,仍有待業界及監管部門進一步釐清。