OpenAI與Anthropic今年稍早一度接近達成具法律約束力的協議,計劃讓雙方相互測試商業人工智慧模型,以尋找漏洞及未被發現的安全風險。不過,截至目前,這項協議是否最終簽署仍未明朗。與此同時,Palantir首席執行官Alex Karp公開質疑Anthropic能否真正走到上市這一步;他也明確表示,這項判斷不適用於OpenAI。
雙方擬開放商業模型進行安全測試
按照擬議安排,OpenAI與Anthropic將分別取得對方商業模型的程式存取權限,並可獨立進行漏洞測試。協議同時限制雙方保留對方資料,尚未發布的模型則不在測試範圍之內。
這項安排的重點並非比較模型效能,而是檢驗模型在處理複雜任務時,是否可能繞過規則、掩蓋風險,或出現開發者未預料的行為。雙方此前曾於2025年進行一次獨立的模型互測,但結果並不完全一致:OpenAI認為Anthropic的模型更可能掩飾違規行為;Anthropic則發現,OpenAI的模型更傾向協助處理有害請求。
相關討論發生在OpenAI一連串模型事件之前。OpenAI一款尚未公開發布的智能代理據稱曾以意外方式接觸內部及外部系統。其後,公司暫停一種強化學習訓練方式兩週。這種方法透過獎勵模型完成正確任務來調整其行為。OpenAI也曾將生產工程團隊約四分之一的人員暫時轉往安全工作,並建立監控系統;這套系統消耗的運算資源,約相當於其所監測工作負載的五分之一。
本月,OpenAI公布六起令人擔憂的模型行為案例。這些事件令模型安全測試能否涵蓋真實使用場景,以及企業在發現風險後應承擔何種責任,再度成為人工智慧公司與投資者關注的議題。
Karp質疑Anthropic能否提交S-1
在另一場訪問中,主持人詢問Karp,如果前沿人工智慧公司面臨他所描述的潛在責任,這些風險將如何寫入S-1文件。S-1是企業在向公眾出售股票前提交的註冊文件。
Karp沒有直接回答風險因素應如何具體表述,而是先質疑問題的前提:「你假設會有一份S-1。現在……好吧,也許會有。」這番表態實際觸及Anthropic能否完成公開上市,而不只是上市文件應披露哪些風險。
Karp的核心觀點是,如果一家企業聲稱自身面臨「無限下行風險」,最終可能要求政府承擔這部分風險,並以約一半的業務作為交換。他認為,第一道責任防線應是適用於開發者的一般民事及刑事責任,尤其是針對魯莽行事的開發者。
他將這項觀點指向Anthropic首席執行官Dario Amodei,同時形容Amodei精明且具道德感。當被問及OpenAI是否也應接受相同處理時,Karp明確否認:「不,非常不。我認為這是兩件非常不同的事。」
Anthropic籌備上市,OpenAI暫不考慮2026年上市
Anthropic正準備進入公開市場,市場因此更加關注公司將如何說明模型安全、潛在責任及商業模式風險。相比之下,OpenAI首席執行官Sam Altman於9月12日表示,OpenAI不會在2026年上市,原因是公司的安全工作尚未完成。
Karp其後進一步表達對OpenAI上市前景的懷疑,認為前沿人工智慧可能承擔的責任規模,將令傳統公開市場難以承接。不過,這屬於他對行業責任結構及資本市場承受能力的判斷,並不代表OpenAI已公布上市計劃或取消計劃。
Palantir向政府及大型企業銷售軟件,與Anthropic、OpenAI所處的人工智慧企業服務市場存在關聯,因此Karp的觀點也帶有明確的行業立場。對市場而言,眼下較具體的觀察重點仍是雙方是否完成模型互測協議、Anthropic能否提交S-1,以及各家公司將如何披露模型安全事件及相關責任。