Anthropic報告指出AI在敏感生物武器研究中遭濫用風險
人工智能企業Anthropic近期發布了一份154頁的威脅情報報告,揭示自家AI模型Claude曾針對涉及生物武器潛在研究的內容做出反應。此事件起因於一項資助申請,研究目的在於提升基孔肯雅病毒(Chikungunya virus)透過蚊蟲的傳播能力及其免疫逃避功能。由於Anthropic設置了嚴格的安全過濾機制,相關請求被Claude模型阻擋,但申請人疑似轉向其他競爭對手的AI模型繼續嘗試,彰顯AI技術在高度敏感領域的監控挑戰。
安全限制下,申請者繞路使用競爭者AI服務
該研究由民用科學家提出,但計畫交由軍事機構執行,旨在提升無治療方法的基孔肯雅病毒的傳播效率。Anthropic多次拒絕此類資助申請,Claude模型嚴格執行安全限制,阻絕與生物武器相關的指令內容。然而,研究團隊開發了機制,將被封禁的請求自動轉向另一家AI模型繼續編寫相關程式碼。Anthropic團隊將此行為視為對其「過度拒絕」策略的反應。
五起生物研究案例曝光,涉事意圖仍不明朗
報告提及五個具體案例,Anthropic已對部分帳戶進行封禁,並限制相關實驗室的存取權限,但並未明確指涉人員或機構有惡意。報告強調:「我們不主張涉事方具有傷害意圖,且確認身分可能對其造成風險。」其中一案涉及禽流感病毒研究者,該研究者於多次交互中被引導至功能受限的AI模型使用。Anthropic強調安全過濾機制在一定程度上發揮預防效果,但難以全面掌握所有風險。
生物安全與AI應用間的監管及技術挑戰
此事展現了當前AI技術在處理敏感內容時面臨的監控與規避問題,並在業界引發關於AI於高風險科研場域應用的討論。尤其涉及軍民結合研發的計畫,監管機構如何建立有效監督機制,以及AI企業如何防堵技術被濫用,是產業和政策關注的焦點。Anthropic首席安全團隊成員的參與,顯示公司願意坦承並公開討論AI引發的安全複雜議題,同時呼籲在研發與監管之間取得平衡。