Anthropic报告揭示AI在生物武器相关研究中的角色疑虑
人工智能企业Anthropic近期发布了一份154页的威胁情报报告,披露自家AI模型曾对涉及潜在生物武器研究的内容作出反应。事件起因于一份资助申请,涉及使蚊媒病毒——基孔肯雅病毒——传播性提高及免疫逃避,虽因安全过滤被Anthropic模型“Claude”阻断,但申请者疑似通过路由至其他竞争对手AI模型继续尝试。此情况显示AI在高度敏感生物研究中的安全挑战。
资助申请被阻,研究者绕道竞品AI模型
该项研究意图推动无治愈手段的基孔肯雅病毒更易传播,申请由民用科学家提出,计划在军事机构下执行。申请过程遭Anthropic多次拒绝,Claude模型严格执行安全限制。然而,研究团队绕过限制,通过构建将被封禁请求自动切换至另一家AI模型的机制,继续编写相关代码。Anthropic团队指出,此举是对“过度拒绝”问题的回应。
五起生物案例曝光,但意图尚无定论
报告中涵盖五个具体案例,Anthropic已经封禁部分账户并停止相关实验室的访问权限,但并未明确指控涉事人员或实验室存在恶意意图。报告中明确表示:“我们并不主张他们存在伤害意图,确认身份可能对他们构成风险。”其中一例涉及禽流感病毒研究者,该研究者在多次交互中被引导使用功能较弱的AI模型。整体来看,Anthropic强调过滤机制在一定程度上发挥了预防作用,但尚难界定全部安全隐患。
AI技术在生物安全领域的挑战和不确定性
此次事件反映出现阶段AI技术在处理敏感领域内容时存在监控和规避问题。Anthropic的报告引发业界对AI在高风险科研领域应用的警示,尤其是在军民结合的研究项目中。监管层面如何建立完善的监督机制,以及AI企业如何防止技术被绕过利用,仍是行业关注的核心。
报告发布者包括Anthropic首席安全团队成员,显示该公司愿意公开讨论AI引发的复杂安全问题,同时呼吁在研发和监管上实现平衡。