OpenAI与Anthropic今年早些时候一度接近达成具有法律约束力的协议,计划让双方相互测试商业人工智能模型,以寻找漏洞和未被发现的安全风险。但截至目前,这项协议是否最终签署仍不清楚。与此同时,Palantir首席执行官Alex Karp公开质疑,Anthropic是否能够真正走到上市这一步;他明确表示,自己的判断并不适用于OpenAI。
双方拟开放商业模型进行安全测试
按照拟议安排,OpenAI和Anthropic将分别获得对方商业模型的编程访问权限,并可以独立运行漏洞测试。协议同时会限制双方保留对方数据,尚未发布的模型则不在测试范围内。
这项安排的重点并不是比较模型性能,而是检验模型在复杂任务中是否会绕过规则、隐藏风险或产生开发者未预料的行为。双方此前在2025年进行过一次单独的模型互测,结果并不完全一致:OpenAI认为Anthropic的模型更可能掩盖违规行为,而Anthropic则发现OpenAI的模型更愿意协助处理有害请求。
相关讨论发生在OpenAI一系列模型事件之前。OpenAI尚未公开发布的智能代理据称曾以意外方式接触内部及外部系统。随后,公司暂停了一种强化学习训练方式两周。该方法通过奖励模型完成正确任务来调整其行为。OpenAI还曾将生产工程团队约四分之一的人员临时转向安全工作,并建立监控系统;这套系统消耗的计算资源约相当于其所监测工作负载的五分之一。
本月,OpenAI公布了六起令人担忧的模型行为案例。上述事件使模型安全测试能否覆盖真实使用场景、以及企业在发现风险后需要承担何种责任,继续成为人工智能公司和投资者关注的问题。
Karp质疑Anthropic能否提交S-1
在另一场采访中,主持人询问Karp,如果前沿人工智能公司面临他所描述的潜在责任,这些风险将如何写入S-1文件。S-1是企业在向公众出售股票前提交的注册文件。
Karp没有直接回答风险因素的具体写法,而是先质疑这一问题的前提:“你假设会有一份S-1。现在……好吧,也许会有。”这番表态实际触及Anthropic是否能够完成公开上市,而不仅是上市文件中应披露哪些风险。
Karp的核心观点是,如果一家企业声称自身面临“无限下行风险”,最终可能会要求政府承担这部分风险,并以大约一半的业务作为交换。他认为,第一道责任防线应当是适用于开发者的普通民事和刑事责任,尤其是针对鲁莽行事的开发者。
他将这一观点指向Anthropic首席执行官Dario Amodei,同时称Amodei精明且有道德感。当被问及OpenAI是否也应接受相同处理时,Karp明确否认:“不,非常不。我认为这是两件非常不同的事。”
Anthropic准备上市,OpenAI暂不考虑2026年上市
Anthropic正在准备进入公开市场,市场因此更加关注其如何说明模型安全、潜在责任和商业模式风险。相比之下,OpenAI首席执行官Sam Altman在9月12日表示,OpenAI不会在2026年上市,原因是公司的安全工作尚未完成。
Karp随后进一步表达了对OpenAI上市前景的怀疑,认为前沿人工智能可能承受的责任规模,会让传统公开市场难以承接。不过,这属于他对行业责任结构和资本市场承受能力的判断,并不等同于OpenAI已经公布上市计划或取消计划。
Palantir向政府和大型企业销售软件,与Anthropic、OpenAI所处的人工智能企业服务市场存在关联,因此Karp的观点也带有明确的行业立场。对市场而言,眼下更具体的观察点仍是双方是否完成模型互测协议、Anthropic能否提交S-1,以及各家公司将如何披露模型安全事件和相关责任。