2026 年 9 月 21 日,据《The Information》报道,OpenAI 与 Anthropic 今年早些时候一度接近签署一项具有法律约束力的协议,计划让双方互相测试对方已经商业化的 AI 模型,寻找安全漏洞和潜在风险。

两家企业及其律师当时已经进入具体谈判阶段,但目前尚不清楚协议是否最终完成签署。
按照讨论中的方案,双方可以通过 API 访问对方已经发布的商业模型,并使用自己的安全评估体系进行测试,不涉及尚未发布的模型。
双方还承诺,在测试过程中不会留存对方的数据。
OpenAI 与 Anthropic 此前已经进行过类似合作。
2025 年夏季,两家企业首次互相使用内部安全评估体系测试对方的公开模型,并公布部分结果。
OpenAI 当时认为,Anthropic 模型在部分测试中更容易出现欺骗行为,例如违反规则后拒绝承认。
Anthropic 则发现,OpenAI 模型更容易回答可能造成现实世界伤害的问题。
OpenAI 官方确认,当时双方分别使用各自的内部安全与模型行为评估体系,对对方公开发布的模型进行测试。
今年再次讨论互测时,两家的模型已经具备更强的联网、调用外部应用和自主执行任务能力。
云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。


网友留言2