OpenAI安全团队再遇动荡:安全透明度负责人离职,三名安全研究员被解雇

2026/10/4news

OpenAI安全部门近期接连出现人事变动。据Business Insider报道,OpenAI Safety Systems团队“安全透明度”职能负责人David Robinson已离职,其本人尚未公开说明离职原因,OpenAI也未公布继任者人选。

Robinson负责的工作虽不显眼,却相当关键:他的团队负责在OpenAI每次发布重要模型时撰写“system card”,即模型的风险说明书,内容涵盖模型训练方法、安全评估结果、在生物和网络攻击等高风险领域的能力水平、已采取的安全措施及残余风险等。这类文件往往长达数十页,被视为OpenAI向外界提供的最详细的安全工作说明。

此外,Robinson还是《Preparedness Framework 2.0》的主要起草人。该框架用于追踪前沿模型的严重风险,第二版新增了生物与化学能力、网络安全能力以及AI自我改进能力三类追踪项。若模型能力达到High级别,意味着可能显著放大现有危害路径,部署前必须配置足够安全措施;达到Critical级别,则需重新审视是否继续开发。不久前,Robinson还在招聘OpenAI首位Safety Transparency Editor,目前该岗位仍在招聘中。

在Robinson离职消息曝光前,OpenAI安全部门已状况频发。据《华尔街日报》报道,OpenAI近日解雇了三名安全方向的员工——Jasmine Wang、Tomek Korbak和Mikita Balesni,三人主要从事安全与模型对齐研究。OpenAI给出的理由是,内部调查发现三人将公司敏感信息分享给了一家外部AI安全机构,其中涉及OpenAI基础设施架构内容。

值得注意的是,Korbak此前曾担任OpenAI与第三方评估机构METR、Redwood Research之间的技术联系人,而这两家机构正是在此前事件后受邀进驻OpenAI进行调查的第三方机构。

截至目前,OpenAI尚未就Robinson的离职原因作出公开回应。