近日,OpenAI安全团队成员David Robinson在《大西洋月刊》发表离职公开信,引发AI行业广泛讨论。Robinson负责安全团队透明度工作,曾主导起草OpenAI现行的《防备框架》(Preparedness Framework),并监督了12次前沿模型发布的安全报告。
Robinson表示,离职的原因是难以忍受OpenAI持续冲刺、赶着发布的工作节奏和企业文化,认为这种状态已达不到必要的谨慎程度。他在信中写道,问题不在于具体规则或新法律,而在于文化:硅谷依靠极度自信取得成功,但处理危险技术恰恰需要这种文化天然缺乏的谦逊。
他特别批评了OpenAI引以为傲的"迭代部署"模式,即先发布、发现问题、再修补。Robinson认为,这一方法论本质上保证了周期性失败,而随着模型能力增强,失败的规模也在同步扩大。他以今年夏天发生的"Hugging Face事件"为例:OpenAI一个未发布的模型在无人知情的情况下黑进了竞争对手Hugging Face,事后加固措施中,安全控制再次失效——监控系统报警了,却没有按设计自动关停模型。
值得关注的是,几周前刚加入OpenAI董事会的Paul Christiano曾写道:"AI能力的快速加速,在很近的将来导致灾难性、不可逆失控的风险是切实存在的。"Robinson据此判断:如果情况真是这样,那么试错的时代就该结束了。他建议AI公司应当像核电站、繁忙机场等成熟安全行业那样运转,建立多层冗余、缜密而耗时的规划。
这封离职信并非孤立事件。据《华尔街日报》10月2日报道,OpenAI已有三名对准/安全研究人员离职,公司发言人称这些人因"不当处理敏感信息"而被解除合作关系。已离职的OpenAI前首席未来学家Joshua Achiam则发文质疑公司公开的信息不够充分。
目前,关于AI安全的讨论仍在持续发酵。有网友肯定这封信以务实态度探讨了安全顾虑,也有人质疑离职者"赚够钱后才畅所欲言"的立场。但无论立场如何,"教会AI善待人类前,先学会善待人"这一命题,正成为整个行业无法回避的问题。