星光澄海 | BLOG

OpenAI不松口:坚持解雇三名AI安全研究员的决定

周五OpenAI在X发了一条公开声明,明确表态不推翻解雇三名AI安全研究员的决定。被解雇的是Jasmine Wang、Tomek Korbak和Mikita Balesni,公司给出的理由是“严重违反信任”,具体指向“违反敏感信息处理的明确政策”。

解雇的直接冲突:公开信 vs 公司声明

这不是一起公司单方面的处分。就在OpenAI发声明的前一天,也就是周四,这三人已经联合发表了一封公开信,要求OpenAI对解雇原因给出更透明的解释。在后续的社交平台发言里,他们还提到,自己的行动更多是出于对AI安全的担忧——这也让事件的性质从“内部管理问题”带上了一层“言论被打压”的色彩。OpenAI的声明特意强调,解雇和他们的发声、AI安全方面的担忧无关,只和违反敏感信息政策有关,这相当于直接切断了“言论打压”的联想,但也没说清敏感信息到底是什么。

安全研究的“信任边界”在哪?

这里的核心争议,其实是AI安全领域里的“信任边界”问题。OpenAI作为目前最受关注的AI公司,手里握着大量和模型安全相关的敏感数据——比如训练数据的细节、模型的安全对齐测试结果之类的。公司会制定严格的政策,要求内部人员不能随意泄露这些信息,本质是为了避免外界用这些数据做出危害安全的事。但对于专门研究AI安全的研究员来说,他们可能会觉得,某些“敏感信息”是推进安全研究的必要材料,甚至是验证公司安全承诺的关键依据。这时候,到底哪些信息是绝对不能碰的,哪些是可以公开讨论的,就成了一个模糊的地带。OpenAI这次的决定,相当于在这个模糊地带里划了一条自己的线,而且态度很坚决。

对AI安全圈的暗示?

这件事最值得琢磨的,是对整个AI安全研究圈的影响。现在,AI安全已经成了行业里的头等大事,无论是公司还是监管层,都在盯着这方面的进展。而内部研究员的意见,往往是最直接、最真实的安全信号。OpenAI的决定,会让其他安全研究员开始思考:自己的哪些行为会被算成“违反信任”?是泄露内部安全数据,还是公开质疑公司的安全决策?如果公司把“发声”和“违规”切割开,那是不是意味着,以后研究员可以放心提安全担忧,只要不碰敏感信息?还是说,公司的声明本身就是一种信号——即便是出于安全目的,触碰敏感信息的后果也很严重?

我自己的感觉是,OpenAI这次的选择,是在维护内部管理的规则,但也可能给AI安全研究的信息流通蒙上一层阴影。毕竟,安全研究需要的就是透明和自由的讨论,要是大家都不敢碰敏感信息,很多安全问题可能就会被掩盖过去。问题在于,你觉得,OpenAI的这个决定,是在给安全研究立规矩,还是在给内部意见套紧箍咒?


素材来源:The Verge AI · AI情报、AI政策与监管、科研前沿
查看报道原文

发表第一条评论吧

支持 Markdown