据8月17日公开报道,AI头部企业OpenAI于上月底正式解散负责评估前沿模型生化、网络攻击等高风险的防范团队,相关职能按领域拆分并入现有业务线。这是该公司继解散AGI准备团队、超级对齐团队后的又一次架构调整,多名核心安全岗成员已相继离职,前超级对齐团队负责人Jan Leike公开指出公司正为产品推进系统性忽视安全投入。

本次被解散的防范团队(Prevention Team)此前是OpenAI安全体系中直接对接前沿模型风险评估的核心部门,核心职责是在新模型发布前,对其可能被滥用生成生化武器制备方案、恶意网络攻击代码等极端风险进行全流程测试,并制定对应的防范、拦截规则。
这已经是OpenAI近两年来第三次解散核心安全相关团队。此前该公司已经先后裁撤AGI准备团队与超级对齐团队,两个团队分别负责通用人工智能落地前的合规路径规划、超智能模型的人类对齐技术研发。今年2月从Anthropic加入OpenAI的准备团队负责人Dylan Scandinaro,后续将不再统筹全公司的风险防范工作,转而聚焦业务线的具体落地安全规则适配。
伴随团队裁撤的是核心安全岗位人员的连续流失:伦理负责人Chloé Bakalar、首席未来学家Josh Achiam及安全主管Johannes Heidecke等核心成员均在近期离职,2024年离开的前超级对齐团队负责人Jan Leike更是直接表态,OpenAI当前的优先级已经完全向“炫酷产品”倾斜,安全投入被系统性压缩。
OpenAI成立初期曾明确以“安全优先推进AGI发展”为核心治理原则,独立的安全团队拥有对新模型发布的一票否决权。而本次防范团队的职能拆分并入业务线,意味着原有的独立安全审核机制已被打破,风险评估的决策权将直接下沉至对应的业务部门,此次调整也被业内视为OpenAI完全偏离早期公益治理定位的标志性事件。
从2024年以来,OpenAI明显加快了产品迭代节奏,GPT系列模型的更新周期从原来的半年以上压缩至3个月以内,同时接连推出语音助手、企业服务等多条新业务线,直接与Anthropic、谷歌DeepMind等竞争对手抢夺C端和B端市场份额。
OpenAI的架构调整也引发了全球AI行业对安全与发展平衡的讨论。部分产业人士认为,在全球大模型竞速的节点,适度加快迭代效率、将安全能力嵌入业务流程,反而能提升风险应对的响应速度;但更多安全研究者则担心,独立安全部门的消失,会让企业为了商业化进度主动放低风险审核门槛,最终导致极端风险外溢。
目前从Anthropic、谷歌DeepMind等头部企业的架构来看,独立安全团队仍然是核心配置,拥有独立的风险评估和产品叫停权限,与OpenAI的调整方向形成了明显反差。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。