问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
近日,人工智能企业Anthropic资深研究员Jacob Coxon正式宣布离职,其核心离职动因是对无监管自改进AI技术可能触发的人类生存风险存在强烈担忧,他公开呼吁全球头部AI实验室签署统一研发节奏协议,避免在高风险AI技术赛道无序竞速,该事件也引发了全球科技行业对AGI研发伦理与监管边界的广泛讨论。

这一消息在Disrupt 2026科技大会开幕前三天被曝出,原本Jacob Coxon受邀将在大会AI安全分论坛发表关于大模型对齐技术落地的主题演讲,离职消息公开后,Anthropic方面已经紧急调整了参会嘉宾名单,未对外披露后续的演讲主题替换方案。
自2025年以来,OpenAI、Anthropic等全球头部AGI厂商都将自改进AI列为核心研发方向——这类系统能够自主调整模型架构、优化训练流程,无需人类工程师深度介入即可完成迭代,被业内公认为是通向通用人工智能的核心技术路径。
但随着赛道竞争日趋白热化,头部实验室的研发节奏不断加快,且几乎没有统一的跨机构安全评估标准。此前一份行业匿名调研报告显示,全球排名前三的AI厂商的自改进AI研发进度,比其对外公开披露的内容领先至少18个月,大量高风险测试未经过第三方独立审计。
作为Anthropic对齐团队的核心成员,Jacob Coxon曾深度参与Claude 3、Claude 4系列大模型的安全对齐研发,是业内知名的AI安全专家。他在个人社交平台发布的离职说明中直言,当前头部实验室对自改进AI的研发是“拿全人类的命运赌博”,在没有明确的风险熔断机制前提下加速技术落地,极有可能触发不可控的连锁风险。
他公开呼吁的跨实验室“研发节奏协议”,要求所有涉及自改进AI的研发项目必须提交第三方安全机构审计,风险等级达到特定阈值的项目必须主动暂停研发。目前已有超过200名全球AI领域的研究者公开联署支持这一提议。
尽管目前欧盟AI法案已经将自主迭代的AGI系统划为最高风险等级,但相关的风险评估标准、检测技术细则仍未完全落地,不同国家的监管尺度也存在明显差异。
截至目前,OpenAI、Anthropic均未对Jacob Coxon的呼吁作出公开回应,仅有中小AI研发企业如Replit公开表态,支持建立全行业统一的自改进AI安全审计机制。业内分析指出,头部厂商出于商业竞争的考量,大多不愿意公开核心研发进度,这也成为跨机构安全协议落地的最大阻碍。
值得注意的是,这已经不是AI安全研究者第一次因理念不合从头部实验室离职。过去12个月,全球头部AGI厂商已有至少7名核心安全团队成员公开离职,其中多数都曾公开发声反对无监管的高风险AI研发,AI技术迭代效率与安全边界的博弈,仍将是未来数年行业的核心矛盾。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。