2026年6月,人工智能初创企业Anthropic被曝与美国国家安全局达成深度合作,部署其最新研发的Claude Mythos大模型用于进攻性网络作战,同时派驻6名技术工程师驻场提供定制调优支持。该具备漏洞自主挖掘能力的大模型已开放至全球15国150家机构,其技术滥用风险引发各界广泛争议。

据内部知情人士透露,此次合作并非简单的产品采购:Anthropic派驻的6名工程师将全程嵌入美国国安局网络作战部门的日常工作流,除了基础的模型部署调试外,还将针对特定攻击目标的系统特性、防护逻辑对Claude Mythos做定向微调,进一步提升其漏洞挖掘、渗透路径规划的效率。作为此前主打“安全对齐”理念的头部AI初创企业,Anthropic此次与情报部门的合作也让不少行业人士感到意外。
近两年来全球网络空间的对抗烈度持续上升,传统人工挖掘漏洞的周期往往需要数周甚至数月,而大模型的加入可以将这一过程压缩至小时级,效率提升上千倍,这也让AI工具成为各国情报部门在网络攻防领域的布局重点。此前就有多家头部AI厂商被曝出与美国国防部、国土安全部等部门达成防务合作,AI技术的军事化应用趋势越发明显。
Claude Mythos是Anthropic在2026年4月推出的全新垂直领域大模型,核心特性是端到端网络安全响应能力:它不仅能自主扫描主流操作系统、开源组件的未公开漏洞,还能自动生成渗透代码、规划攻击路径,甚至可以模拟防守方的反制逻辑动态调整攻击策略,这也是美国国安局选中它的核心原因。该模型首发阶段仅对美国本土12家防务、安全机构开放,本周刚刚宣布扩大授权范围至全球15个国家的150家合作机构,其中大部分为北约成员国的政府部门和核心防务企业。
此次合作曝光后,Claude Mythos的应用边界问题迅速引发全球各国政府、金融机构和科技企业的普遍担忧。不少网络安全专家指出,一旦这类具备自主攻击能力的大模型脱离监管,轻则导致大量商业机构的数据泄露风险陡增,重则可能触发国家级网络对抗,突破现有网络空间的国际规则边界。
面对质疑,接近Anthropic的内部人士回应称,所有对外授权的Claude Mythos模型都设置了严格的权限管控和操作审计机制,且会对攻击目标范围做强制限制,“只有掌握先进的攻击技术,才能构建更完善的防守体系”,但这种说法并未打消外界顾虑,目前已有多个非美国的科技行业协会呼吁对AI攻防工具的跨境流通建立统一监管规则。
截至目前,全球范围内尚未出台针对AI攻防类大模型的统一监管框架,不同国家的准入规则、使用边界差异极大,监管滞后于技术发展的问题已经显现。已有多个国际网络安全组织呼吁,各国应尽快启动相关规则的多边谈判,明确AI攻防工具的使用红线,避免AI技术成为网络空间冲突的新导火索。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。