问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年5月,网络安全领域曝出典型大语言模型滥用案例。据安全研究员Sibi Moosa监测,恶意开发者利用Anthropic旗下大语言模型Claude编写恶意代码,向npm包仓库推送超670个含窃取脚本的污染包,可盗取开发者敏感凭据、私有代码库资源。该事件暴露出大语言模型降低恶意软件开发门槛的风险,已引发全球网络安全行业高度警惕。

作为全球应用最广的JavaScript软件包管理系统,npm仓库承载着超过千万个开源组件,是全球前端开发者日常开发的核心基础设施。而近期曝出的这起大规模投毒事件,再次将开源生态的安全软肋和AI滥用的新风险摆到了行业面前。
过去几年,npm仓库的恶意代码投毒事件时有发生,但此前的攻击大多由攻击者手动编写代码、逐个上传包,投放规模通常仅有数个到数十个,扩散速度相对可控,平台通过人工审核和简单的特征匹配就能拦截大部分风险。
随着开源组件的调用率持续攀升,90%以上的商业软件项目都会引入第三方开源包,开源供应链早已成为网络攻击者的核心靶场,一旦投毒成功就可能影响数十万甚至上百万个下游项目,收益远高于传统定向攻击。
此次曝光的案例打破了过往的攻击规律。据网络安全研究员Sibi Moosa的监测数据,网名为“mousie-5212-super-formatter”的恶意开发者,全程借助Anthropic旗下大语言模型Claude生成恶意代码的核心逻辑,仅通过简单的指令诱导,就获得了逻辑严密、隐蔽性极强的凭据窃取脚本。
整个攻击过程的自动化程度极高,攻击者仅需对Claude输出的代码做简单的伪装和打包,就能生成可正常安装的npm包。短时间内,攻击者就向npm仓库推送了超670个受污染软件包,这些包被下载安装后,会悄悄窃取用户设备上的npm令牌、GitHub访问凭据,甚至爬取本地存储的私有代码库源代码,将所有数据上传至攻击者控制的远端服务器。
此次事件也暴露出当前大语言模型安全对齐机制的盲区。现有LLM的内容审核规则大多会直接拒绝“写恶意代码”的明确请求,但攻击者可以通过拆分需求、伪装成正常功能开发等诱导方式,绕开审核规则获取所需的恶意代码片段,拼接后就能实现完整的攻击功能。
业内安全专家提醒,此次事件只是AI滥用的一个缩影,未来针对开源生态的AI辅助攻击会越来越多。一方面,大语言模型厂商需要优化对齐策略,识别更隐蔽的恶意请求;另一方面,npm等开源包管理平台也需要升级审核机制,加入针对AI生成恶意代码的专项检测能力,从源头阻断污染包的扩散。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。