问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
AI大模型企业Anthropic近期发布公开指控称,阿里巴巴通过2.5万个伪造账号大规模爬取其旗下大模型产品Claude的交互数据,累计发起2880万次查询,疑似通过模型提取手段复刻Claude的技术能力。该事件是今年以来全球AI领域首个公开曝出的头部企业间大规模数据窃取纠纷,引发行业对大模型知识产权保护的广泛讨论。

根据Anthropic提交的相关合规文件披露,这场有组织的爬取行为持续了近三个月,所有涉事账号均使用虚假身份信息注册,通过分散IP的方式规避了Claude平台的接口频率限制和反爬规则,2880万次查询的规模相当于近百万普通用户一个季度的总调用量。
本次指控中提到的模型提取攻击,是AI领域针对闭源模型的常见攻击方式:攻击者通过向目标模型发起大量查询、获取输出结果,用这些数据训练自有模型,就能以极低的成本复刻目标模型的核心能力,相当于直接窃取厂商投入上亿美元的研发成果。
作为仅次于OpenAI GPT系列的全球第二大闭源大模型,Claude在长文本处理、多轮逻辑推理等领域拥有明显技术优势,其企业级客户数量在过去一年增长超过7倍,和阿里巴巴旗下通义千问系列大模型在全球To B AI服务市场存在直接竞争关系。
本次事件之所以引发行业高度关注,核心原因在于全球范围内尚未出台针对大模型知识产权保护的明确规则。目前闭源大模型厂商的防护手段主要集中在接口限流、异常账号识别等层面,面对头部企业发起的、有技术储备的规模化爬取,现有防护机制往往很难完全阻断。
此前行业内已有多起中小厂商爬取主流大模型数据的案例,但均未进入公开追责流程,本次Anthropic公开指控阿里巴巴,也是头部企业首次就大模型窃取行为正式发起维权,其后续走向将为行业建立相关规则提供重要参考。
随着大模型商业化进程加速,AI行业的竞争已经从早期的技术研发竞速,延伸到知识产权、商业伦理等多个维度。本次事件也倒逼行业重新思考公共AI服务的使用边界:通过公开接口获取的模型输出,是否可以被用于训练其他商业化模型,大规模自动化调用是否属于侵权行为,这些问题都有待监管层和行业协会给出明确答案。
截至发稿,阿里巴巴方面尚未对该指控作出公开回应,不少行业专家表示,无论最终核查结果如何,本次事件都将推动全球AI行业建立更完善的知识产权保护机制,规范市场竞争秩序。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。