问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年3月,全球知名内容品牌《大英百科全书》及其子公司韦氏词典正式向美国曼哈顿联邦法院提起诉讼,指控微软投资的OpenAI未经授权使用近10万篇受版权保护的百科词条、词典条目训练ChatGPT,同时涉及不当使用商标的虚假宣传行为,原告方已提出经济赔偿、叫停侵权行为的多项诉讼请求。
此次诉讼的诉求核心直指生成式AI行业长期存在的训练数据灰色地带。根据公开的起诉书内容,OpenAI的侵权行为分为两类核心情形:一是在未获得任何授权的前提下,非法爬取了大英百科及韦氏词典累计近10万篇版权内容用于ChatGPT的多轮模型训练,用户向ChatGPT询问相关常识问题时,输出的内容摘要与原作几乎逐字相同,直接分流了大英百科官网的付费及免费流量,导致其用户规模连续数个季度出现下滑。
另一项指控则指向商标侵权,原告方指出,ChatGPT出现事实性错误(即AI幻觉)时,多次虚构内容出自《大英百科全书》授权,误导公众认为OpenAI与大英百科有官方合作,严重损害了后者积累数百年的内容权威性口碑。这也是大英百科继2025年起诉AI搜索公司Perplexity AI之后,第二次发起针对AI企业的维权诉讼,其对内容版权保护的强硬态度已经十分明确。
事实上,此次诉讼并非生成式AI领域的首个版权纠纷,自2023年起,全球范围内已有超过30起针对大模型厂商的版权诉讼,原告方覆盖图片机构、文字创作者、传统媒体等多个内容供给侧主体,核心诉求均指向大模型训练阶段未经授权使用版权内容的行为。
此前已有不少内容方选择与大模型厂商达成合作,比如美联社、《纽约时报》都先后和OpenAI签订了内容授权协议,前者的新闻内容被允许用于GPT系列模型的训练,后者则获得了GPT生成内容中引用其报道的版权分成。但对于大英百科这类核心内容壁垒极强、用户付费意愿较高的品牌而言,现有授权模式给出的收益很难匹配其内容的商业价值,因此更倾向于通过诉讼确定新的行业版权规则。
此次诉讼也给整个大模型行业敲响了警钟,随着各国版权监管政策的收紧,未经授权爬取版权内容训练大模型的行为将面临越来越高的法律风险,未来大模型厂商的训练数据成本将出现明显上升。
有行业分析师指出,未来拥有独家版权内容储备、或者已经和大量内容方达成长期授权协议的大模型厂商,将在竞争中获得明显的合规优势,而缺乏内容资源储备的中小厂商,可能会面临要么支付高额版权费、要么模型训练数据不足的两难境地,整个生成式AI行业的竞争门槛将进一步提升。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。