问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
针对近期AI领域流传的“月之暗面旗下大模型Kimi K3性能快速提升是利用Anthropic的Fable模型蒸馏而来”的说法,多位AI大模型领域资深专家近日公开回应称,仅靠蒸馏Fable模型无法在短时间内实现Kimi K3级别的能力跃升,相关猜测缺乏技术逻辑支撑,目前暂无证据显示Kimi K3存在技术侵权行为。

今年7月中旬,月之暗面正式推出新一代通用大模型Kimi K3,这款产品在长文本理解、复杂逻辑推理、多模态交互等12项公开基准测试中均跻身全球第一梯队,部分指标甚至超过Anthropic旗下的Claude 3 Opus、OpenAI的GPT-4o等头部产品,其迭代速度引发全行业关注,相关技术来源的争议也随之发酵。
作为全球大模型赛道的核心玩家之一,Anthropic今年上半年被曝出内部正在研发代号为“Fable”的下一代大模型,其内测表现远超当前对外商用的Claude 3系列产品,部分测试数据在小范围流出后,刚好撞上Kimi K3的发布节点,加上部分开发者对比发现两者在部分推理题的回答逻辑上存在相似性,“Kimi K3靠蒸馏Fable走捷径”的说法很快就在开发者社群传播开来。
多位从事大模型训练研发的行业专家对该传闻给予了明确否定。“仅靠严格蒸馏Fable的输出结果,你不可能在这么短的时间内拿出能力这么强的量产模型”,一位头部AI企业的核心技术负责人表示,蒸馏闭源模型确实是中小厂商快速提升性能的常用手段,但这种方式只能复刻表层的回答风格,很难在核心的长上下文、复杂推理等能力上实现质的突破,更不可能通过公开测试的全方位校验。
事实上,月之暗面自成立以来就长期押注长上下文大模型赛道,此前已经推出了全球首个支持百万字上下文的商用大模型Kimi Chat,Kimi K3的能力提升主要来自三个核心模块的自研迭代:一是稀疏注意力优化架构,大幅降低了超长上下文的计算损耗,将有效上下文窗口提升到200万token的行业领先水平;二是多模态混合预训练策略,优化了通用语料、专业数据、合成数据的配比,解决了大模型“知识遗忘”的痛点;三是人机混合对齐机制,大幅提升了回答的实用度和安全性,这些技术的研发均早于Fable的相关信息流出时间,不存在“窃取技术”的可能性。
此次争议也折射出当前大模型赛道竞速下的合规隐忧。随着大模型迭代速度从年度更新加快到季度更新,不少中小厂商为了抢进度,确实存在通过爬虫获取头部模型输出结果、蒸馏复刻能力的“搭便车”行为,这种做法不仅涉嫌侵犯知识产权,也会压低整个行业的自研投入意愿,不利于长期技术创新。业内普遍呼吁,后续要加快建立大模型技术溯源机制,完善相关知识产权保护规则,为合规研发的企业创造更公平的竞争环境。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。