2026年7月15日,国内大模型厂商月之暗面在多个社交平台发布预热内容,为即将推出的Kimi K3大模型造势。目前代号Kivine的匿名模型已现身Arena.ai评测平台,业界普遍推测其为Kimi K3测试版,已有网友流出其与Claude Fable5、GPT-5.6 Sol等头部旗舰模型的对比测试内容,直指当前第一梯队大模型的能力短板。

此次放出的预热视频时长不足15秒,全片用科技感极强的流动光效作为主视觉,仅在第4秒位置闪过一个亮银色的数字“3”,没有放出任何参数信息或功能演示,却迅速引发了大模型圈的集体讨论。
作为国内最早主打超长上下文能力的大模型厂商,月之暗面旗下的Kimi系列一直保持着较快的迭代节奏。2025年7月推出的K2系列,仅用一年时间就迭代到了K2.6版本,已经实现300个子Agent并行调度的能力,在多任务处理、复杂文档解析等场景的表现已经跻身国内第一梯队。
此前Kimi系列凭借200万字的超长上下文窗口能力,在办公、法律、研发等B端场景已经积累了不少客户,K2.6版本的多Agent能力更是解决了多任务并发处理的痛点,此次K3的升级也被不少行业用户寄予厚望,符合其每年更新一代主力模型的产品节奏。
就在预热视频放出的同一天,一款代号为Kivine的匿名模型悄然登上了第三方大模型评测平台Arena.ai,其能力评分在代码生成、逻辑推理两个核心维度上,已经接近当前公认能力最强的两款闭源模型:Anthropic旗下的Claude Fable5和OpenAI旗下的GPT-5.6 Sol。
随后很快就有网友放出了Kivine与两款头部模型的横向对比测试视频,在百万字代码库解析、多语言混合编程、复杂逻辑题求解等测试项中,Kivine的表现已经和Claude Fable5不相上下,部分场景甚至实现了反超。业界普遍认为,这款匿名模型就是Kimi K3的测试版本,月之暗面此次的目标直接对准了全球第一梯队的旗舰大模型。
从2025年下半年开始,全球大模型赛道已经逐渐脱离了“堆参数、拼上下文窗口长度”的粗放竞争阶段,厂商开始将研发重心放在细分场景的能力优化、多Agent调度效率、落地成本控制等更务实的方向上。
此次月之暗面的K3如果能在核心能力上追平甚至超过Claude Fable5,也意味着国内大模型厂商已经具备了和海外头部厂商正面竞争的实力,未来全球大模型市场的竞争格局很可能会出现新的变化。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。