问小创

您好,我是AI助手

我可以帮您推荐合适的AI工具,有什么需要帮忙的吗?

我会根据您的需求,智能推荐站内收录的AI工具
猜您想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI助手: 我可以帮您推荐合适的AI工具,有什么需要帮忙的吗?

Cursor推出Composer 2.5编程大模型 性能对标GPT-5.5级产品

AI代码编辑器开发商Cursor于2026年5月19日发布自研编程大模型Composer 2.5,该模型基于月之暗面开源Kimi K2.5基座微调,训练数据量较前代提升25倍,85%计算预算投入强化学习与扩展训练。在SWE-Bench、CursorBench v3.1测试中得分达79.8%、63.2%,性能看齐Anthropic Opus 4.7、GPT-5.5等顶尖大模型。

对于常年依赖AI编程工具的开发者而言,调用头部通用大模型API的高成本、数据泄露风险一直是两大核心痛点。此次Cursor推出的自研大模型,正是瞄准这一市场空白,试图用垂直领域的定向优化,拿出比通用大模型性价比高得多的编程解决方案。

过去三年,AI编程工具的核心能力几乎都绑定OpenAI、Anthropic等厂商的通用大模型API,开发者每生成1000Token的代码,平均需要支付0.01到0.03美元的调用成本,对于日均生成上千行代码的资深开发者而言,仅工具成本每月就可达数百元。此外,代码作为企业核心资产,上传到第三方大模型API引发的泄露风险,也让不少企业级用户对公共AI编程工具持观望态度。

Cursor作为全球市占率前三的AI代码编辑器,此前已经积累了超过1200万全球开发者用户,覆盖从个人开发者到科技大厂的各类编程场景,这也为其自研编程大模型提供了充足的场景数据支撑。

为了贴合编程场景的特殊需求,Cursor团队没有选择堆叠参数的通用大模型路线,而是基于月之暗面开源的Kimi K2.5基座做垂直微调,训练数据量较前代提升25倍,且全部是编程相关的合成任务数据,覆盖从前端页面开发到后端架构重构的全场景代码需求。

更值得关注的是其研发投入的倾斜:Cursor将85%的计算预算投入强化学习与扩展训练,而非常规的预训练环节。这一选择针对性补全了大模型在复杂逻辑拆解、代码错误排查、多文件联动修改等高频编程场景的能力短板,避免了通用大模型经常出现的“代码跑不通、逻辑自相矛盾”等问题。

在业界公认的SWE-Bench多语言编程测试和CursorBench v3.1专项评测中,Composer 2.5分别拿到了79.8%和63.2%的得分,这一成绩已经和当前顶尖的通用大模型Anthropic Opus 4.7、GPT-5.5的编程能力持平,部分复杂C++、Rust代码生成场景的准确率甚至超过后者。

Composer 2.5的推出,也打破了此前“只有千亿参数通用大模型才能做好专业场景任务”的固有认知。相较于通用大模型动辄数十亿的训练成本,垂直场景大模型基于开源基座微调的路线,成本仅为前者的几十分之一,却能在特定场景达到持平甚至超越的效果。

据Cursor团队透露,后续Composer系列大模型将全部内嵌到编辑器产品中,用户不需要调用外部API即可使用,不仅使用成本将降低60%以上,代码数据也可以全程留在本地,解决了企业用户的安全顾虑。这一模式也将为更多垂直领域的AI应用厂商提供参考,推动AI从通用能力普及走向细分场景的深度落地。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。