AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

腾讯发布混元3.0大模型 编程性能跃升40%已开放免费体验

2026年4月,腾讯正式推出新一代AI大模型混元3.0(内部代号Hy3),在AI专家姚顺雨带领的研发团队推动下,其编程能力实现突破性提升,SWE-Bench编程测试得分达74.4%,较上一代混元2.0提升超40%,目前该模型以Hy3preview名义在OpenRouter平台免费开放体验,已跻身国内大模型第一梯队。

国内大模型赛道的竞争正在从通用能力比拼,转向垂直场景的硬核能力卡位,其中开发场景的代码生成、调试能力,已经成为2026年头部厂商竞速的核心赛点。腾讯此次推出的混元3.0,正是瞄准这一赛道缺口交出的最新答卷。

根据公开的SWE-Bench编程能力测试数据,混元3.0的得分达到74.4%,而此前发布的混元2.0得分仅为53.0%,性能提升幅度超过40%。这一成绩已经接近智谱AI推出的GLM-4.7,尽管距离最新的GLM-5仍有一定差距,但已经足以让混元3.0进入国内代码能力最强的大模型第一阵营。

架构层面,混元3.0采用了当下主流的MoE(混合专家)架构,设置三个不同级别的推理档位,支持最长262K的上下文窗口,能够处理长代码文件的全量解析、跨模块调试等复杂开发需求,对中大型项目的开发辅助能力远高于上一代产品。

混元3.0的性能大幅跃升,与腾讯此前引入的AI专家姚顺雨直接相关。作为深耕大模型性能优化、代码专项训练领域的资深研究者,姚顺雨加盟腾讯后,牵头重构了混元大模型的代码训练数据集、优化了模型微调策略,直接解决了此前混元系列代码能力偏弱的短板。

业内人士指出,头部科技企业对核心AI研发人才的争夺,正在直接影响大模型产品的迭代速度,人才的流动已经成为决定大模型赛道竞争格局的核心变量之一。

目前混元3.0已经以Hy3preview的名义在全球大模型聚合平台OpenRouter上线,面向所有用户免费开放体验。不同于此前腾讯大模型优先面向内部生态、B端客户开放的策略,此次直接登陆第三方开放平台,显然是希望快速收集全球开发者的真实使用反馈,进一步优化模型性能。

按照腾讯过往的产品落地节奏,在完成公测优化后,混元3.0的代码能力后续大概率会接入腾讯云开发工具、微信小程序开发平台等自有生态,为B端开发者、C端低代码用户提供辅助开发能力。

随着AI Agent、企业级自动化开发需求的爆发,大模型的代码能力已经不再是小众场景的需求,而是成为支撑AI落地千行百业的核心基础能力。2026年以来,已经有包括智谱、字节、百度在内的多家厂商推出了代码专项优化的大模型产品,赛道竞争日趋白热化。

预计接下来半年内,国内头部大模型的SWE-Bench测试得分将普遍突破80%,代码生成的准确率、可直接部署率还将有明显提升,相关开发工具的落地成本也会进一步下降。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。