AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

京东云首发上线MiniMax M3大模型 推理性能实现跨越式提升

2026年6月2日,国内大模型厂商MiniMax正式发布新一代M3大模型,京东云JoyBuilder模型开发平台同步完成首发接入并面向公众开放服务。本次接入依托京东云自研推理框架,融合PD分离部署、KV Cache缓存、投机采样等多项优化技术,实现推理吞吐量与响应效率双提升,将大幅优化开发者调用体验。

配图

作为国内大模型赛道的重磅新品,MiniMax M3此前就因集齐顶尖编程能力、100万token超长上下文窗口、原生多模态交互三大核心能力受到行业广泛关注,是目前国内首个同时满足三项技术指标的大模型产品,部分性能表现已经跻身全球第一梯队。

大模型商业化落地的核心瓶颈之一,就是推理阶段的性能损耗——高并发场景下的延迟升高、吞吐量不足,往往会直接影响开发者的调用体验和落地场景的稳定性。

京东云本次接入M3时,针对推理场景做了全链路技术优化:依托自研的推理框架,深度融合PD分离部署、KV Cache缓存、投机采样等多项前沿优化技术,实现了底层算力的高效调度。实测数据显示,同等硬件配置下,M3在京东云平台的推理吞吐量较行业平均水平提升42%,单请求响应延迟压缩28%,推理效率实现阶跃式提升。

京东云JoyBuilder是面向AI开发者打造的一站式模型开发运营平台,覆盖算力调度、微调训练、部署上线、运维监控等全链路工具能力,目前已经接入数十款主流开源及商用大模型。

本次首发接入M3后,开发者无需自行完成模型适配、算力部署等繁琐工作,即可直接调用经过性能优化的M3全量能力,可快速落地代码辅助开发、长文档智能处理、多模态内容生成等多个场景的应用,大幅降低中小企业的大模型应用成本。

近两年来,大模型的迭代速度不断加快,从模型正式发布到实现产业落地的时间窗口已经从过去的半年以上压缩到1周以内。

云厂商凭借算力调度、工程优化、开发者生态的三重优势,已经成为大模型厂商连接终端用户、落地产业场景的核心通道。本次京东云能够第一时间完成M3的适配接入与性能优化,也体现了其在大模型服务领域的技术储备与响应速度,未来“模型厂商+云服务商”的联动模式将成为行业常态,进一步推动AI技术的普惠落地。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。