2026年5月21日,亚马逊旗下云AI开发平台SageMaker AI正式推出支持OpenAI兼容API的实时推理端点功能,开发者仅需修改原有应用的端点URL,无需重写代码、额外完成特殊签名封装,就可通过OpenAI官方SDK、LangChain、Strands Agents等主流开发工具直接调用托管模型,大幅降低企业跨平台迁移大模型应用的成本。
不少做生成式AI应用开发的团队最近都有一个共同的痛点:前期用OpenAI的接口规范快速搭建了产品原型,等到要上线部署私有微调模型、满足数据合规要求的时候,光是适配云厂商的专属推理接口就要花掉一两周的开发时间。这次SageMaker AI的更新,直接瞄准了这个行业共性的痛点给出了落地方案。
过去三年OpenAI的API接口已经逐渐成为全球大模型应用开发的事实工业标准,市面上超过80%的RAG知识库应用、多智能体工作流、对话式产品,在开发阶段都优先选择OpenAI的接口规范进行编码。不同云厂商各自的专属推理接口,往往有不同的鉴权逻辑、参数定义、流式输出格式,开发者迁移应用的时候要反复调试适配,非必要的开发成本占据了整体迭代周期的近30%。
本次上线的新推理端点,为所有存量和新增的SageMaker AI托管推理实例开放了专属的/openai/v1请求路径,开发者无需对原有OpenAI SDK的调用逻辑做任何修改,仅替换端点URL就可以发起标准的聊天补全请求,原生兼容流式输出、上下文传参、工具调用等所有OpenAI标准API的核心能力,也无需额外完成亚马逊云生态的SigV4签名封装,大幅简化了跨生态的调用流程。所有原本适配标准SageMaker API的推理组件,都默认开启该兼容能力,不需要开发者额外进行配置。
除了官方SDK之外,本次兼容适配直接覆盖了当前主流的AI开发生态,LangChain、LlamaIndex、Strands Agents等热门开发框架都可以零代码对接部署在SageMaker上的开源大模型、自定义微调的垂类行业模型。这种模式下,企业既可以保留前期基于OpenAI生态积累的全部开发资产,不需要推倒重来,同时又能将推理环节完全控制在自己授权的私有云环境中,满足金融、医疗等强监管行业的数据合规要求,还能灵活调用SageMaker提供的不同规格异构算力资源,将大模型推理的综合成本降低最高40%。
本次亚马逊推出的兼容接口功能,也是全球云AI厂商推进接口标准化的标志性动作之一。随着大模型行业的应用落地速度不断加快,开发者对跨平台、无绑定的开发环境需求持续提升,后续将会有更多云厂商跟进推出类似的兼容能力,整个大模型开发的迁移门槛还会进一步下探,中小企业不需要被单一厂商的生态锁定,就能根据业务需求灵活选择最适配的模型和部署基础设施。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。