问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
当地时间8月13日,人工智能头部企业OpenAI正式上线旗舰大模型GPT-5.6 Sol的全新“Ultrafast”模式预览版,该模式在保障输出质量不变的前提下,可将模型运行效率提升至原有水平的14倍。本次更新主要面向B端企业用户开放,旨在解决高算力需求场景下大模型响应延迟的痛点,为企业级AI应用落地扫清核心障碍。

不少接入GPT-5.6 Sol的企业客户此前都有过类似的糟心体验:针对多步骤的供应链调度需求提交查询后,要等近10秒才能拿到完整结果,完全达不到实时决策的要求。这种“效果够了但速度跟不上”的痛点,如今终于有了官方解决方案。
近年大模型在产业端的渗透速度不断加快,金融实时风控、电商智能客服、工业数字孪生、自动驾驶仿真等场景,对大模型的响应速度要求普遍在百毫秒级。此前GPT-5.6 Sol虽然凭借领先的推理效果拿下了不少企业订单,但复杂任务平均响应耗时接近8秒的短板,也让很多对实时性要求高的客户不得不选择效果稍弱但速度更快的小参数模型,这也成为OpenAI企业业务增速不达预期的核心原因之一。
本次推出的Ultrafast模式并非通过降低模型输出质量换取速度,而是OpenAI在推理框架优化、动态稀疏计算、专属硬件调度适配三个层面实现了联合技术突破。官方测试数据显示,在输出结果完全一致的前提下,Ultrafast模式下GPT-5.6 Sol的推理速度最高可达原有版本的14倍,平均响应耗时压缩到0.5秒以内,完全满足绝大多数实时产业场景的需求。
有参与内测的零售企业客户透露,接入Ultrafast模式后,其智能客服系统的用户满意度提升了27%,复杂售后问题的解决效率提升了近2倍。目前该功能仅向OpenAI的企业级付费客户开放测试资格,预计2026年第四季度会逐步向普通Plus用户开放部分权限。
此前全球大模型厂商的竞争核心始终围绕模型效果展开,参数规模、基准测试得分是各家宣传的核心指标。但随着GPT-5.6 Sol、Claude 3 Opus等旗舰模型的效果已经达到产业应用的合格阈值,推理速度、调用成本、部署灵活性正在成为抢夺企业客户的核心胜负手。
OpenAI本次推出Ultrafast模式相当于为行业划定了新的竞争标杆,后续包括谷歌、Anthropic在内的头部厂商都将加速跟进推理侧的技术优化,行业普遍预计,未来1-2年内大模型的单位调用成本有望降至当前的十分之一,实时AI应用的普及速度将远超市场预期。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。