问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年8月27日,智谱AI正式发布GLM-5系列首个原生多模态大模型GLM-5.3-Flash,该模型正是此前开源社区引发广泛讨论的神秘模型“Ox-Alpha”。其第三方综合测评得分达57分,超越DeepSeek V4 Pro等主流旗舰产品,同时定价仅为每百万Token输入0.8元、输出2.8元,依托全国产算力底座成为行业性价比新标杆。

过去半个月,代号为“Ox-Alpha”、被开发者戏称为“牛来”的神秘多模态模型在开源社区引发大量测评和讨论,其接近全球顶级旗舰的性能表现,让不少从业者猜测其背后的开发主体是国内头部大模型厂商。直到8月27日,智谱AI正式揭晓答案:Ox-Alpha正是其GLM-5系列的首款原生多模态产品GLM-5.3-Flash。
根据第三方测评机构Artificial Analysis Intelligence的最新评分,GLM-5.3-Flash综合得分达到57分,不仅超过智谱上一代旗舰模型GLM-5.2,也比国内另一款头部产品DeepSeek V4 Pro正式版的53分高出4分,远超同类多模态模型18分的行业中间值。
作为原生多模态模型,其在图文理解、复杂推理、多轮对话等场景的表现均达到了旗舰级水准,解决了此前很多拼接式多模态模型存在的模态融合差、响应延迟高的问题,可直接支持企业级复杂多模态场景的落地需求。
更让行业震动的是GLM-5.3-Flash的定价策略。不同于传统大模型“参数越高、定价越贵”的行业惯例,这款旗舰级多模态模型的调用价格仅为每百万Token输入0.8元、输出2.8元,缓存命中场景下的价格还会进一步下探,仅为同级海外旗舰模型定价的1/10,国内同性能产品定价的1/5。
据智谱AI方面透露,如此低的定价核心得益于其全栈自研的技术体系和全国产算力底座的支撑,不需要支付海外IP授权费用,算力成本也比采用进口芯片的方案低40%以上,才能做到旗舰性能、平民定价。
此前,旗舰级多模态大模型的高调用成本,一直是中小开发者落地多模态应用的最大门槛,大量细分场景的创新需求因为成本问题难以落地。GLM-5.3-Flash的推出,直接将多模态大模型的使用成本降到了此前入门级模型的水准,预计将带动智能内容生产、多模态客服、教育AI等多个场景的应用爆发。
不少行业分析师指出,这款产品的发布标志着国内大模型行业的竞争已经从单纯的参数比拼、性能比拼,进入到“性能+成本+供应链自主可控”的综合比拼阶段,接下来半年内大概率会有更多厂商跟进调整旗舰产品的定价,国内大模型的普惠化进程将至少提前1-2年。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。