AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

智谱开源GLM-5.3-Flash 性能追平Claude Opus4.8定价仅其1/40

2026年8月27日,智谱正式发布并开源GLM-5系列首款原生多模态大模型GLM-5.3-Flash。该模型在Artificial Analysis Intelligence Index测评中获57分,与Claude Opus4.8持平,综合性能超越GLM-5.2,发布前曾以匿名身份“Ox-Alpha”登顶OpenCode、OpenRouter调用榜,定价仅为Claude Opus4.8的四十分之一,大幅降低前沿AI使用门槛。

配图

半个月前,一款名为“Ox-Alpha”的匿名大模型突然刷屏海外开发者社区:它在没有任何官方背书的情况下,连续一周登顶OpenCode、OpenRouter两大AI模型分发平台的调用量榜首,多模态理解、代码生成的实测表现甚至超过了不少市面上的主流头部模型,不少从业者猜测这是某海外大厂的秘密测试版本,直到智谱27日的新品发布会,这款“黑马”才正式揭下神秘面纱。

此次发布的GLM-5.3-Flash(320B-A18B)为GLM-5系列首款原生多模态模型,官方测试数据显示,其在Artificial Analysis Intelligence Index测评中拿到57分的总成绩,与Anthropic旗下头部闭源模型Claude Opus4.8持平,代码生成能力的实测表现也与后者相当,综合性能甚至超过了参数量更大的前代产品GLM-5.2。
技术层面,该模型是全球首个落地稀疏注意力与线性注意力混合架构的开源前沿大模型,通过动态调整不同任务下的注意力计算模式,在压缩激活参数量的同时保证了性能输出,推理效率比同级别模型提升3倍以上。

成本优势是此次产品的核心亮点。GLM-5.3-Flash的常规调用定价仅为同系列高配版GLM-5.3的十分之一,上线前三个月还提供限时折扣,最低可至常规价的二分之一,折算后调用成本仅为Claude Opus4.8的四十分之一。
此前中小开发者、创业团队批量调用头部多模态模型处理图文解析、代码调试、多轮交互等任务时,单月算力成本往往高达数千元甚至上万元,此次定价调整直接将前沿模型的使用门槛拉至普通开发者可承受的区间,甚至个人爱好者也能无压力调用全能力版本的模型。

过往头部多模态大模型大多采取“闭源高价”的商业化策略,少数开源的产品也会对核心能力做不同程度的裁剪,性能距离第一梯队有明显差距。智谱此次直接将追平头部闭源模型的产品全量开源,同时搭配极低的商用定价,释放出清晰的行业信号:大模型的竞争已经从过去拼参数、堆规模的“性能竞赛”,转向拼落地效率、拼普惠性的“落地竞赛”。
业内分析认为,随着这类高性价比开源模型的普及,原本算力成本高企的AI+产业场景,比如制造业质检、教育内容生成、中小企业数字化服务等,将迎来更快速的落地渗透。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。