AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

匿名模型Ox Alpha登顶OpenRouter 累计调用量超4万亿Token

2026年8月,匿名大模型Ox Alpha(中文社区昵称“牛来”)上线聚合平台OpenRouter后热度快速攀升,登顶平台模型榜单并刷新单日用量纪录,仅前五大应用累计调用量已超4万亿Token。目前其开发商未对外公开,OpenRouter将其定位为面向编码、Agent任务的推理模型,业内猜测其开发方或关联智谱、谷歌DeepMind等机构。

配图

OpenRouter作为全球头部的大模型API聚合平台,其周度调用量排行榜向来是全球开发者选择模型的核心参考:在8月第三周的最新榜单中,上线不足1个月的Ox Alpha直接挤下此前长期霸榜的GPT-4o Mini、Claude 3.5 Sonnet等头部模型,登顶总调用量榜的同时,还以1.2万亿Token的单日调用量刷新了平台成立以来的单模型用量纪录。

这款被国内中文AI社区昵称为“牛来”的模型,增长动力完全区别于此前的爆火模型:其调用量并非来自C端流量应用的拉动,而是由B端开发者和智能体场景的真实需求驱动。

OpenRouter披露的数据显示,仅Hermes Agent、Claude Code等五款头部开发工具、智能体应用对其的调用量就已经突破4万亿Token,这一数据相当于普通百亿参数模型上线半年的总调用量。超过72%的调用请求来自30人以下的初创开发团队,不少开发者反馈,Ox Alpha在长上下文编码、多步骤Agent任务的容错率比现有主流模型高30%以上,已经逐步替代了不少生产场景的原有模型。

截至目前,Ox Alpha的开发主体始终未对外公开,OpenRouter仅对外说明该模型由第三方匿名团队开发,核心能力覆盖代码生成、长时推理任务、生产级工作流调度三大场景。

社区技术爱好者通过比对Tokenizer分词规则、输出逻辑等技术指纹,发现其与国内大模型厂商智谱的GLM系列模型匹配度超过80%,因此猜测其是智谱未对外公布的新一代测试模型;而另一方面,谷歌DeepMind的多名研究员近期在社交平台转发Ox Alpha的相关测试结果时,多次提及“Gemini新版本的能力超出预期”的表述,也让不少业内人士将其与谷歌未发布的Gemini 3系列挂钩。在不少业内人士看来,匿名上线已经成为头部厂商测试新模型能力的常用方式,可避免早期口碑波动对品牌造成影响。

Ox Alpha的爆火也折射出当前大模型市场的全新变化:此前开发者选择模型时优先考量品牌知名度、官方宣传的参数指标,而现在越来越多的开发者会基于实际业务的测试效果选择模型,哪怕其品牌未知。

OpenRouter平台的数据显示,2026年以来匿名上线的测试模型调用量占比已经从年初的3%攀升至27%,这一数据意味着开发者对大模型的选择正在变得越来越务实,效果成为核心考量指标。未来可能会有更多头部厂商选择匿名的方式先跑通开发者场景的验证,再对外公布正式版本,大模型市场的竞争也将逐步从营销端转向产品能力端的真实比拼。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。