AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

微博AI发布VibeThinker-3B开源模型 小参数推理性能跻身第一梯队

微博AI近期正式发布3B参数开源密集推理模型VibeThinker-3B,该模型基于通义千问Qwen2.5-Coder-3B底座研发,采用独创的谱到信号(Spectrum-to-Signal)后训练pipeline优化,在AIME26基准测试中得分达94.3,LiveCodeBench v6测试得分达80.2,性能远超同参数级别模型,为端侧推理场景提供了高性价比的全新技术选型。

配图

根据2026年上半年端侧AI产业调研数据,近7成消费电子厂商正在推进本地AI推理功能的落地,但现有可商用的推理模型大多集中在7B及以上参数区间,受限于设备算力无法在中低端硬件上部署。而3B参数级别的模型普遍存在数学推理、代码生成能力不足的问题,在专业任务中的准确率不足50%,难以支撑教育、开发工具类场景的需求,产业端对高性能小参数推理模型的需求正在快速攀升。

过往AI推理能力的提升大多依赖参数规模扩张,头部闭源推理模型参数已经突破千亿级别,只能通过云侧调用提供服务,不仅存在数据隐私风险,网络延迟也无法满足实时交互场景的需求。而端侧部署要求模型参数控制在3B以内,此前行业内没有能同时满足高推理准确率、低算力消耗要求的成熟开源方案,成为限制端侧AI普及的核心瓶颈。

从应用端看,离线学习工具、车载智能助手、工业嵌入式检测设备等场景,都对本地推理能力有明确需求,仅国内市场对小参数推理模型的潜在需求规模就超过百亿元,供给端的缺口仍在持续扩大。

VibeThinker-3B的研发团队选择了代码能力突出的Qwen2.5-Coder-3B作为基础底座,没有走传统堆参数、加训练数据的技术路线,而是通过自研的谱到信号后训练pipeline对模型的推理逻辑层进行针对性优化,在不增加参数量的前提下大幅提升了模型的逻辑链拆解能力。

公开测试数据显示,该模型在数学推理基准AIME26中拿到了94.3分的成绩,在代码生成基准LiveCodeBench v6中得分达80.2,两项成绩均远超同参数模型的平均表现,甚至追平了部分10B参数级别的闭源推理模型。而且该模型完全开源,开发者可直接获取权重进行微调部署,无需支付商用授权费用。

业内人士分析,VibeThinker-3B的推出填补了3B参数级别高推理能力开源模型的市场空白,后续有望在离线数学辅导工具、嵌入式设备代码助手、低算力IoT设备本地决策等场景实现规模化落地。对于中小开发者而言,该模型的开源也大幅降低了端侧推理应用的研发门槛,无需投入大量算力从零训练模型,即可基于现有底座快速开发适配不同场景的端侧AI功能。

据了解,微博AI团队后续还将基于该训练架构推出1B甚至更小参数的推理模型,进一步适配智能手表、智能家居传感器等更低算力的终端设备,推动推理AI的全场景覆盖。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。