问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年9月1日,科大讯飞全资子公司词元星火正式开源星火X2.5-4B、星火X2.5-1.7B两款端侧通用大模型。作为全球首个原生支持100万Token上下文的端侧大模型,该系列采用混合注意力架构优化核心能力,全程基于国产算力训练,现已开放全部权重、代码仓库与部署文档,综合性能领先同尺寸开源模型。

对于家电品牌的线下售后工程师来说,以往遇到冷门故障需要翻几百页的产品手册、对照过往工单排查问题的流程,未来可能只要把全套资料导入手机端的AI助手就能一键得到解决方案——这正是星火X2.5双子星大模型落地后的典型应用场景。
此次开源的两款大模型参数分别为4B和1.7B,均针对端侧部署的能耗、算力限制做了深度优化。和此前行业普遍的端侧模型上下文窗口不超过128K的水平相比,两款模型原生支持100万Token上下文,相当于一次性可以处理近70万字的文本内容,覆盖整本书籍、长篇技术文档、全年度运营数据集等复杂长文本场景,真正实现了小模型“读全书”的能力。
为了实现这一突破,模型采用混合注意力架构,用覆盖长篇文档、技术资料、多轮对话等场景的千亿Token级高质量数据集训练,同时针对智能体调用、代码生成、数学推理、指令遵循四大核心能力做了定向优化,实测表现全面领先业界同尺寸一流开源模型。值得注意的是,整个训练过程全程基于国产算力完成,供应链自主可控性显著提升。
端侧大模型的核心优势在于数据无需上传云端、响应延迟更低、无网络环境也可正常使用,但此前受限于上下文窗口大小,只能承担语音指令识别、简短信息查询等简单功能。
星火X2.5系列的百万Token能力下放后,端侧AI的应用场景大幅拓展:智能座舱可一次性导入完整车辆手册、用户过往出行记录,离线生成个性化出行方案;办公电子本可导入整份百万字的行业研究报告、全年会议记录,直接完成全文梳理、核心数据提取、观点对比等复杂任务;工业场景的手持运维设备导入全套运维手册后,一线工程师离线即可快速查询故障解决方案,无需逐层上报咨询。
此次官方同步开放了模型权重、代码仓库、部署文档,中小开发者无需投入高昂的训练成本,即可基于该模型快速开发适配不同场景的端侧AI应用,大幅降低了端侧AI的落地门槛。
随着大模型产业逐步从尝鲜走向落地,云侧大模型向端侧下沉已经成为行业公认的发展趋势。此前包括海外OpenAI、Google,国内多家大模型厂商都在布局端侧大模型,但上下文能力始终是核心短板。
此次讯飞星火将百万Token上下文能力首次下放到端侧,直接拉高了端侧大模型的能力基准线,后续赛道竞争将从单纯的参数规模比拼,转向上下文能力、能耗比、场景适配性等多维度的综合竞争。业内预计,未来1-2年内,搭载百万Token级端侧大模型的消费电子、工业设备、智能硬件产品将密集落地,普通用户无需依赖云端服务即可在本地享受到高性能的AI能力支持。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。