问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年9月1日,科大讯飞全资子公司词元星火正式开源星火X2.5-4B、星火X2.5-1.7B两款端侧通用大模型,两款模型原生支持最高100万Token超长上下文窗口,突破端侧算力瓶颈,可支撑小型智能设备处理超长文本与复杂长周期任务,为车载、消费级智能硬件等多场景的离线AI应用提供底层技术支撑。

过去三年,端侧AI的落地速度始终落后于云端大模型,核心卡点集中在两点:一是小参数模型性能不足以支撑复杂推理、多轮交互任务,二是上下文窗口普遍在32万Token以下,无法处理长文档、长周期任务需求,多数智能终端的AI功能仍需依赖云端响应,不仅延迟高,也存在用户数据上传的隐私风险,车载、智能穿戴、家居IoT等场景的离线AI需求长期未被充分满足。
本次开源的两款模型均为针对端侧硬件优化的小参数量通用大模型,不同于行业常见的“大模型压缩后适配端侧”的技术路径,两款模型从训练阶段就针对端侧有限的算力资源做了架构优化,原生支持最高100万Token的上下文窗口,且无明显性能损耗。
按照1Token约等于0.7个汉字换算,100万Token足以覆盖一整本70万字的长篇小说、一份数百页的项目合同的全量处理需求。此外,两款模型还重点提升了智能体交互、数学计算与通用语义理解能力,可适配更多场景的复杂需求。
两款开源模型主要面向车载、消费级智能硬件、万物互联等端侧场景,开发者可直接基于开源模型做场景化定制,无需支付授权费用,大幅降低端侧AI的开发门槛。同时,所有计算均在设备本地完成,无需上传云端,既降低了响应延迟,也从底层保障了用户数据隐私。
据了解,本次端侧模型开源只是词元星火9月产品发布的第一站,9月7日该团队还将发布更大参数规模的通用大模型,最终形成“端侧小模型负责离线轻量化任务、云端大模型负责超复杂推理”的端云协同产品矩阵,覆盖不同层级的AI应用需求。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。