问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年4月22日,国内大模型厂商DeepSeek宣布旗下API正式升级至百万Token上下文版本,容量较此前的128k版本提升近7倍,同步将内置知识库更新至2025年5月,非联网状态下可覆盖对应时间节点的信息查询。创始人梁文锋此前曾透露新一代旗舰大模型研发进展,本次升级也被视作新模型落地前的重要技术铺垫。
对重度依赖大模型API的开发者群体而言,上下文窗口的容量上限一直是限制场景落地的核心瓶颈:此前DeepSeek API 128k的容量仅能支持单次上传约10万字文本,处理超长法律卷宗、全量代码库解析等任务时必须手动拆分内容、多次调用,不仅提升了开发成本,也容易出现上下文衔接错误。
近两年大模型的商业化落地逐渐向垂直行业深入,政务、法律、金融、软件开发等领域普遍存在长文本处理需求,仅能支持单篇短文交互的小上下文模型已经无法满足B端客户的核心诉求。从2025年开始,多家头部大模型厂商先后把C端产品的上下文窗口提升到百万Token级别,但API端受限于推理成本、算力调度等问题,大多仍停留在128k到512k的区间,本次DeepSeek率先把API端的上下文能力拉齐到C端水准,也直接拉高了行业的竞争门槛。
本次升级后,百万Token上下文的容量可支持单次上传最高约80万字的文本内容,且API端的能力已经和DeepSeek App、网页端完全对齐,全平台用户不需要额外做内容拆分就能完成整本书籍解读、上百轮历史对话留存等操作,大幅提升了对话连贯性和信息完整度。
同时,DeepSeek的内置知识库也同步更新至2025年5月,用户在非联网的离线部署场景下,也能准确查询到该时间节点之前的公开信息,对有数据安全要求、无法接入公网的企业客户而言,这一更新的实用价值甚至高于上下文能力的提升。
需要注意的是,当前DeepSeek的系列模型仍为单模态架构,仅支持文本、语音输入,暂不支持图像、视频等视觉内容的理解,用户需要根据场景需求选择适配的模型能力。
DeepSeek创始人梁文锋此前曾对外透露,团队正在研发新一代旗舰大模型,本次API端的能力升级也被业内视作新模型落地前的生态铺垫:提前让开发者适配百万Token的调用规则,等新模型正式上线后即可实现无缝对接,减少适配成本。
业内分析认为,本次升级后,百万Token级别的API服务将逐步成为行业标配,接下来头部厂商的竞争焦点将转向长上下文下的推理准确率、推理成本控制,以及多模态能力的落地速度,普通用户和开发者都将享受到技术迭代带来的红利。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。