AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

DeepSeek下调Flash系列大模型定价 最高降幅达60%

大模型厂商DeepSeek于2026年9月9日发布公告,将于9月10日12时起正式调整Flash系列大模型的调用定价,覆盖deepseek-v4-flash及deepseek-v4-flash-vision-exp两款产品。本次调价三档价格全线下调,其中空闲时段输入缓存命中价降幅达60%,输出价降至每百万Token4元,高峰时段定价为空闲时段的2倍。

配图

2026年以来,国内大模型市场的竞争已从参数规模、效果比拼转向落地性价比的角逐,推理调用成本作为影响企业客户选型的核心指标,成为各家厂商降价争夺的核心阵地。DeepSeek本次针对主打高吞吐低延迟的Flash系列调价,直接拉低了行业主流推理产品的价格底线。

根据官方公布的定价方案,本次调价区分空闲时段和高峰时段计费,空闲时段输入缓存命中每百万Token仅0.02元,输入缓存未命中每百万Token1元,输出每百万Token4元,高峰时段各项价格均为空闲时段的2倍。

和原价格相比,三档计费标准均有明显下调:其中输入缓存命中价从原空闲时段0.05元降至0.02元,降幅达60%;输入缓存未命中价从1.5元降至1元,降幅约33%;输出价也较此前下降了超20%。本次调价覆盖Flash系列两款核心产品:通用大模型deepseek-v4-flash、多模态实验版模型deepseek-v4-flash-vision-exp,两款产品执行相同的调价幅度。

Flash系列是DeepSeek面向高频推理场景推出的轻量化产品,主打毫秒级响应延迟,此前已经广泛应用于智能客服、内容生成、实时多模态识别等场景。

本次调价对不同场景的成本优化效果差异明显:对于长会话、重复查询占比较高的客服、知识库问答场景,缓存命中占比可达70%以上,企业客户的整体推理成本可直接下降40%以上;对于个人开发者、小型创业团队而言,低至0.02元每百万Token的调用价格,也大幅降低了AI应用的试错门槛。

业内分析认为,DeepSeek本次调价背后,是大模型推理侧工程化优化的持续突破:通过缓存技术、量化压缩、算力调度等技术的迭代,头部厂商已经能够在不损失推理效果的前提下,持续摊薄单位调用成本。

本次降价也很可能引发行业连锁反应,此前已有多个大模型厂商推出过阶梯定价、流量包优惠等政策,随着推理成本的持续下探,此前因成本问题难以落地的下沉场景,比如线下商户的智能导购、教育领域的个性化辅导工具等,都将迎来规模化落地的窗口期。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。