问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年6月2日,腾讯云宣布自次日零时起大幅下调旗下智能体开发平台的DeepSeek-V4系列大模型调用价格,全面与DeepSeek官方售价持平。其中DeepSeek-V4-Pro缓存命中价格最高降幅达97.5%,推理输入、输出价均下调75%,DeepSeek-V4-Flash缓存命中价降幅达90%。该系列为今年4月新发布的1.6万亿参数量MoE架构大模型。

按照最新调价规则,DeepSeek-V4-Pro的推理输入、输出价格分别降至0.003元/千tokens、0.006元/千tokens,缓存命中价则低至0.000025元/千tokens;DeepSeek-V4-Flash的缓存命中价同样调整为0.000025元/千tokens,对高频调用场景的成本压降效果尤为明显。
作为今年4月24日发布的明星大模型产品,DeepSeek-V4系列包含Pro高性能版与Flash高速版两个版本,总参数量达1.6万亿,采用当前主流的混合专家(MoE)架构,原生支持最高100万tokens的上下文窗口,在长文本处理、复杂推理场景的表现位列国内大模型第一梯队。此前该系列模型的调用成本较高,一定程度上限制了中小开发者的使用意愿,而腾讯云此次调价直接拉平了第三方平台与官方的定价差,本质是降低AI应用的开发门槛。
此次调价中缓存命中价格的大幅下探是最受开发者关注的调整点:90%以上的降幅意味着,针对知识库问答、标准化批量推理、固定prompt生成等高频复用场景,开发者的调用成本直接压缩至原来的十分之一甚至三十分之一。对依赖大模型高频调用的SaaS服务商、智能客服厂商、内容生成平台来说,单月推理成本有望从十万级降至万元以内,盈利空间得到显著提升。
从行业趋势来看,腾讯云此次调价并非个例,近半年来国内头部云厂商均在逐步下调主流大模型的调用价格,背后是大模型推理效率的提升、算力成本的下降,以及云厂商抢占AI开发服务市场的战略需求。随着头部大模型的调用成本逐步下探至0.01元/千tokens以内,AI原生应用的落地速度将进一步加快,中小团队也能用上此前只有大厂才能负担的高性能大模型能力。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。