问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
6月2日腾讯云智能体开发平台宣布,将于6月3日零时起对DeepSeek旗下V4系列大模型执行全面降价政策,其中主力模型DeepSeek-V4-Pro推理输入、输出价格均降75%,缓存命中价格降幅达97.5%;轻量款DeepSeek-V4-Flash缓存命中价降90%,本次调价旨在降低企业与开发者大模型调用成本,释放AI创新活力。

当前AI应用落地进程中,大模型推理成本是制约中小团队创新的核心门槛之一,尤其是面向C端的高并发智能应用、企业内部知识库等高频复用场景,调用成本往往占项目运营成本的60%以上,不少初创团队甚至因为算力成本过高被迫暂停项目迭代。
本次调价覆盖DeepSeek V4系列全量产品,不同定位的模型降幅均指向高频使用场景的成本优化。其中定位通用高性能推理的DeepSeek-V4-Pro,推理输入、输出价格均下调75%,直接降低了所有调用场景的基础成本;最值得关注的是其缓存命中价格降幅高达97.5%,对于企业客服、知识库问答等存在大量重复查询请求的场景,单条请求的成本几乎可以忽略不计。
主打低延迟高并发的轻量模型DeepSeek-V4-Flash也同步调整价格,缓存命中价格降幅达90%,适配实时对话、短视频脚本生成、智能助手等对响应速度要求高的场景。腾讯云方面透露,本次调价后平台上DeepSeek V4系列的调用价格已经与DeepSeek官方原厂价格完全持平,开发者无需额外支付平台适配费用即可享受腾讯云的工具链支持。
作为国内大模型厂商的第一梯队产品,DeepSeek V4系列此前已经凭借128K长上下文支持、高准确率代码生成、多模态理解等能力获得大量开发者认可。本次调价并未对模型能力做任何裁剪,腾讯云智能体开发平台已经完成了与V4系列的全接口适配,开发者无需修改原有调用代码即可直接享受降价福利,同时还可以使用平台提供的prompt工程、知识库挂载、多模型编排等工具,进一步降低AI应用的开发难度。
从平台侧来看,本次降价也是腾讯云推动智能体生态建设的重要动作,更低的调用成本可以吸引更多开发者入驻平台,丰富智能体应用的品类,形成“平台-开发者-用户”的正向循环。
此前国内大模型市场的竞争核心集中在参数规模、能力上限等技术指标上,随着多个大模型的通用能力趋近及格线,企业与开发者选型时对成本的敏感度正在快速上升。本次腾讯云针对DeepSeek V4系列的大幅降价,正是击中了当前市场的核心需求,也释放出明确的信号:大模型推理服务已经从“尝鲜期”进入“规模化落地期”,性价比将成为云平台和大模型厂商的核心竞争维度之一。
行业分析师预测,接下来半年内会有更多云平台跟进大模型调用价格的调整,同时会出现更多针对垂直场景的定制化优惠方案,中小开发者的AI创新门槛将进一步降低,2026年下半年大概率会迎来中小AI应用的爆发期。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。