AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

DeepSeek上调部分V4模型定价超10倍 产能承压下的供需博弈

国内大模型厂商DeepSeek近日宣布上调部分V4系列模型API调用价格,最高涨幅超10倍,引发全球开发者群体广泛关注。本次调价核心原因是高算力场景AI需求爆发导致算力产能承压,不过品牌同步推出错峰定价、缓存折扣、多模型路由等配套政策,用户实际使用成本波动远低于纸面涨幅。

配图

这波调价消息最早于7月中旬被海外开发者在GitHub、Reddit等开源社区自发曝光,有用户晒出的最新价目表显示,此前DeepSeek V4系列部分高参数推理模型的每百万token调用价格仅为0.1美元,调价后峰值时段最高可达1.2美元,涨幅超过11倍,不少依赖低成本API开发轻量级AI应用的中小开发者直言“超出预期预算”。

本次调价的底层逻辑是全球AI推理需求爆发带来的算力缺口。2024年上半年全球大模型API调用量同比上涨217%,其中高参数模型的推理算力缺口达到38%。作为近年崛起的高性价比大模型厂商,DeepSeek此前凭借比OpenAI GPT-4低80%的定价,在代码生成、多语言推理、中文语义理解等场景拿下了大量海外客户,2024年上半年其API调用量环比上涨超过300%,现有算力集群已经连续3个月负载率超过95%,峰值时段甚至出现过请求排队超过2分钟的情况,对企业级客户的服务稳定性造成了影响。

不少开发者忽略了本次调价的配套政策,其实际影响远低于纸面涨幅。DeepSeek官方在开发者社区回应称,本次调价仅针对工作日9:00-22:00峰值时段的高参数V4模型调用,非高峰时段、V3及以下模型的定价均保持不变。用户还可以享受两类优惠:高频调用的缓存内容最高可享70%折扣,平台也会自动将对精度要求不高的请求路由到成本更低的V3系列模型。测算显示,80%的普通个人开发者月均成本上涨不会超过25元人民币,本次调价更多是为了限制峰值时段的恶意刷量调用,优先保障付费企业客户的服务稳定性。

此次调价也标志着大模型行业正在告别过去两年的“低价抢量”野蛮增长阶段。行业分析师指出,此前不少大模型厂商的定价远低于实际算力成本,本质是用融资补贴用户,这种模式不可能长期持续。目前OpenAI、Anthropic等头部厂商也在测试分时段定价、缓存折扣等精细化定价规则,通过价格杠杆调节算力资源分配,既能避免资源浪费,也能保障厂商有足够资金投入下一代模型的研发。对于中小开发者而言,通过优化prompt减少冗余token、错峰调用等方式,依然可以将AI开发成本控制在合理区间。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。