问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
国内大模型厂商DeepSeek近日宣布将旗下高端大语言模型V4-Pro的推理服务价格下调75%,这一调价动作直接对标OpenAI、Anthropic、谷歌等海外头部大模型厂商的高端定价策略,凸显当前大模型推理成本的持续下降趋势,也标志着全球生成式AI赛道的商业化竞争正式进入价格与技术双重比拼的关键阶段。
此次调价后,DeepSeek V4-Pro的千token输入价格仅为0.001元人民币,输出价格为0.002元人民币,仅为OpenAI GPT-4 Turbo同量级服务定价的1/5,直接击穿了过去两年全球高端大模型维持的价格基准线,引发行业内外的广泛讨论。
在此次调价之前,全球高端大模型市场的定价体系基本由海外头部厂商主导:OpenAI GPT-4 Turbo的千token输入定价约0.01美元,输出约0.03美元;Anthropic Claude 3 Opus的定价更是比GPT-4 Turbo高出30%左右。国内同级别大模型的定价普遍为海外厂商的50%左右,仍然让大量中小开发者、垂直行业客户难以承担高端大模型的使用成本,也限制了生成式AI在长尾场景的落地。
不同于消费互联网常见的恶意价格战,此次DeepSeek的调价背后是大模型推理技术的持续迭代带来的成本下降。据行业测算,2022年以来,大模型单token推理成本的年均降幅超过70%,稀疏激活架构、动态批处理技术、4bit量化推理等技术的大规模落地,让头部厂商的推理成本已经降到了三年前的10%以下。DeepSeek相关技术负责人此前也曾透露,其V4系列模型采用了自研的MoE架构和推理优化引擎,单位计算效率比行业平均水平高出40%以上,完全有能力支撑当前的定价水平。
多位行业分析师指出,此次降价只是全球大模型价格战的一个缩影,未来1-2年内,高端大模型的推理价格还有至少50%的下探空间。价格门槛的持续降低,将直接推动高端大模型从原来的互联网大厂、头部企业客户,下沉到中小商家、个人开发者群体,代码开发、智能客服、多模态内容生成、企业知识库等场景的AI渗透率将出现爆发式增长。而对于大模型厂商而言,单纯的参数竞赛已经没有意义,能否在保证模型效果的前提下控制成本,将成为下一阶段竞争的核心胜负手。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。