AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

大模型服务成本持续走高 美国科技企业转用中国开源模型

2026年以来美国头部大模型服务价格持续攀升,加密货币交易所Coinbase率先将智谱GLM5.2、月之暗面Kimi K2.7设为工程师默认AI工具,CEO布莱恩·阿姆斯特朗透露该举措在未限制Token用量的前提下将公司AI开支压缩近50%,目前Airbnb、AI企业Lindy等多家美企也已跟进切换中国开源大模型降本。

上周,Coinbase的工程师们打开内部开发工具时发现,此前默认排在首位的GPT-4o入口已经被调整到二级菜单,取而代之的是两个来自中国厂商的大模型选项:智谱GLM5.2与月之暗面Kimi K2.7。这一没有提前发全员通知的调整,很快在硅谷开发者社群引发了广泛讨论。

过去18个月里,美国头部闭源大模型先后4次调整计费标准,百万Token的调用成本平均涨幅超过45%,对于每年AI调用量超万亿Token的科技企业来说,仅这一项开支的年增量就可达数千万美元。不少硅谷科技公司的技术负责人此前在社交平台吐槽,大模型调用成本已经超过了云服务器开支,成为企业研发板块增长最快的成本项。

此前不少企业通过限制员工单月Token用量控制成本,反而引发了开发效率下降的内部争议,寻找更高性价比的替代方案,成为不少企业技术部门的核心KPI。

阿姆斯特朗在内部沟通会上透露,本次调整前公司技术团队对十余款开源大模型进行了为期3个月的测试,最终选定的智谱GLM5.2在代码生成、逻辑推理场景的准确率达到GPT-4的94%,Kimi K2.7的长文档处理能力甚至超出原有工具17%,而两者的调用成本仅为美国头部闭源模型的35%。

调整落地后,工程师不仅没有受到任何Token用量限制,反而可以放开使用大模型处理更多重复性工作,公司整体AI开支压缩了48%。目前这两款模型已经覆盖了Coinbase内部代码审查、文档总结、测试用例生成等90%的常规开发场景。

除了Coinbase之外,短租平台Airbnb近期也完成了客服场景的大模型替换,采用中国开源大模型处理用户工单分类、退改政策问答等需求,在准确率持平原有方案的前提下,单月AI成本下降了62%;AI初创公司Lindy则把中国开源模型作为Agent的底层基座,推理成本降低了70%。

此前海外市场对中国大模型的认知多停留在中文能力突出,随着多家头部厂商迭代多语言版本、开放商用友好的开源协议,中国大模型的海外接受度正在快速提升。行业测算显示,2026年上半年中国开源大模型的海外调用量同比增长320%,生产级场景的占比已经从去年的8%提升到27%。

行业分析师指出,当前大模型产业正在从“追求极致性能”转向“性能成本平衡”,中国开源大模型凭借高性价比、灵活可二次开发的特点,正在快速抢占海外生产级场景的市场份额,预计2027年中国开源大模型在海外的调用量占比将突破20%。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。