问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年7月,全球AI产业突现成本失控警报,Atlassian、Adobe、亚马逊、花旗银行等科技及金融巨头相继出台内部限制政策,禁止员工随意调用GPT-5.5、Claude Opus 4.6等旗舰大模型,转而要求使用低价替代方案。此次成本暴涨源于供应商从固定年费改为按量计费,部分企业AI单月开销已涨至此前三倍,突破1500万美元。

近日一份从花旗银行内部流出的办公指引文件,把此前隐藏在全球科技企业内部的AI成本压力直接公之于众:所有业务线员工的GPT-5.5、Claude Opus 4.6及4.7版本等旗舰大模型默认调用权限已被全部收回,普通办公需求仅可使用价格仅为前者二十分之一的中小参数模型,违规调用旗舰模型产生的费用将由部门自行承担。
此前多数企业采购第三方大模型服务采用固定年费模式,员工调用权限放开后基本没有成本约束,不少业务线甚至把旗舰大模型用来写周报、整理会议纪要这类低价值场景。随着大模型推理端算力成本持续上涨,从2025年底开始,OpenAI、Anthropic等头部供应商陆续取消企业级固定年费套餐,全面转向按token调用的按量计费模式,成本压力直接传导到下游企业。
某头部SaaS企业泄露的内部财报显示,切换计费模式后,其单月AI调用成本从480万美元暴涨至1520万美元,涨幅超过210%,整个上半年的AI预算在Q2首月就消耗殆尽,不得不临时追加预算才能保证核心业务的AI需求不受影响。
面对陡然高企的成本,各家企业的应对策略逐渐趋同,核心都是把AI资源向高价值场景倾斜。花旗银行采取了最严格的管控措施,只有涉及全球宏观策略分析、复杂金融产品建模等高密高价值场景,经过部门总监和IT部门双重审批后才可以申请调用旗舰模型。
Atlassian则推出了内部场景分级机制,普通的代码补全、客服回复需求强制引导到成本仅为旗舰模型1/18的自研小模型,只有长文档推理、跨语种法律文件审核等场景才开放旗舰模型权限。Adobe更是直接把旗下创意云的全部AI生成功能切换到自研的Firefly系列模型,彻底停用第三方旗舰模型接入,仅这一项调整就使其单月AI成本下降62%。
这场由成本引发的“限流潮”,也宣告了过去三年AI产业不计成本跑马圈地的阶段正式结束。Gartner AI产业首席分析师陈曦表示,2026年全球企业级AI市场的核心关键词就是“投入产出比验证”,过去不管场景价值盲目上高端模型的做法会被市场彻底淘汰。
未来“中小模型覆盖通用需求、旗舰模型定向服务高价值场景”的分层架构会成为绝大多数企业的标配,而成本压力也正在反向倒逼大模型供应商调整商业化策略,目前已有多家头部厂商开始测试针对高频调用客户的阶梯折扣包、场景专属定价等灵活方案,整个AI产业的商业化路径正在向更理性、更可持续的方向演进。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。