2026年7月3日,AI大模型厂商Anthropic宣布将于7月7日起,将旗下旗舰大模型Claude Fable5从现有各档订阅服务中移除,转为按实际使用量的积分计费模式。此前Pro、Max等订阅用户每周可使用该模型的额度最高占周限额的50%,本次订阅权益缩水引发大量用户不满,官方解释称调整源于算力承载压力。

就在不少用户已经习惯用Claude Fable5处理长文档创作、多模态复杂推理任务时,Anthropic的一纸权益调整公告,直接打破了原有订阅用户的使用预期。有海外用户在社交平台晒出账单截图显示,其每月支付29美元的Pro订阅中,近6成使用时长都分配给了Fable5模型,本次调整相当于其订阅价值直接缩水一半。
作为Anthropic在2026年第一季度推出的旗舰级大模型,Claude Fable5凭借128M超长上下文窗口、毫秒级多模态响应精度以及接近人类水准的复杂逻辑推理能力,上线仅3个月就实现了月调用量突破20亿次的成绩,远超Anthropic此前的产能规划。
此前为了快速抢占高端用户市场,Anthropic将Claude Fable5纳入了全档位订阅包的权益范围,规定Pro、Max、团队版及部分企业版用户,每周最多可以将50%的订阅内置使用额度分配给Fable5。这一策略确实帮助Anthropic在上半年拿下了近12%的全球高端大模型市场份额,但也为后续的算力危机埋下了伏笔。
Anthropic官方给出的调整理由是Fable5的市场需求远超预期,现有算力承载能力已经接近极限,调整计费模式是为了保证服务的稳定性和资源分配的公平性。但不少行业分析师认为,旗舰模型的成本倒挂才是本次调整的核心原因。
据业内测算,Claude Fable5单次处理10万token长文档的推理成本约为0.12美元,是上一代旗舰Claude 3 Opus的7.2倍。按照此前的订阅规则,每月支付29美元的Pro用户如果满额使用Fable5的配额,单月产生的推理成本最高可达120美元,远高于订阅费用。叠加当下高端GPU产能仍然紧张,Anthropic无法在短期内快速扩容算力池,只能通过调整计费规则,筛选出真正愿意为高价值服务付费的用户。
按照新的计费规则,7月7日之后订阅用户的固定权益将不再包含Fable5的调用权限,用户需要单独购买使用积分进行兑换,每1000token输入收费0.02积分、输出收费0.08积分,1积分对应0.01美元,折算下来定价和当前GPT-4o的按需付费价格基本持平。
本次权益调整在用户群体中引发了明显的分歧。大量个人C端用户在社交平台吐槽,订阅费用没有下调,但核心权益被砍,属于变相涨价。有用户晒出自己的使用记录显示,其每月Pro订阅的使用需求中60%都依赖Fable5,调整后每月的使用成本将从29美元上涨至80美元以上。
而不少B端企业用户反而对本次调整持支持态度。有跨境电商企业的技术负责人表示,此前因为大量C端用户占用Fable5的算力,企业端的调用请求经常出现10秒以上的延迟,高峰时段甚至会出现调用失败的情况。调整为按需付费后,企业用户的算力优先级更高,服务稳定性明显提升,反而更符合B端的使用需求。
实际上,本次调整并非大模型行业的个例。今年上半年OpenAI就曾两次下调GPT-4o的订阅用户免费调用额度,谷歌Gemini Ultra也早已退出普通订阅包转为单独付费,高端旗舰模型脱离通用订阅包、转向按需付费已经成为行业的普遍趋势。
从行业发展的角度来看,大模型厂商的策略调整本质上是商业化路径的回归。在过去几年的补贴期,各大厂商为了抢占用户,纷纷将高端模型放入低价订阅包,本质上是用亏损换市场。但随着大模型技术逐步落地,资本对AI企业的盈利要求越来越高,覆盖成本、实现正向现金流已经成为所有大模型厂商的核心目标。
未来,“通用订阅+高端模型按需付费”的分层服务模式大概率会成为行业标配:普通用户可以通过几十元的月费订阅获得入门级大模型的无限使用权限,满足日常聊天、文档整理等轻度需求;有专业需求的用户和企业用户,可以按照实际使用量付费调用旗舰模型,获得更高的性能和稳定性。这种模式既能够覆盖不同层级用户的需求,也能让大模型厂商实现可持续的商业化运营。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。