问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
2026年7月消息显示,受全球算力供给短缺影响,谷歌已限制Meta对其顶级AI模型Gemini的访问权限。此前Gemini是Meta内容安全审核核心工具,检测性能优于其自研的Llama系列模型。当前谷歌2026年一季度云业务营收达200亿美元,但基础设施扩容仍跟不上算力需求增长,此次限制已导致Meta多个AI项目延误,倒逼其加速自研大模型与算力布局。

多位Meta内容安全线的内部员工透露,上周团队突然收到谷歌云的通知,调用Gemini模型的API配额被直接削减了60%,原本1小时就能完成的全平台有害内容批量筛查,现在需要至少3.5小时,部分新兴市场的诈骗内容举报响应时效,更是从2小时拉长到了8小时,用户投诉量环比上涨了27%。
这一变化的背后,是全球AI算力供需失衡的大背景。2026年上半年,随着大模型在C端内容生产、B端企业服务、工业自动化等场景的规模化落地,全球AI推理算力需求同比增长327%,即便是手握全球Top3云基础设施的谷歌,也难以覆盖爆发式的需求增量。
数据显示,谷歌2026年第一季度云业务营收达200亿美元,但其同期采购的GPU、TPU等算力硬件总量,仅能满足60%的新增订单需求。为了优先保障自家搜索、广告、核心云客户的算力供给,谷歌不得不对非核心合作方的模型调用权限进行限制,而年调用量排名前列的Meta首当其冲。
此前Meta选择Gemini作为内容安全审核的核心工具,正是因为其在诈骗信息识别、有害内容过滤场景下的准确率,比Meta自研的Llama 3模型高出12%,且单任务处理成本低18%,是Meta降低内容审核成本的核心支撑。
此次突如其来的权限限制,直接打乱了Meta多个AI相关项目的推进节奏,其中原定三季度上线的青少年内容保护功能,已经宣布延后至明年一季度上线。
面对基础设施层面的掣肘,Meta CEO马克·扎克伯格已经在内部高管会上明确要求,所有非核心业务的外部算力采购预算,全部向自研大模型、自有算力集群建设倾斜。原本计划2027年Q2上线的Llama 4安全专项模型,研发进度被提前了整整8个月,同时Meta宣布将在今年内新增3座超算中心,总算力规模较当前提升40%,目标是2027年实现核心AI业务的算力完全自主。
这一事件也折射出全球AI产业的发展拐点:此前科技巨头之间普遍存在交叉采购模型、算力服务的合作模式,正在被持续扩大的算力缺口打破。
多位行业分析师指出,未来2-3年内,先进算力的供需缺口将长期存在,“算力自主权”将成为科技巨头争夺AI产业话语权的核心指标。一方面,拥有自有算力集群的厂商,能够更好地控制大模型研发、迭代的成本与节奏;另一方面,避免被外部供应商卡脖子,也能保障核心业务的稳定性,避免类似Meta这次的业务动荡。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。