谷歌因算力不足限制Meta调用Gemini模型

6月28日 14:40
受限于基础设施供给瓶颈,谷歌自2026年5月起对包括Meta在内的客户实施API调用额度管控,导致后者内部多项AI项目进度推迟并被迫调整资源使用策略。

谷歌母公司Alphabet因无法满足市场对人工智能算力的急剧增长需求,已对Meta公司调用其Gemini大模型实施严格的资源限制措施。这一事件的核心矛盾在于供给侧基础设施扩建速度滞后于需求侧爆发式增长,导致作为核心客户的Meta面临严重的算力缺口。据多方信息确认,谷歌方面于今年3月正式通知Meta,表示无法按照其期望规模提供所需的Gemini模型计算资源。由于Meta对算力的需求量远超其他普通企业客户,其内部研发活动受到的冲击最为显著,多项既定的人工智能项目因此被迫延期或调整推进节奏。

在具体的执行层面,受限于资源供给不足,谷歌自2026年5月17日起开始对Gemini应用程序实施基于额度的使用限制。该机制类似于移动通信领域的流量套餐模式,用户不再享有无限制的请求权限,而是在每周滚动的刷新窗口内(设定为5小时)拥有固定的使用上限。作为直接受影响方,Meta已向其内部员工发出指令,要求在保证业务运转的前提下节约消耗AI词元(token),提升现有资源的利用效率,以应对算力供应紧张带来的成本与进度压力。虽然谷歌云的其他客户也面临类似的资源紧缩状况,但受波及程度相对较轻,未出现类似Meta这样大规模的项目停滞现象。

从行业宏观视角来看,这一事件折射出当前人工智能基础设施建设的普遍性瓶颈。尽管全球主要科技企业持续投入数十亿美元用于采购芯片、扩建数据中心,但在面对指数级增长的AI服务需求时,算力供给依然显得捉襟见肘。谷歌首席执行官桑达尔·皮查伊曾公开表示,算力供给的制约直接阻碍了云业务实现更高的增长速度,并导致云部门积压订单量在季度环比中近乎翻倍。截至今年一季度,谷歌云营收虽已达200亿美元,但基础设施的物理限制已成为其进一步扩张的主要障碍。Meta此次遭遇的算力限制,不仅是单一企业的运营挑战,也反映了整个AI行业在从研发阶段向规模化应用过渡过程中面临的共同难题。