
作者 | 周子意
據報道,谷歌正在收緊其Gemini人工智能平臺的資源供應,因為開發者、企業以及科技巨頭的日益增長的需求正威脅著現有容量。
這一舉措背后,是2025年3月至8月期間Gemini API請求量翻倍,這一點迫使谷歌重新思考應該如何分配科技領域最搶手的資源之一——原始人工智能(AI)計算能力。
據知情人士透露,谷歌在今年3月前后告訴Meta,無法足額供應其所需的Gemini模型算力額度。由于Meta對谷歌模型的需求遠高于其他客戶,因此受到的影響也最為明顯。
此舉打亂并推遲了Meta多項內部人工智能項目的推進節奏。受該算力限制,疊加公司整體壓縮人工智能成本的戰略,Meta已要求員工節約調用AI令牌,提升使用效率。
除Meta之外,其他谷歌客戶也受到算力不足影響,但程度相對有限。
自2026年5月17日起,谷歌對Gemini應用實施了基于算力額度的使用限制。這類似于手機流量套餐:用戶不再擁有無限請求,而是需在每周滾動更新的5小時刷新窗口內使用,并且每周有使用上限。
這些限制適用于廣泛范圍,而不僅限于一家公司。谷歌已記錄了速率限制和支出層級,旨在確保在該公司所稱的快速增長階段,所有客戶都能公平使用API。
谷歌選擇實施使用量限制而非單純擴大基礎設施,這正說明了其經濟考量。即使對于擁有谷歌資源的公司而言,要滿足不受約束的人工智能需求所需的資本支出也令人望而生畏,因此有必要在短期內采取需求管理措施。
這起事件再次凸顯,即使全球科技巨頭持續投入數千億美元興建數據中心并采購人工智能芯片,整體基礎設施仍難以追上生成式人工智能快速擴張所帶來的需求,算力供給仍是目前產業發展的重要瓶頸。
谷歌云端事業最新財報也反映相同問題。 在截至2026年3月底的2026財年第一季,谷歌云營收達200億美元,但Alphabet CEO皮查伊當時表示,算力限制使谷歌云無法承接更多客戶需求,也讓該部門積壓訂單較前一季接近倍增。

