Google Cloud 7 月 21 日更新 Gemini Enterprise Agent Platform 文件,將一批透過 Model as a Service(MaaS)提供的開放模型標示為 deprecated,退役日期訂在 2026 年 10 月 21 日。MaaS 是由 Google Cloud 代管模型端點、讓客戶以 API 呼叫模型的服務;這次變更會影響仍使用這些端點的既有工作負載。
清單包含 DeepSeek-OCR、DeepSeek-R1、DeepSeek-V3.2、GLM 5、GPT OSS 20B、Kimi K2 Thinking、Llama 3.3 70B、MiniMax M2、多個 Qwen 3 模型,以及 E5 文字嵌入模型。Google Cloud 建議客戶在退役日前改用其他託管端點,或將模型改成在 Model Garden 自行部署。
Google Cloud MaaS 將於 10 月 21 日停止多個開放模型端點
Google Cloud 對 deprecated 的定義是,模型進入通知期後,既有端點仍可供原有工作負載使用,但不再加入新功能或更新,且新的端點使用可能受到限制。到了 retirement date,該 MaaS 端點就不再提供服務。
這個時間表針對的是 Google Cloud 的託管入口,並不等於 DeepSeek、Llama、Qwen 或其他模型的權重在所有環境中消失。使用者若在自有 GPU、其他雲端或不同服務商部署同名模型,仍需依各平台的版本、授權與生命週期規則處理。

DeepSeek、Llama、Qwen 與 GPT OSS 都在退役清單
文件列出的模型 ID 都帶有 `-maas` 後綴,例如 `deepseek-v3.2-maas`、`llama-3.3-70b-instruct-maas`、`gpt-oss-20b-maas` 與 `qwen3-coder-480b-a35b-instruct-maas`。同一批清單也包括 `multilingual-e5-small-maas` 與 `multilingual-e5-large-maas` 兩個嵌入端點。
這些端點的共同點是透過 Google Cloud 以 serverless managed API 形式提供。應用程式若把模型 ID、區域、權限或回應格式寫死在 MaaS 入口,遷移時需要同步檢查 API 位址、模型版本、流量設定與輸出驗證。
Google Cloud 以 Model Garden 自部署作為替代路徑
Google Cloud 的 Model Garden 文件把自部署模型與 MaaS 分開:MaaS 不需要客戶配置伺服器,而自部署模型會在客戶的 Google Cloud 專案與 VPC 網路內建立端點。文件也指出,自部署模型需要客戶管理部署資源,並依實際計算資源付費。
因此,自部署可以保留部分模型選擇與環境控制,但也會把機器類型、GPU 容量、擴縮、監控與更新責任交回使用團隊。若改用另一個託管模型,則要另外核對區域、配額、輸入輸出格式與模型行為差異。
Google Cloud MaaS 退役日期把遷移期限定在 10 月
Google Cloud 文件目前把 2026 年 10 月 21 日列為上述開放模型 MaaS 端點的 retirement date,並提供對應的 self-deploy alternative。文件也保留一項限制:退役時間表可能延後,但不會早於表列日期。
在退役前,既有端點仍可能可用;新工作負載是否能繼續建立則可能受到限制。使用中的 API 端點、部署方式與替代模型,最後仍要以 Google Cloud 的最新生命週期文件與實際專案設定為準。
消息來源:Google Cloud 開放模型退役文件、Google Cloud MaaS 開放模型文件、Google Cloud Model Garden 自部署文件。