全部產品
Search
文件中心

SuperApp:快速部署平台模型

更新時間:Apr 29, 2026

本文介紹了小程式叢集對接方案如何進行平台模型部署與資源配置。

第一步:選擇模型

從多種來源中選擇基本模型或 LoRA 適配器進行部署。

模型選擇方式

瀏覽模型廣場

探索我們精心整理的預訓練模型集合,涵蓋業界領先的 AI 供應商。

可用模型:Qwen, GPT, DeepSeek, GLM, internlm 等

開啟模型廣場

使用自有模型

部署您已在平台上上傳或微調的模型。

配置選項

選擇模型

  • 基本模型:具備廣泛的語言理解和產生能力,適合作為起點部署

  • 微調模型:在本平台基於基本模型後訓練完成的定製模型

顯示名稱

用於在控制台中標識該部署的描述性名稱(不超過 64 個字元)

模型架構

選擇模型部署架構(VLLM, SGLANG)

image

第二步:配置資源

為您的模型選擇合適的計算資源與部署設定。

資源配置

地區選擇

根據使用者所在位置選擇部署地區,以獲得最優訪問延遲。

可用地區:新加坡,日本,美國東部,印尼,法蘭克福,中國香港,馬來西亞

GPU 類型選擇

根據模型需求和效能要求選擇合適的 GPU 類型。

可選規格: NVIDIA A10、L20 等

副本數量

部署的副本數量,用於負載平衡與高可用保障。

image

第三步:確認並部署

在建立部署前,請確認您的配置資訊與費用明細。

費用概覽

  • GPU 計算費用

  • 系統開銷(當前為 $0)

說明: 模型下載與儲存費用不計入費用概覽。