智能體專用型規格類型系列是面向中小企業及開發人員Agent情境的規格類型系列,在雲端服務器資源基礎上打包預付費Tokens資源。本文介紹該規格類型系列的適用情境、在售執行個體規格、Tokens資源的計費計量方式以及使用限制,供您在購買前做規格選型參考。
規格類型系列介紹
智能體專用型規格類型系列專註於中小企業及開發人員的Agent情境,在Simple Application Server的計算、儲存、網路資源之上,打包預付費的Tokens資源,具備以下特點:
簡單:套餐內包含Tokens資源,無二次消費;與熱門AI應用深度整合,提供應用鏡像與面板,開箱即用。
便宜:將匹配中小企業及開發人員需求的vCPU、記憶體、雲端硬碟、公網與Tokens打包定價。
典型情境包括雲端專屬AI助理(如OpenClaw、Hermes Agent、ZeroClaw等個人助理,Claude Code、OpenCode等編碼助理)以及基於Dify等搭建的自建AI應用。
使用限制
當前僅在中國站的中國內地地區售賣。
不支援掛載資料盤。
暫不支援升配。
Tokens資源套件用盡後,平台將自動停止模型服務(限流為0),以避免產生套餐以外的Tokens費用,用量在下一個計費周期重設。高峰期資源爭搶和濫用模型工具,會對RPM(每分鐘調用次數)和TPM(每分鐘消耗Token數)進行限流,智能體專用型不適合應用於對模型效能有強保障訴求的情境。
模型:為最佳化智能體專用型資源利用,將根據模型迭代升級情況不定期下線歷史模型。自下線通知發布之日起,將逐步縮減待下線模型的RPM(每分鐘調用次數)和TPM(每分鐘消耗Token數)。自模型正式下線之日起,停止支援模型推理服務,已建立的調用該模型的應用和服務將無法返回結果。
退訂:雲端服務器按剩餘時間長度退還殘值,Tokens資源按剩餘用量退還殘值;對於五天無理由退訂情境,如果Tokens資源已有消耗,則不支援退訂。
執行個體規格
智能體專用型規格類型系列包含的執行個體規格及指標資料如下表所示。關於各指標資料的說明,請參見執行個體規格指標說明。
執行個體規格 | vCPU | 記憶體(GiB) | 系統硬碟容量(GiB) | 公網流量包 | 峰值公網頻寬(Mbps) | 公網線路類型 | 固定公網地址 | Tokens(M) |
swas.as.c2m05s20b1t100.linux | 2 | 0.5 | 20 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 100 |
swas.as.c2m2s40b1t200.linux | 2 | 2 | 40 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 200 |
swas.as.c2m4s50b1t400.linux | 2 | 4 | 50 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 400 |
swas.ad.c4m8s180b1t800.linux | 4 | 8 | 180 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 800 |
swas.ad.c4m16s240b1t800.linux | 4 | 16 | 240 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 800 |
swas.ad.c8m16s300b1t1600.linux | 8 | 16 | 300 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 1600 |
swas.ad.c8m32s360b1t1600.linux | 8 | 32 | 360 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 1600 |
swas.ad.c16m32s420b1t3200.linux | 16 | 32 | 420 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 3200 |
swas.ad.c16m64s480b1t3200.linux | 16 | 64 | 480 | 無固定流量(不收取流量費用) | 最高200 | BGP | 1個IPv4 | 3200 |
智能體專用型(2 vCPU)不適合應用於對計算效能有強保障訴求的情境,當阿里雲在業務高峰期出現資源爭搶時,計算效能會發生一定的波動;智能體專用型(≥4 vCPUs)適合對計算效能有強保障訴求的企業級情境,始終能保證對整個超執行緒的佔用,從而提供始終如一的高效能。智能體專用型規格類型系列目前僅在中國站的中國內地地區售賣,支援的地區包括華東1(杭州)、華北2(北京)、華東2(上海)、華南1(深圳)、西南1(成都)、華北1(青島)、華北3(張家口)、華北5(呼和浩特)、華北6(烏蘭察布)、華南3(廣州)、華中1(武漢-本地地區)、華南2(河源)。
Tokens資源
支援的模型
智能體專用型執行個體的Tokens資源當前支援以下模型版本,模型採用預設配置:
qwen3.7-plus
deepseek-v4-flash
計費與計量
售賣方式:Tokens資源套件與雲端服務器強捆綁,採用預付費方式,隨執行個體一同購買,不支援單獨購買Tokens。
計量方式:Tokens不區分輸入、緩衝和輸出,不區分單次請求的輸入Token階梯,不收模數型工具調用費用。計量單位為M(百萬Tokens)。
額度用盡:當Tokens資源套件用盡後,模型服務將不可用,直到下一個計費周期重設用量。
用量查詢與通知
用量查詢:您可以查詢Tokens資源套件的已使用量和總量。具體操作,請參見賬單和用量查詢。
用量通知:當Tokens資源套件使用量達到50%、80%、100%三個閾值時,通過簡訊、郵件、站內信、Webhook四個通路向您發送通知。
API接入
API Key:每台雲端服務器帶一個獨立的API Key,支援重設、禁用。
Base URL:
OpenAI相容:https://api.simple-server.cn/compatible-mode/v1
Anthropic相容:https://api.simple-server.cn/apps/anthropic
支援的鏡像
系統鏡像:Alibaba Cloud Linux 4 LTS 64位 Agentic版、Alibaba Cloud Linux 4 LTS 64位、Alibaba Cloud Linux 3.2104 LTS 64位、Ubuntu。
應用鏡像:OpenClaw、Hermes Agent、CoPaw、ZeroClaw、MaxKB、Dify、寶塔Linux面板、1Panel。
自訂鏡像。