接入大模型 API 時,需要對使用者輸入和模型輸出進行Alibaba Content Security Service檢測。本文介紹如何開通 AI 安全護欄(AI Guardrails)隨用隨付服務,以及各審核類型的計費規則。
開通 AI 安全護欄隨用隨付後,預設支援內容合規檢測服務。如需檢測敏感內容或提示詞攻擊,需在控制台開啟相應的功能開關後才可使用這兩項檢查功能(下文有相應的介紹)。
開通AI 安全護欄隨用隨付
開通 AI 安全護欄隨用隨付不收費,系統按實際用量計費。具體計費單價見審核類型與計費單價。
根據業務情境選擇合適的接入方式:
API 接入:通過 API 直接調用審核服務,適用於獨立使用 AI 安全護欄的情境。
開啟檢測功能
登入AI 安全護欄產品控制台,在左側導覽列選擇。
在檢測項配置列表中,找到目標 Service,單擊操作列的管理,進入 Service 管理頁面。
在防護維度地區,通過卡片上的開關啟用或關閉對應檢測功能:
内容合规:預設啟用,檢測色情、暴力、政治等不良內容,該功能單獨計費。計費單價見審核類型與計費單價。
敏感内容检测:檢測可能泄露的個人資訊或企業敏感性資料,該功能單獨計費。計費單價見審核類型與計費單價。
提示词攻击检测:檢測旨在繞過大模型安全限制的惡意提示詞,該功能單獨計費。計費單價見審核類型與計費單價。
恶意URL(公測中):掃描大模型內容中的惡意連結,當前免費試用。
模型幻觉(公測中):檢測大模型產生的虛假或不準確資訊,當前免費試用。
檢測Agent:基於使用者靈活自訂配置的大模型互動內容,精準識別業務自訂的特定風險內容。計費單價見檢測Agent計費方案。
開啟成功後,對應功能的開關顯示為已開啟狀態。
審核類型與計費單價
接入方式 | 審核類型 | 支援的業務情境(服務) | 計費單價 |
API 接入/AI 網關整合接入 | 文本審核-按次-進階 text_guard_advanced |
| 6 美元/萬次 |
API 接入/AI 網關整合接入 | 敏感內容審核-按次-進階 text_sddp_advanced |
| 6 美元/萬次 |
API 接入/AI 網關整合接入 | 提示詞攻擊審核 |
| 6 美元/萬次 重要 該項功能已於 2026 年 01 月 22 日正式開始商業化收費,如不需要使用該服務,請在 AI 安全護欄產品控制台關閉服務,以免產生費用。 |
AI 安全護欄隨用隨付會根據不同的檢測內容和檢測量級進行計量和出賬。
前往AI 安全護欄產品開通服務頁面
仔細閱讀並選中服務合約,單擊立即購買。
開通成功後,登入 AI 安全護欄控制台,確認服務狀態為已開通。
欠費與儲值
AI 安全護欄的計費周期視窗為24 小時。
阿里雲在每一個計費周期視窗根據上一周期視窗的服務使用量出具賬單,並從阿里雲賬戶中按賬單金額扣劃服務費用。賬單出賬時間通常在每個自然日結束後 10~12 小時。
當系統檢測到賬戶處於欠費狀態時,將暫停提供服務。待補繳欠費後,可再次使用Alibaba Content Security Service服務(5 分鐘內生效)。