接入大模型 API 时,需要对用户输入和模型输出进行内容安全检测。本文介绍如何开通 AI 安全护栏(AI Guardrails)按量付费服务,以及各审核类型的计费规则。
开通 AI 安全护栏按量付费后,默认支持内容合规检测服务。如需检测敏感内容或提示词攻击,需在控制台打开相应的功能开关后才可使用这两项检查功能(下文有相应的介绍)。
开通AI 安全护栏按量付费
开通 AI 安全护栏按量付费不收费,系统按实际用量计费。具体计费单价见审核类型与计费单价。
根据业务场景选择合适的接入方式:
API 接入:通过 API 直接调用审核服务,适用于独立使用 AI 安全护栏的场景。
开启检测功能
登录AI 安全护栏产品控制台,在左侧导航栏选择。
在检测项配置列表中,找到目标 Service,单击操作列的管理,进入 Service 管理页面。
在防护维度区域,通过卡片上的开关启用或关闭对应检测功能:
内容合规:默认启用,检测色情、暴力、政治等不良内容,该功能单独计费。计费单价见审核类型与计费单价。
敏感内容检测:检测可能泄露的个人信息或企业敏感数据,该功能单独计费。计费单价见审核类型与计费单价。
提示词攻击检测:检测旨在绕过大模型安全限制的恶意提示词,该功能单独计费。计费单价见审核类型与计费单价。
恶意URL(公测中):扫描大模型内容中的恶意链接,当前免费试用。
模型幻觉(公测中):检测大模型生成的虚假或不准确信息,当前免费试用。
检测Agent:基于用户灵活自定义配置的大模型交互内容,精准识别业务自定义的特定风险内容。计费单价见检测Agent计费方案。
开启成功后,对应功能的开关显示为已开启状态。
审核类型与计费单价
接入方式 | 审核类型 | 支持的业务场景(服务) | 计费单价 |
API 接入/AI 网关集成接入 | 文本审核-按次-高级 text_guard_advanced |
| 6 美元/万次 |
API 接入/AI 网关集成接入 | 敏感内容审核-按次-高级 text_sddp_advanced |
| 6 美元/万次 |
API 接入/AI 网关集成接入 | 提示词攻击审核 |
| 6 美元/万次 重要 该项功能已于 2026 年 01 月 22 日正式开始商业化收费,如不需要使用该服务,请在 AI 安全护栏产品控制台关闭服务,以免产生费用。 |
AI 安全护栏按量付费会根据不同的检测内容和检测量级进行计量和出账。
前往AI 安全护栏产品开通服务页面
仔细阅读并选中服务协议,单击立即购买。
开通成功后,登录 AI 安全护栏控制台,确认服务状态为已开通。
欠费与充值
AI 安全护栏的计费周期窗口为24 小时。
阿里云在每一个计费周期窗口根据上一周期窗口的服务使用量出具账单,并从阿里云账户中按账单金额扣划服务费用。账单出账时间通常在每个自然日结束后 10~12 小时。
当系统检测到账户处于欠费状态时,将暂停提供服务。待补缴欠费后,可再次使用内容安全服务(5 分钟内生效)。