AI アプリケーション保護は、人工知能 (AI) システムとそのアプリケーションシナリオに対して、Web Application Firewall (WAF) 3.0 で導入された一連のセキュリティ対策です。AI モデル、データ、インフラストラクチャ、およびビジネスプロセスを攻撃、不正利用、または予期しないリスクから保護します。このトピックでは、AI アプリケーション保護の利点と、有効化する方法について説明します。
AI アプリケーション保護とは
AI モデルは、自然言語処理、画像認識、インテリジェントな推薦システムなど、さまざまな分野で広く使用されています。その強力な生成能力と高い処理効率は、多くの業界に前例のない機会をもたらしています。しかし、AI アプリケーションや AI エージェントを開発・運用する際、開発者や AI 企業は、リクエスト内容のコンプライアンスリスク、プロンプトインジェクション攻撃、ジェイルブレイクコマンド、ロールプレイ操作などのセキュリティ脅威に直面しています。これらの AI 関連リスクは、通常のビジネス運用を脅かすだけでなく、企業を重大なコンプライアンスリスクや社会的リスクにさらします。そのため、AI アプリケーションのセキュリティ確保は、見過ごせない重要な検討事項です。
利点
AI アプリケーション保護は、Alibaba Cloud AI Security Guardrails と統合されています。プロンプトインジェクション攻撃、ロールプレイ操作、ジェイルブレイク攻撃などを検知し、ブロック、レスポンス置換、取り消しなどの WAF 対策と組み合わせることで、リスクをリアルタイムでブロックし、ビジネスのセキュリティを確保します。
プロンプト攻撃の検知:生成 AI を対象としたインジェクション攻撃に対する専門的な防御を提供します。ジェイルブレイクコマンド、ロールプレイ操作、システムインストラクションの改ざんなどの敵対的攻撃を正確に識別し、AI システムの「免疫防衛線」を構築します。これは、AI エージェントのインストラクションのやり取りにおけるセキュリティ確保、オープンドメイン対話システムにおける敵対的攻撃の防御、サードパーティ プラグインの呼び出しの権限管理などのシナリオに適用されます。
コンテンツのコンプライアンス検出:リクエストとレスポンスの両方のコンテンツに対してコンプライアンスチェックを実行し、すべてのインタラクションがセキュリティおよび規制要件を満たしていることを確保します。
リアルタイムの保護と対応:ブロック、レスポンス置換、取り消しなどの WAF 対策と組み合わせることで、異常な動作をリアルタイムでブロックし、レスポンスコンテンツを自動的に置換して、安全なビジネス運用を確保します。
AI アプリケーション保護の有効化
AI アプリケーション保護を有効化する前に、サブスクリプション WAF 3.0 または 従量課金 WAF 3.0 を有効化し、Web サービスを WAF に追加する必要があります。
Web Application Firewall 3.0 コンソールにログインします。トップメニューバーで、WAF インスタンスのリソースグループとリージョン ([中国本土]または[中国本土以外]) を選択します。左側のメニューで、 を選択します。
パブリックプレビューの申請:AI アプリケーション保護 ページで、パブリックプレビュー版の無料トライアル をクリックします。画面上の指示に従って試用申請情報を入力し、[送信] をクリックします。
Alibaba Cloud のエンジニアが、申請を受け取ってから 1 週間以内に連絡し、試用の詳細を確認します。試用申請が承認されると、WAF インスタンスで AI アプリケーション保護機能が自動的に有効化されます。
AIガードレールサービスの開通とロール認可: WAF の AI アプリケーション保護 機能は、AI Guardrails の一部の機能を利用します。 パブリックプレビューの申請が完了したら、WAF の AI アプリケーション保護 ページに戻り、画面の指示に従ってサービスの有効化とロールの承認を完了します。
WAF の AI アプリケーション保護 機能はパブリックプレビュー中です。機能自体は無料です。ただし、AI Guardrails の機能を呼び出すため、関連料金は通常どおり請求され、AI Guardrails の請求書に記載されます。
FAQ
What are the differences among AI Guardrails, AI application protection, and AI Gateway?
Comparison item | AI Guardrails (core atomic capabilities) | AI Application Protection (for security teams) | AI Gateway (for business teams) |
Product positioning | Core atomic capabilities for AI intent protection. It provides detection of content risks, prompt attacks, hallucinations, and sensitive information. | An out-of-the-box security protection product built on AI Guardrails. | A traffic routing and management component for Large Language Model (LLM) API forwarding. Security protection is an additional feature. |
Integration method | A detection-only SDK that requires integration with your application's source code. | Requires no modifications to your application code. You can enable protection by adding the AI application's domain name to WAF. | -Set the base URL for the AI agent to the endpoint URL of the AI Gateway. |
Features | Offers high flexibility in deployment and rule configuration. It can be embedded anywhere, such as within applications, between applications, or within LLMs, to effectively prevent policy evasion. | Supports rule configuration with fine-grained protection dimensions. It includes various preconfigured actions, such as revoke, replace, acknowledgement, block, log, and custom responses. | The security plug-in is built on AI Guardrails but offers limited capabilities. It does not support rule configuration for fine-grained content types, and the only available action is to block. |
Limitations | Provides detection capabilities only and does not include direct action capabilities. | Relies heavily on the WAF architecture. This product cannot be used if the protected domain name cannot be added to WAF. | Offers limited security capabilities and actions. |