中国 (上海) リージョンでのユーザープロファイル分析シナリオに必要な MaxCompute プロジェクト、DataWorks ワークスペース、データソース、コンピューティング、ストレージの設定を準備します。
背景情報
地理的属性や社会的属性を含む基本的なユーザープロファイルを構築してウェブサイト上のユーザー行動を分析し、定期的な分析を実行することで、きめ細かなトラフィック運用とビジネス戦略をサポートします。
事前準備
開始する前に、「実験の概要」を読み、ユーザープロファイル分析のワークフローを理解してください。
注意事項
このチュートリアルでは、直接使用できるユーザー情報とウェブサイトのアクセスに関するテストデータを提供します。
提供されるデータはシミュレーションされたもので、DataWorks での実践的な演習のみを目的としています。
このチュートリアルでは、データ変換に DataStudio (レガシー) を使用します。
MaxCompute 環境の準備
1. MaxCompute の有効化
このチュートリアルでは MaxCompute が必要です。次のパラメーターを使用して、中国 (上海) リージョンで MaxCompute を有効化してください。
[リージョン]: 中国 (上海)
[仕様タイプ]: 標準コンピューティングリソース。
2. MaxCompute プロジェクトの作成
標準モードの DataWorks ワークスペースには、開発環境用と本番環境用に 2 つの MaxCompute プロジェクトが必要です。
MaxCompute コンソールに移動します。左側メニューで、 を選択します。
プロジェクトの作成 をクリックして、2 つの MaxCompute プロジェクトを作成します。次の表に、このチュートリアルの主要なパラメーターを示します。その他のパラメーターはデフォルト値のままにしてください。詳細については、「MaxCompute プロジェクトの作成」をご参照ください。
パラメーター
説明
[プロジェクト名]
カスタム。グローバルで一意である必要があります。
このチュートリアルの例:
本番環境:
workshop2024_01開発環境:
workshop2024_01_dev
[計算リソースの料金タイプ]
このチュートリアルでは、[従量課金] を選択します。
[デフォルト Quota]
このチュートリアルでは、ドロップダウンリストからデフォルトの後払いクォータを選択します。
[データ型]
このチュートリアルでは、ドロップダウンリストから [2.0 データ型 (推奨)] を選択します。
[ストレージの暗号化]
このチュートリアルでは、[暗号化なし] を選択します。
MaxCompute プロジェクトの作成に関する詳細については、「MaxCompute プロジェクトの作成」をご参照ください。
DataWorks 環境の準備
開始する前に、DataWorks サービスを有効化してください。詳細については、「購入ガイド」をご参照ください。
1. ワークスペースの作成
DataWorks コンソールにログインし、上部でリージョンを [中国 (上海)] に切り替え、左側メニューで ワークスペース をクリックしてワークスペース一覧ページに移動します。
+ ワークスペースの作成 をクリックして、標準モードのワークスペース ([本番環境と開発環境の隔離]) を作成します。データ開発 (DataStudio) (新版) パブリックプレビューへの参加 は選択しないでください。
2025 年 2 月 18 日以降、Alibaba Cloud アカウントが中国 (上海) リージョンで初めて DataWorks を有効化し、ワークスペースを作成する場合、新しい Data Studio がデフォルトで有効になり、データ開発 (DataStudio) (新版) パブリックプレビューへの参加 パラメーターは表示されなくなります。新しい Data Studio がデフォルトで有効になっている場合は、「新しい Data Studio の使用開始」で対応するチュートリアルをご参照ください。
ワークスペースの作成に関する詳細については、「ワークスペースの作成」をご参照ください。
ステップ 2:サーバーレスリソースグループの作成
サーバーレスリソースグループを購入します。
このチュートリアルでは、データ同期とスケジューリングのために DataWorks サーバーレスリソースグループが必要です。 サーバーレスリソースグループを購入して準備する必要があります。
DataWorks リソースグループリスト ページにログインします。 上部のナビゲーションバーで、リージョンを 中国 (上海) に切り替えます。 左側のナビゲーションペインで、リソースグループ をクリックして リソースグループの一覧 ページに移動します。
リソースグループの新規作成 をクリックします。 購入ページで、[リージョンとゾーン] を 中国 (上海) に設定し、リソースグループ名 を指定します。 プロンプトに従ってその他のパラメーターを設定し、支払いを完了します。 サーバーレスリソースグループの課金の詳細については、「サーバーレスリソースグループの課金」をご参照ください。
説明現在のリージョンで利用可能な VPC または vSwitch がない場合は、パラメーターの説明にある対応するコンソールリンクをクリックして作成してください。 VPC と vSwitch の詳細については、「VPC とは」をご参照ください。
リソースグループを DataWorks ワークスペースにバインドします。
新しいサーバーレスリソースグループを使用する前に、ワークスペースにバインドする必要があります。
DataWorks リソースグループリストページにログインし、リージョンを 中国 (上海) に切り替えます。購入したサーバーレスリソースグループを見つけます。操作 列で、所属ワークスペースの変更 をクリックします。次に、作成した DataWorks ワークスペースを見つけ、アタッチ をクリックします。
リソースグループのパブリックネットワークアクセスを設定します。
このチュートリアルでは、パブリックインターネットからアクセスする必要があるテストデータを使用します。 デフォルトでは、リソースグループは パブリックインターネットにアクセスできません。 アクセスを有効にするには、インターネット NAT ゲートウェイを設定し、リソースグループにバインドされている VPC に EIP を追加する必要があります。
VPC - インターネット NAT ゲートウェイコンソールにログインします。トップナビゲーションバーで、リージョンを 中国 (上海) に切り替えます。
NAT Gateway の作成 をクリックして、パラメーターを設定します。このチュートリアルの主要なパラメーターを、次の表で説明します。その他のパラメーターにはデフォルト値を使用します。
パラメーター
値
[リージョン]
China (Shanghai)。
[ネットワーク & ゾーン]
リソースグループにバインドされている VPC と vSwitch を選択します。
DataWorks コンソールに移動し、リージョンを 中国 (上海) に切り替え、左側のナビゲーションウィンドウで リソースグループ をクリックして リソースグループの一覧 ページに移動します。 作成したリソースグループを見つけ、操作 列の ネットワーク設定 をクリックします。 [データスケジューリング & データ統合] セクションで、バインドされた VPC のアタッチ と vSwitch を表示できます。 VPC と vSwitch の詳細については、「VPC とは」をご参照ください。
[ネットワークタイプ]
インターネット NAT ゲートウェイ。
[EIP]
EIP を作成します。
[サービスリンクロールの作成]
初めてインターネット NAT ゲートウェイを作成する場合、サービスにリンクされたロールを作成する必要があります。サービスにリンクされたロールの作成 をクリックします。
今すぐ購入 をクリックし、サービス利用規約に同意した後、今すぐ利用を開始 をクリックして購入を完了します。
インターネット NAT ゲートウェイを購入した後、コンソールに戻り、新しいゲートウェイインスタンスの SNAT エントリを作成します。
説明VPC 内のリソースグループは、SNAT エントリを設定した後にのみパブリックインターネットにアクセスできます。
新しいインスタンスの行で、操作列の管理をクリックします。インスタンス詳細ページで、[SNAT 管理] タブをクリックします。
SNAT エントリで使用 タブで、SNAT エントリの作成 をクリックします。次の主要なパラメーターを設定します。
パラメーター
値
SNAT エントリの粒度
[VPC を指定] を選択します。 これにより、VPC 内のすべてのリソースグループが、設定された EIP を介してパブリックインターネットにアクセスできるようになります。
EIP の選択
現在のインターネット NAT ゲートウェイインスタンスにバインドされている EIP を選択します。
SNAT エントリのパラメーターを設定した後、OK をクリックして SNAT エントリを作成します。
SNAT エントリで使用 タブで、新しい SNAT エントリの ステータス が 利用可能 になるまで待ちます。 ステータスが利用可能になると、リソースグループにバインドされている VPC はパブリックインターネットにアクセスできるようになります。
サーバーレスリソースグループの追加と使用方法に関する詳細については、「サーバーレスリソースグループの使用」をご参照ください。
3. MaxCompute プロジェクトの関連付け
作成した MaxCompute プロジェクトをコンピューティングリソースとして DataWorks ワークスペースに関連付け、Data Studio から MaxCompute のデータを処理できるようにします。
DataWorks ワークスペース一覧ページに移動します。上部でリージョンを [中国 (上海)] に切り替え、作成したワークスペースを見つけてワークスペース名をクリックし、ワークスペースの詳細 ページに移動します。
左側メニューで 計算リソース をクリックすると、 ページに自動的にジャンプします。
計算リソースの作成 をクリックし、関連付ける 計算リソースタイプ を選択してから、パラメーターを設定します。
このチュートリアルでは、コンピューティングリソースとストレージリソースとして MaxCompute を使用するため、コンピューティングリソースタイプとして MaxCompute を選択し、関連パラメーターを設定します。以下は、この例の主要なパラメーターです。その他のパラメーターはデフォルト値のままにしてください。
パラメーター
説明
[データソース名]
コンピューティングリソースのカスタム名。タスクはこの名前を参照してリソースを選択します。
[所属 Alibaba Cloud アカウント]
現在の Alibaba Cloud アカウント に設定します。
[リージョン]
現在の DataWorks ワークスペースと同じリージョンである [中国 (上海)] を選択します。
[MaxCompute プロジェクト名]
関連付ける MaxCompute プロジェクトを選択します。このチュートリアルでは、「2. MaxCompute プロジェクトの作成」セクションで作成した、本番環境と開発環境に対応する MaxCompute プロジェクトをそれぞれ関連付けます。
[デフォルトアクセス主体]
現在のワークスペースから MaxCompute プロジェクトにアクセスするために使用されるアイデンティティ。
開発環境: 現在、[実行者] アイデンティティを使用したアクセスのみがサポートされています。
本番環境: 現在ログインしているアカウントに基づいてドロップダウンリストから選択します。このチュートリアルでは [Alibaba Cloud アカウント] を選択します。
説明別のアイデンティティでログインしている場合は、「新しい Data Studio:コンピューティングリソースの関連付け」で特定の設定をご参照ください。
[接続設定]
MaxCompute コンピューティングリソースへの接続に使用されるリソースグループ。現在のワークスペースに関連付けられているサーバーレスリソースグループのみが表示されます。開発環境と本番環境の両方で接続性をテストしてください。
データソースを作成し、データ開発にアタッチします をクリックします。
プロンプトに従って、Data Studio のコンピューティングリソースページを更新し、関連付けられた MaxCompute コンピューティングリソースを確認してください。
説明作成した MaxCompute コンピューティングリソースが [未アタッチ] の状態である場合は、アタッチ ボタンをクリックして関連付けます。
次のステップ
これで環境の準備は完了です。次に、基本的なユーザー情報とウェブサイトのアクセスログデータを MaxCompute に同期します。詳細については、「データの同期」をご参照ください。