すべてのプロダクト
Search
ドキュメントセンター

DataWorks:ChatBI データセットの管理

最終更新日:Aug 07, 2026

ChatBI でインタラクティブセッションを開始する前に、データセットを使用して分析対象のデータ範囲を定義する必要があります。データセットには、データソースのテーブル、またはローカルファイルを指定できます。

前提条件

ChatBI を使用するリージョンに サーバーレスリソースグループ が作成されている必要があります。

使用上の注意

  • データソースを基にするデータセットでは、Hologres、MaxCompute、StarRocks、MySQL のデータソースのみがサポートされます。

  • ローカルファイルを基にするデータセットでは、xls、xlsx、csv 形式のみがサポートされます。最大 10 個のファイルをアップロードでき、各ファイルのサイズは 1 GB を超えることはできません。

  • ワークスペースメンバーは、ロールに関係なく、DataWorks データソースからデータセットを作成および使用できます。以前は、この機能はワークスペース管理者のみが利用できました。

データセットの作成

  1. ChatBI ページに移動します。

    Alibaba Cloud にログインし、ChatBI Intelligent Data Insights ページを開きます。ご利用の DataWorks リソース(データセットやサーバーレスリソースグループなど)が配置されているリージョンに対応するアクセスポイントを選択してください。

    中国 (杭州) ChatBI アクセスポイント

    中国 (上海) ChatBI アクセスポイント

    中国 (深セン) ChatBI アクセスポイント

    中国 (香港) ChatBI アクセスポイント

    中国 (成都) ChatBI アクセスポイント

    中国 (北京) ChatBI アクセスポイント

    中国 (張家口) ChatBI アクセスポイント

    インドネシア (ジャカルタ) ChatBI アクセスポイント

  2. 左側のナビゲーションペインで、データセット をクリックします。データセットページで、データセットの作成 をクリックします。

  3. データセットの作成 ページで、次のパラメーターを設定します。

    • データセットタイプが データソース の場合:

      パラメーター

      説明

      [基本情報]

      [名前]

      データセットのカスタム名を入力します。

      [タイプ]

      データセットのタイプ。有効な値:

      • データソース

      • ローカルファイル

      データソース を選択します。

      [データソースタイプ]

      データソースのタイプ。有効な値:

      • Hologres

      • MaxCompute

      • StarRocks

      • MySQL

      データソース情報

      設定パラメーターはデータソースタイプによって異なります。

      例えば、Hologres の場合、リージョン、Hologres インスタンス、およびデータベース名を設定する必要があります。

      [リソースグループ]

      後続のセッションでデータソースへのアクセスやデータクエリの実行に使用される、DataWorks のサーバーレスリソースグループを選択します。

      [接続性のテスト]

      選択した DataWorks サーバーレスリソースグループとデータソース間のネットワーク接続をテストします。

      [セマンティック分析]

      (データソースタイプが MaxCompute の場合にのみ表示) データセットのセマンティック分析を有効にするかどうかを指定します。[セマンティック分析を有効にする] を選択後、データセットを作成または編集して保存すると、プラットフォームがデータセット内のデータテーブルを解析するためのセマンティックタスクを自動的に作成または更新します。これにより、ChatBI セッションでのセマンティックナレッジの呼び出しが有効になり、Q&A の回答の精度が向上します。この機能を有効にすると、データセット詳細ページに [セマンティック分析] タブが表示されます。このオプションは、データセットの作成時にデフォルトで選択されています。

      [Select Destination Table]

      宛先テーブルの選択

      基本情報 の設定が完了したら、次へ をクリックして Select Destination Table ステップに進みます。

      未選択 リストで、宛先テーブルを選択し、image をクリックして 選択済み リストに追加します。 選択したテーブルは現在のデータセットに追加されます。

    • データセットタイプが ローカルファイル の場合:

      パラメーター

      説明

      [基本情報]

      [名前]

      データセットのカスタム名を入力します。

      [タイプ]

      データセットのタイプ。有効な値:

      • [Data Source]

      • [Local File]

      ローカルファイル を選択します。

      ローカルファイルのアップロード

      xls、xlsx、csv 形式のみがサポートされます。最大 10 個のファイルをアップロードでき、各ファイルのサイズは 1 GB を超えることはできません。

  4. データセットの設定が完了したら、次へ をクリックして EBS レンズ ステップに進みます。システムはデータセットを自動的にスキャンしてデータ値の特性を抽出します。これにより、セッション中の分析の精度が向上します。

  5. データ洞察には時間がかかる場合があります。直接 完了 をクリックして、後でデータセットで結果を表示できます。

データセットの表示

  1. 左側のナビゲーションペインで、データセット をクリックしてデータセットページに移動します。

  2. 対象のデータセットカードを見つけてクリックし、データセット詳細ページに移動します。

    [セマンティック分析] が有効になっている MaxCompute データセットの場合、データセットカードにはセマンティック解析ステータスとして、「セマンティック解析待ち」、「セマンティック解析中」、「セマンティック解析完了」、または「セマンティック解析失敗」が表示されます。

  3. データセット詳細ページの上部にはデータセットの基本情報 (タイプ、テーブル/ファイル数、作成者など) が表示され、左側にはテーブル/ファイルのリスト、右側には各テーブル/ファイルの基本情報とデータプレビュー (最大 20 レコードまでプレビュー可能) が表示されます。

セマンティック分析結果の表示

[セマンティック分析] が有効化されている MaxCompute データセットでは、データセット詳細ページに移動した後、[セマンティック分析] タブをクリックして、セマンティックタスクのステータスと解析結果を表示できます。

説明

[セマンティック分析] タブは、データセットが MaxCompute データソースを使用し、かつデータセットの作成または編集時に [セマンティック分析を有効にする] が選択された場合にのみ表示されます。

[セマンティック分析] タブのレイアウトは次のとおりです。

  • ステータスバー (上部): 現在のセマンティック解析ステータスと同期ステータスを表示します。セマンティック解析ステータスには、[セマンティック解析中]、[セマンティック解析完了]、[セマンティック解析失敗] が含まれます。

  • [結果ファイル] (左ペイン) :セマンティック解析によって生成された結果ファイル (インデックスファイル (_index.json) やセマンティックモデルの YAML ファイルなど) を一覧表示します。ファイル名をクリックすると、右ペインにその内容が表示されます。

  • コンテンツビューワー (右ペイン) :選択したファイルの詳細な内容を表示します。セマンティックモデルの YAML ファイルの場合、コンテンツビューワーには 2 つのビューがあります。

    • [セマンティックグラフ]:セマンティックモデル内のデータテーブルとメトリック間の関係を視覚的なグラフとして表示し、テーブル数やメトリック数などの統計情報も示します。

    • [YAML ソース]:セマンティックモデルの YAML ファイルの生のコンテンツを行番号付きで表示し、モデル内のフィールド定義、メトリックの式、ビジネス記述を確認できます。

[セマンティック分析] タブでは、以下の操作を実行できます:

ボタン

説明

[Rerun]

セマンティック解析タスクを再度トリガーします。データセット内のテーブル構造が変更され、セマンティックモデルを更新する必要がある場合に使用します。

[Refresh]

セマンティック解析ステータスと結果ファイルリストを更新します。

[Download]

選択したセマンティックモデルの YAML ファイルをローカルマシンにダウンロードします。このボタンは、セマンティック解析が完了した後にのみ使用できます。

セマンティック分析 (セマンティックモデルの YAML 構造やセマンティックグラフの使用方法を含む) の詳細については、「Data Agent のセマンティック分析」をご参照ください。

データセットの編集

  1. 左側のナビゲーションペインで、データセット をクリックして、[データセット] ページに移動します。

  2. 対象のデータセットカードを見つけます。次のいずれかの方法で、データセット編集ページに移動できます。

    • 対象のデータセットカードにカーソルを合わせ、カードの右上隅にある image > 編集 をクリックします。

    • 宛先データセットカードをクリックしてデータセット詳細ページに移動し、右上隅にある編集ボタンをクリックします。

  3. データセットの設定を変更します。パラメーターの説明は、「データセットの作成」と同じです。

    説明

    既存のデータセット設定を編集する場合、タイプとデータソースタイプは変更できません。

  4. データセットの編集が完了したら、[Next] をクリックして [Data Insight] ステップに進みます。データセット内のデータに対して、データインサイトが再度実行されます。

データセットの削除

  1. 左側のナビゲーションペインで、データセット をクリックし、データセット ページに移動します。

  2. 対象のデータセットカードにカーソルを合わせ、カードの右上隅にある image > 削除 をクリックします。データセットを削除すると、関連するセッションやグラフでデータが正しく表示されなくなります。

次のステップ:データセットに基づくセッションの開始

  1. 次のいずれかの方法で、特定のデータセットに基づいてセッションを開始できます。

    • 左側のナビゲーションペインで、データセット をクリックして、「データセット」ページに移動します。目的のデータセットカードにカーソルを合わせ、カードの右上隅にある image をクリックしてセッションを開始します。

    • 左側のナビゲーションペインで、[新規セッション] をクリックして ChatBI セッションウィンドウを開きます。次に、セッションウィンドウで Select Dataset をクリックします。

  2. Chat ページで、要件や質問を入力してデータ分析を開始します。 詳細については、「ChatBI セッション」をご参照ください。

    説明

    セッションで [セマンティック分析] が有効なデータセットを使用する場合、ChatBI は Q&A 中に自動で意味知識を活用し、分析精度を向上させます。データセットが解析中であっても、先に質問を開始できます。複雑な質問の場合、より正確な回答を得るには、解析が完了してから再度質問することをお勧めします。