すべてのプロダクト
Search
ドキュメントセンター

Hologres:数クリックでパブリックデータセットをインポート

最終更新日:Jun 19, 2026

HoloWeb を使用すると、数クリックでパブリックデータセットをインポートし、迅速なデータインポートとクエリを実行できます。HoloWeb コンソールから直接インポートタスクを作成し、タスクステータスを確認できます。

背景情報

HoloWeb では、tpch_10gtpch_100gtpch_1t、および github_event のパブリックデータセットをワンクリックでインポートできます。

  • tpch_10gtpch_100g、および tpch_1t は、小売シナリオ向けのサンプルデータセットです。tpch_10g パブリックデータセットには 10 GB のデータ、tpch_100g パブリックデータセットには 100 GB のデータ、tpch_1t パブリックデータセットには 1 TB のデータが含まれています。詳細については、「Test plan」をご参照ください。

  • github_event パブリックデータセットは GitHub で入手できます。詳細については、「Introduction to business and data」をご参照ください。

前提条件

  • Hologres インスタンスのバージョンが V1.3.13 以降であること。

  • Hologres インスタンスが HoloWeb に接続されていること。詳細については、「Log on to an instance」をご参照ください。

注意事項

  • パブリックデータセットのインポート機能は、China (Beijing)、China (Shanghai)、China (Hangzhou)、China (Shenzhen)、China (Zhangjiakou) の各リージョンにデプロイされた Hologres インスタンスで利用できます。

  • パブリックデータセットをインポートするには、スキーマの作成、テーブルの作成、およびデータの書き込みに関する権限が必要です。詳細については、「Hologres permission models」をご参照ください。

  • パブリックデータセットのインポートには、インスタンス仕様に応じて 3 分から 20 分かかります。オンラインビジネスに影響を与えないよう、事前にコンピューティングリソースを計画してください。

  • インポートタスクは、2 つのスキーマと複数の外部テーブルおよび内部テーブルを自動的に作成します。誤ってデータが削除されることを防ぐため、インスタンス内の既存のスキーマやテーブルと自動作成されるものの名前が重複しないようにしてください。

パブリックデータセットインポートタスクの作成

  1. HoloWeb 開発者ページに移動します。詳細については、「HoloWeb への接続」をご参照ください。

  2. HoloWeb 開発ページのトップメニューバーで、Data Solutions をクリックします。

  3. Data Solutions ページで、左側のナビゲーションペインの Import Public Dataset をクリックします。

  4. Import Public Dataset ページで、Create Task for Importing Public Dataset をクリックします。

  5. Create Task for Importing Public Dataset ページで、Instance NameデータベースPublic Dataset Name を選択します。次に、[サーバーレスコンピューティングリソースを使用してデータをインポート] するかどうかを指定して、Submit をクリックします。

    この機能は、Hologres V1.3.13 以降でのみ利用できます。パブリックデータセットは、インスタンスのストレージ容量を消費します。インポートタスクは、hologres_dataset_tpch_100ghologres_foreign_dataset_tpch_100g などの 2 つのスキーマと、複数の外部テーブルおよび内部テーブルを自動的に作成します。tpch_100g データセットの場合、少なくとも 32 CU のインスタンスを推奨します。

パブリックデータセットインポートタスク情報の表示

  1. Import Public Dataset ページで、Instance Nameデータベース を選択し、Search をクリックしてパブリックデータセットのインポートタスクのリストを表示します。

    タスクリストには、次の情報とアクションが表示されます。

    • 情報: No.Instance NameデータベースPublic Dataset NameStatusProgress (完了した SQL ステートメント数 / SQL ステートメントの総数)、Created At、およびEnd Time

    • アクション: 詳細停止RerunDeleteExecution HistoryQuery

  2. タスクのStatusSuccessfulになるとインポートが完了し、Actions列のQueryをクリックしてさらにデータ分析を実行できます。

パブリックデータセットの削除

次の SQL ステートメントを実行して、パブリックデータセットを含むスキーマとそのすべての依存関係を削除します。この例では、tpch_100g データセットを削除します。この操作は慎重に実行してください。

DROP SCHEMA hologres_dataset_tpch_100g, hologres_foreign_dataset_tpch_100g CASCADE;