すべてのプロダクト
Search
ドキュメントセンター

E-MapReduce:インスタンスタイプの計画と推奨事項

最終更新日:Aug 21, 2026

本ドキュメントでは、StarRocks インスタンスタイプの計画と推奨事項について説明します。コンピューティング・ストレージ統合版とコンピューティング・ストレージ分離版のインスタンスタイプについて解説します。

コンピューティング・ストレージ統合版

コンピューティング・ストレージ統合版では、インスタンスにはフロントエンド (FE) ノードとバックエンド (BE) ノードのみが含まれます。本セクションでは、両方のノードタイプのスペックに関する推奨事項を示します。

BE ノードの CU 数の見積もり

コンピューティング・ストレージ統合版では、バックエンド (BE) ノードはデータストレージとコンピューティングタスクを担当します。

  • 見積もり式

    合計 CU 数 = スキャン対象の総行数 / CPU 処理能力 / 期待応答時間 * QPS (秒間クエリ数)

    パラメータの説明は次のとおりです。

    • スキャン対象の総行数:各 SQL クエリでスキャンされると予想される行数です。これは単一テーブルの総行数ではなく、スキャンする必要がある行数のみを指します。

    • CPU 処理能力:この値は SQL クエリの複雑さに基づいて動的に変化します。通常、1 秒あたり 1,000 万行から 1 億行の範囲です。SQL クエリが複雑になるほど、処理される行数は少なくなります。

    • 期待応答時間:SQL クエリに期待される実行時間です。たとえば、クエリが 1 秒以内に結果を返す必要がある場合などです。

    • 秒間クエリ数 (QPS):1 秒あたりに送信される同時実行 SQL クエリの数です。たとえば、1 秒あたり 30 クエリなどです。

  • サンプルデータ

    重要

    この式は見積もりであり、SQL の複雑さによってパフォーマンスが変化するため、完全に正確であるとは限りません。本番環境では、特定のビジネスにおける負荷テスト結果に基づいて、最終的に必要なリソースを評価する必要があります。

    スキャン対象の総行数

    SQL の複雑さ

    推定 CPU 処理能力 (行/秒)

    期待応答時間 (秒)

    秒間クエリ数 (QPS)

    推定合計 CU 数

    推定 BE スペック

    5,000 万行

    2,000 万行

    2

    50

    63

    16 CU × 4 ノード

    5,000 万行

    5,000 万行

    1.5

    100

    67

    16 CU × 5 ノード

    5,000 万行

    1 億行

    1

    200

    100

    32 CU × 3 ノード

    10 億行

    2,000 万行

    5

    20

    200

    32 CU × 7 ノード

    10 億行

    5,000 万行

    3

    50

    333

    64 CU × 6 ノード

    10 億行

    1 億行

    1

    80

    800

    64 CU × 13 ノード

    300 億行

    2,000 万行

    30

    10

    500

    64 CU × 8 ノード

    300 億行

    5,000 万行

    15

    20

    800

    64 CU × 13 ノード

    300 億行

    1 億行

    15

    20

    400

    64 CU × 6 ノード

    3,000 億行

    2,000 万行

    60

    5

    2,083

    64 CU × 33 ノード

    3,000 億行

    5,000 万行

    45

    10

    2,222

    64 CU × 35 ノード

    3,000 億行

    1 億行

    45

    10

    1,111

    64 CU × 18 ノード

BE ノードのストレージの見積もり

StarRocks インスタンスに必要な総ストレージ容量は、生データサイズ、レプリカ数、および使用する圧縮アルゴリズムの圧縮率によって決まります。

  • 見積もり式

    必要な総ストレージ容量 = 生データサイズ * レプリカ数 / 圧縮率

    パラメータの説明は次のとおりです。

    • 生データサイズ:1 行のサイズ × 総行数。

    • レプリカ数:コンピューティング・ストレージ統合アーキテクチャでは、通常 3 に設定されます。

    • 圧縮率:StarRocks は、zlib、Zstandard (または zstd)、LZ4、Snappy の 4 つの圧縮アルゴリズムをサポートしています (圧縮率の降順)。これらのアルゴリズムの圧縮率は 3:1 から 5:1 です。

  • サンプルデータ

    1 行のサイズ (KB)

    行数

    レプリカ数

    圧縮率

    推定データサイズ (GB)

    50

    100,000,000

    3

    3

    4,768.37

    説明

    表の値はあくまで推奨値です。本番環境では、特定のビジネスにおける負荷テスト結果に基づいて、最終的に必要なリソースを評価する必要があります。

BE ノードのディスク計画

見積もり式は次のとおりです。

BE ノードあたりの総ディスクサイズ = 総ストレージ容量 / ディスク使用率 / BE ノード数

パラメータの説明は次のとおりです。

  • 総ストレージ容量:BE ノードに対して計算された総ストレージ容量。

  • ディスク使用率:残りの 20% の容量をコンピューティング用に確保するため、使用率 80% を推奨します。

  • BE ノード数:CU 見積もりから決定された BE ノードの数です。

たとえば、総ストレージ容量が 4,768 GB、ディスク使用率が 80%、BE ノード数が 11 の場合、計算は 4,768 GB / 80% / 11 = 541 GB となります。したがって、単一 BE ノードの総ディスクサイズは 541 GB です。

ディスク数の選択

選択するディスク数は、ESSD のパフォーマンスと単一ノードの総ディスク容量によって異なります。単一ディスクのパフォーマンスを最適化するために、次の表に示すように ESSD PL1 ディスクを分割できます。

BE ノードあたりの総ディスクサイズ

ディスクタイプ

推奨ディスク数

<= 500 GB

ESSD PL1

1

500 GB ~ 1 TB

ESSD PL1

1 ~ 2

1 TB ~ 1.5 TB

ESSD PL1

2 ~ 3

1.5 TB ~ 2 TB

ESSD PL1

3 ~ 4

2 TB ~ 2.5 TB

ESSD PL1

4 ~ 5

2.5 TB ~ 3 TB

ESSD PL1

5 ~ 6

3 TB ~ 3.5 TB

ESSD PL1

6 ~ 7

3.5 TB ~ 4 TB

ESSD PL1

7 ~ 8

> 4 TB

ESSD PL1

8 ブロック

他の ESSD クラウドディスクのパフォーマンス上限は次のとおりです。

  • ESSD PL0: 320 GB で最大ディスク IOPS に到達します。

  • ESSD PL1: 460 GB で最大ディスク IOPS に到達します。

  • ESSD PL2: 1,260 GB で最大ディスク IOPS に到達します。

  • ESSD PL3: 7,760 GB で最大ディスク IOPS に到達します。

パフォーマンスを最適化するには、ESSD PL1 のディスク分割の推奨事項を参照し、他の ESSD タイプのディスク数を適宜調整してください。

FE ノードのスペックの見積もり

フロントエンド (FE) ノードは、主にメタデータ管理、クライアント接続管理、クエリ計画、クエリスケジューリングを担当します。

BE ノードの合計 CU 数に基づいて、FE スペックをおおまかに見積もることができます。次の表に具体的な推奨事項を示します。FE ノードのデータディスクは、通常 100 GB あれば十分です。ストレージ容量が不足した場合は、個別にスケールアウトできます。

BE の合計 CU 数

シナリオタイプ

推奨 FE スペック

< 120 CU

通常シナリオ

8 CU × 3

120 CU ~ 1,000 CU

通常シナリオ

16 CU × 3

1,000 CU ~ 3,000 CU

通常シナリオ

32 CU × 3

>= 3,000 CU

通常シナリオ

64 CU × 3

説明
  • 表の値はあくまで推奨値です。本番環境では、特定のビジネスにおける負荷テスト結果に基づいて、最終的に必要なリソースを評価する必要があります。

  • 高同時実行のポイントクエリシナリオでは、FE ノードの数を増やすことを検討してください。たとえば、ノード数を 5 に増やすことができます。

コンピューティング・ストレージ分離版

コンピューティング・ストレージ分離版では、インスタンスには FE ノードとコンピュートノード (CN) のみが含まれます。

CN の CU 数の見積もり

詳細については、「BE ノードの CU 数の見積もり」をご参照ください。

CN のストレージの見積もり

CN のストレージは、主にキャッシュデータに使用されます。

  • 見積もり式

    必要な総ストレージ容量 = 生データサイズ / 圧縮率 * ホットデータ割合

    パラメータは次のとおりです。

    • 生データサイズ:1 行のサイズ × 総行数。

    • 圧縮率:StarRocks は、zlib、Zstandard (または zstd)、LZ4、Snappy の 4 つの圧縮アルゴリズムをサポートしています (圧縮率の降順)。これらのアルゴリズムの圧縮率は 3:1 から 5:1 です。

    • ホットデータ割合:ビジネスニーズに基づいて、頻繁にクエリされるデータ (ホットデータ) の割合を見積もります。たとえば、この値を 50% に設定できます。具体的な割合が不明で、コンピューティング・ストレージ分離インスタンスの十分なクエリパフォーマンスを確保したい場合は、この値を 100% に設定します。これは 1 つのレプリカのサイズに相当します。プライマリキーインデックスもキャッシュディスク容量を使用するため、20% のバッファを推奨します。したがって、推奨設定は 120% です。

  • サンプルデータ

    1 行のサイズ (KB)

    行数

    圧縮率

    ホットデータ割合

    推定データサイズ (GB)

    50

    100,000,000

    3

    120%

    1,907.35

    説明

    表の値はあくまで推奨値です。本番環境では、特定のビジネスにおける負荷テスト結果に基づいて、最終的に必要なリソースを評価する必要があります。

単一 CN のディスクサイズと数量については、「BE ノードのディスク計画」をご参照ください。

FE ノードのスペックの見積もり

詳細については、「FE ノードのスペックの見積もり」をご参照ください。