本トピックでは、Lindorm と他のオープンソースデータベースを比較します。
背景
Lindorm は、Apache HBase、S3、TSDB、HDFS、Apache Solr などの複数の標準 API と互換性があります。ワイドテーブル、時系列、オブジェクト、テキスト、キュー、空間モデルなど、さまざまなデータモデルをサポートしています。Lindorm は、ログ、請求書、タグなどの多様なデータ型を高性能かつ低コストで保存および分析するのに最適です。
このトピックでは、Lindorm を Apache HBase、OpenTSDB、Elasticsearch、Apache Solr、HDFS などのオープンソースの代替製品と比較します。この比較では、コア機能、パフォーマンス、コストを取り上げ、Lindorm のメリットを理解するのに役立ちます。
機能比較
Lindorm と Apache HBase の比較
LindormTable は、大量の構造化データと半構造化データ用の分散ストレージエンジンです。Apache HBase や Phoenix (SQL) など、オープンソース標準 API と互換性があります。次の表では、LindormTable と Apache HBase を比較します。
|
機能 |
Lindorm |
Apache HBase |
|
|
コア機能 |
データモデル |
ワイドテーブル、時系列、検索、ファイルなど、複数のデータモデルをサポートします。ワイドテーブルモデルは、複数のエンドポイントと API をサポートします。 |
ワイドテーブルのみ |
|
API アクセス |
HBase API と Phoenix SQL をサポートします。データは、異なるエンドポイント間で相互運用できます。 |
HBase API または Phoenix SQL |
|
|
SQL |
JDBC に準拠し、Phoenix と互換性があります。優れた安定性とパフォーマンスを提供します。 |
外部 Phoenix のサポートが必要です。 |
|
|
データ型 |
豊富なデータ型をサポートします。詳細については、「Data types」をご参照ください。 |
|
|
|
TTL |
テーブル、行、セルレベルでエンタープライズグレードの TTL を提供します。 |
テーブルレベルとセルレベルの TTL をサポートします。 |
|
|
強い整合性 |
強い整合性や結果整合性など、複数の整合性レベルをサポートします。 |
サポートされています |
|
|
グローバルセカンダリインデックス |
組み込みのグローバルセカンダリインデックスを提供します。この機能により、透過的なクエリが可能になり、高性能を実現します。また、インデックス化されていない列をオンデマンドで冗長化することも可能です。 |
外部コンポーネントの複雑な設定が必要です。 |
|
|
多次元検索 |
LindormSearch とシームレスに統合し、大規模データストレージ、多次元クエリ、全文検索への統一されたアクセスを提供します。詳細については、「Search index overview」をご参照ください。 |
サポートされていません |
|
|
パフォーマンス |
スループット |
単一の Apache HBase ノードと比べて、最大 7 倍のスループットを実現します。詳細については、「Test result analysis」をご参照ください。 |
該当しません |
|
リクエストレイテンシースパイク |
Apache HBase と比べて、P99 レイテンシーを 10 分の 1 に低減します。詳細については、「Test result analysis」をご参照ください。 |
レイテンシースパイクが頻発します |
|
|
コスト |
ストレージコスト |
Performance、Standard、Capacity など、複数のストレージタイプを提供します。クラウドディスク上のセルフマネージドインスタンスと比べて、コストを最大 80% 削減します。 |
高コストで弾力性に欠ける、セルフマネージドのクラウドディスクまたはローカルディスクに基づきます。 |
|
コンピューティングとストレージの分離 |
はい。ストレージリソースとコンピューティングリソースは個別にスケーリングできます。 |
いいえ |
|
|
データ圧縮 |
高度に最適化された組み込み圧縮アルゴリズムを使用し、10:1 を超える圧縮率を実現します。これは Snappy より 50% 以上高い値です。 |
Snappy、LZ4、LZO をサポートしますが、圧縮率は低いです。 |
|
|
エンコーディング |
データ型を考慮した適応型エンコーディングを採用し、高い圧縮率を実現します。これにより、デコードせずに高速に検索できます。 |
中程度の圧縮率で DIFF をサポートします。エンコード済みデータは検索できません。 |
|
|
ホット/コールドデータ分離 |
データを自動的に階層化します。コールドデータを低コストかつ高圧縮のストレージに移動してコストを 80% 削減し、ホットデータのアクセスパフォーマンスを 15% 向上させます。詳細については、「Hot and cold data separation」をご参照ください。 |
サポートされていません |
|
|
スケーラビリティと弾力性 |
最小スケール |
該当しません。 |
少なくとも 3 ノード |
|
スケーラビリティ |
高いスケーラビリティを備えています。数千ノードまでの水平スケーリングをサポートします。 |
高いスケーラビリティを備えています。数千ノードまでの水平スケーリングをサポートします。 |
|
|
信頼性 |
アクティブ/アクティブ冗長性 |
自動ディザスタリカバリフェイルオーバーや、デュアルクラスター間での同時リクエストなどの高度な機能を提供します。セルフマネージドの Apache HBase クラスターと組み合わせて、ハイブリッドなプライマリ/スタンバイアーキテクチャを構築できます。 |
製品化された機能ではありません。フェイルオーバーはサポートされていません。 |
|
AZ 間強い整合性 |
アベイラビリティーゾーン (AZ) をまたいだデプロイをサポートし、AZ レベルの障害が発生した場合でも、自動復旧と強いデータ整合性を確保します。 |
サポートされていません |
|
|
バックアップと復元 |
100 TB を超えるデータセットを OSS にバックアップできます。オンデマンドバックアップ、ポイントインタイムリカバリ (PITR)、およびデータサイズに依存しない 30 分未満の目標復旧時間 (RTO) などの高度な機能を提供します。詳細については、「Enable backup and restoration」をご参照ください。 |
サポートされていますが、機能は限定的です。 |
|
|
アクティブ地理的冗長性 |
サポートされています。オンデマンドのデータ同期により、複数の地理的リージョンやユニットにまたがるデプロイが可能です。 |
サポートされていません |
|
|
マルチテナンシーとセキュリティ |
認証と ACL |
ユーザー名とパスワードによる認証と ACL をサポートします。詳細については、「Manage users」をご参照ください。 |
Kerberos 認証と ACL をサポートしますが、追加の設定が必要です。 |
|
リソース分離 |
リソースグループを提供し、テナント間の物理リソース分離を可能にします。 |
サポートされていません |
|
|
クォータ |
リクエストとストレージを含む、テナント向けのグローバルクォータをサポートします。 |
マルチテナンシーをサポートしていません。 |
|
|
保管時の暗号化 |
サポートされています。キーは KMS で管理され、すべてのデータとログは暗号化されます。 |
サポートされていますが、機能は限定的です。 |
|
|
RPC ブラックリスト |
RPC ブラックリストをサポートし、特定の呼び出しを制限できます。 |
サポートされていません |
|
|
監査 |
現在サポートされていません。 |
サポートされていません |
|
|
高度な機能 |
テーブルのごみ箱 |
Lindorm は、削除されたテーブルをごみ箱に移動します。誤ってデータを失うことを防ぐため、ごみ箱からテーブルを復元できます。 |
サポートされていません |
|
カスケーディング分割 |
コンパクションの完了を待たずにリージョンを連続して分割できるため、スケーラビリティと負荷分散が大幅に向上します。 |
サポートされていません |
|
|
離散 TTL |
連続していない複数の期間のデータを保持できます。 |
サポートされていません |
|
|
運用と診断 |
運用ツール |
テーブル、名前空間、グループ、ACL を管理するための GUI ベースのクラスター管理ツールを提供します。詳細については、「Log on to the cluster management system」をご参照ください。 |
HBase Shell |
|
データクエリ |
GUI ベースのクラスター管理システムで対話型 SQL クエリをサポートします。詳細については、「Data Query」をご参照ください。また、HBase Shell や CQLsh などのオープンソースツールもサポートします。 |
HBase Shell |
|
|
エコシステム |
データ移行 |
さまざまなバージョンの Apache HBase からのオンライン、クロスバージョン、自動化された効率的な移行をサポートします。移行プロセスはアプリケーションに影響せず、コードの変更も不要です。詳細については、「Lindorm Tunnel Service」をご参照ください。 |
オフライン移行のみをサポートします。 |
|
MySQL データ同期 |
Lindorm Tunnel Service を使用して、MySQL データを Lindorm にフルインポートし、増分同期できます。 |
サードパーティツールが必要です。オンラインの増分同期はサポートされていません。 |
|
|
Spark 分析 |
製品レベルで Spark と緊密に統合されています。Lindorm のデータを Spark に増分同期し、Spark SQL で分析した結果を Lindorm に書き戻すことができます。 |
最適化されていません。データ統合には多大な開発工数が必要です。 |
|
|
MaxCompute |
製品レベルの統合により、Lindorm のデータを MaxCompute に増分アーカイブできます。 |
データ統合には多大な開発工数が必要です。 |
|
|
Log Service |
Lindorm Tunnel Service を使用して、Log Service から Lindorm へリアルタイムにデータをサブスクライブできます。 |
データ統合には多大な開発工数が必要です。 |
|
|
サービスとサポート |
可用性 SLA |
SLA で保証されています。単一 AZ インスタンスでは 99.95%、マルチ AZ インスタンスでは 99.975% の可用性を提供します。 |
提供されていません |
|
運用コスト |
複雑なデータベース運用が不要になるフルマネージドサービスです。 |
運用コストが高い |
|
|
技術チーム |
Apache Project Management Committee (PMC) のメンバーおよびコミッターで構成される専門チームが、技術サポートを提供します。 |
提供されていません |
|
|
実績 |
導入実績は数万インスタンスに及び、Alibaba の 11.11 グローバルショッピングフェスティバルを 9 年間支えてきました。 |
該当しません |
|
Lindorm と OpenTSDB の比較
LindormTSDB は、高性能でコスト効率に優れた信頼性の高い時系列データベースエンジンです。効率的な読み書き操作、高いデータ圧縮率、時系列データの集約を提供します。LindormTSDB は OpenTSDB プロトコルと高い互換性があり、独自のインデックス、データモデリング、ストリーム集約技術を使用して、強力な時系列機能を提供します。次の表は、LindormTSDB と OpenTSDB を比較したものです。
|
機能 |
LindormTSDB |
OpenTSDB |
|
|
運用と管理 |
サービス可用性 |
99.9% |
可用性を確保するために、クラスターと依存関係を構築および管理する必要があります。 |
|
データ信頼性 |
99.9999% |
信頼性を確保するために、クラスターと依存関係を構築および管理する必要があります。 |
|
|
ハードウェアとソフトウェアへの投資 |
ハードウェアやソフトウェアへの投資は不要です。従量課金制です。 |
データベースサーバーのコストが比較的高くなります。 |
|
|
メンテナンスコスト |
マネージドサービス |
専任のデータベース管理者 (DBA) が必要であり、人件費が高くなります。 |
|
|
デプロイとスケーリング |
即時アクティベーション、迅速なデプロイ、エラスティックスケーリングを提供します。 |
ハードウェアの調達、データセンターのホスティング、マシンのデプロイに時間がかかります。 |
|
|
依存関係 |
運用保守は不要です。 |
AsyncHBase と HBase に依存しており、運用コストが高くなります。 |
|
|
パラメータチューニング |
ベストプラクティスに基づいたデフォルトパラメータを使用します。 |
SALT、接続数、同期フラッシュ、コンパクションなどのパラメータを手動でチューニングする必要があります。 |
|
|
テーブル作成ステートメント |
テーブル作成はサービスによって管理され、ユーザーに対して透過的です。 |
運用保守担当者が静的なテーブル作成ステートメントを記述する必要があります。 |
|
|
モニタリングとアラート |
完全な自己監視パイプラインを提供します。 |
セットアップに外部ツールが必要です。 |
|
|
機能 |
データモデル |
多値データモデルと単一値データモデルの両方をサポートします。 |
単一値データモデルのみをサポートします。 |
|
SDK |
Java SDK |
オープンソース SDK はクエリをサポートしていません。 |
|
|
データ型の多様性 |
数値型、ブール型、文字列型など、複数のデータ型をサポートします。 |
数値型のみをサポートします。 |
|
|
SQL クエリ機能 |
分析クエリ用の SQL をサポートします。 |
サポートされていません |
|
|
中国語文字のサポート |
英語と中国語の文字をサポートします。 |
英語の文字のみをサポートします。 |
|
|
タグの要件 |
タグはオプションです。 |
タグは必須です。 |
|
|
タグキーの数 |
最大 16 |
最大 8 |
|
|
統合 |
Flink や IoT Platform とのシームレスな統合により、豊富なエコシステムを提供します。 |
オープンソース製品であるため、クラウドサービスとの統合機能は限定的です。 |
|
|
ストレージコスト |
データ圧縮 |
時系列データ専用の圧縮アルゴリズムを使用し、高い圧縮率を実現します。 |
汎用の圧縮アルゴリズムを使用するため、圧縮率は低くなります。 |
|
安定性 |
データの読み取り |
読み書きのスレッドプールを分離することで接続管理が容易になり、安定した読み書きパフォーマンスを実現します。 |
読み書き操作が結合されており、接続の枯渇や読み書きの失敗率の上昇につながる可能性があります。 |
|
アグリゲーター |
きめ細かいメモリ管理が可能なストリーム集約により、より高度な制御を実現します。 |
インメモリマテリアライズド集約を使用するため、メモリ不足 (OOM) エラーが発生しやすくなります。 |
|
LindormSearch と Elasticsearch および Solr の比較
LindormSearch は、大規模なデータセット向けに設計された分散型検索ストレージエンジンです。標準の Apache Solr API と互換性があります。次の表では、LindormSearch と Elasticsearch および Apache Solr を比較します。
|
機能 |
LindormSearch |
Elasticsearch |
Apache Solr |
|
|
コア機能 |
データモデル |
ワイドテーブル、時系列、検索、ファイルなど、複数のデータモデルをサポートします。検索エンジンは、他のエンジンのインデックスストアとしてシームレスに利用できます。 |
検索のみ |
検索のみ |
|
API アクセス |
Phoenix SQL と Solr API をサポートします。 |
ES API |
Solr API |
|
|
TTL |
テーブルや行など、複数の粒度でエンタープライズグレードの TTL を提供します。 |
テーブルレベルの TTL のみをサポートします。 |
テーブルレベルの TTL のみをサポートします。 |
|
|
統合ストレージと検索 |
LindormTable と LindormTSDB とシームレスに統合し、統合マルチモーダルストレージと検索を提供します。 |
該当なし |
該当なし |
|
|
パフォーマンスとコスト |
スループット |
単一の Apache Solr ノードと比べて、スループットは 130%~200% です。 |
該当なし |
該当なし |
|
ストレージコスト |
Performance、Standard、Capacity など、複数のストレージタイプを提供します。クラウドディスク上のセルフマネージドインスタンスと比べて、ストレージコストを最大 80% 削減します。 |
高コストで弾力性に欠け、セルフマネージドのクラウドディスクまたはローカルディスクに基づきます。 |
高コストで弾力性に欠け、セルフマネージドのクラウドディスクまたはローカルディスクに基づきます。 |
|
|
コンピューティングとストレージの分離 |
はい。ストレージリソースとコンピューティングリソースは個別にスケールします。 |
いいえ |
いいえ |
|
|
データ圧縮 |
高度に最適化された組み込み圧縮アルゴリズムを使用し、10:1 を超える圧縮率を実現します。これは Snappy より 50% を超える高い値です。 |
該当なし |
該当なし |
|
|
ホットデータとコールドデータの分離 |
時間属性に基づいてデータをテーブルに自動的に分離します。コールドデータには高圧縮かつ低コストのストレージを使用してコストを削減し、ホットデータのアクセスパフォーマンスを向上させます。 |
サポートされていません |
サポートされていません |
|
|
弾力性 |
ストレージの弾力性 |
高い。ストレージをコンピューティングから切り離し、ワンクリックのスケーリングをサポートします。ストレージのスケーリングは数秒で反映され、コンピューティングのスケーリングは数分で反映されます。 |
低い。スケールアウトにはデータ移行が必要で、数時間かかります。 |
低い。スケールアウトにはデータ移行が必要で、数時間かかります。 |
|
シングルライター・マルチリーダー |
データシャードは、シングルライター・マルチリーダーモデルをサポートします。リードレプリカはオンラインで水平スケーリングでき、変更は数秒で反映されます。 |
サポートされていますが、リードレプリカの追加にはデータ移行が必要で、数時間かかります。 |
サポートされていますが、リードレプリカの追加にはデータ移行が必要で、数時間かかります。 |
|
|
エコシステム |
データ移行 |
Apache Solr または Elasticsearch クラスターから Lindorm への、オンラインで自動化された、効率的なデータ移行をサポートします。アプリケーションへの影響やコード変更は不要です。詳細については、「Lindorm Tunnel Service」をご参照ください。 |
オフライン移行のみをサポートします。 |
オフライン移行のみをサポートします。 |
|
MySQL データ同期 |
Lindorm Tunnel Service を使用して、MySQL データを Lindorm に全量インポートし、増分同期できます。 |
サードパーティツールが必要です。オンラインの増分同期はサポートされていません。 |
サードパーティツールが必要です。オンラインの増分同期はサポートされていません。 |
|
|
Spark 分析 |
高度に製品化された統合を提供します。Spark SQL を使用して Lindorm のデータを分析し、Lindorm のデータを Spark に増分同期したうえで、オフライン分析結果を Lindorm に書き戻すことができます。 |
最適化されていません。データ統合には多大な開発工数が必要です。 |
最適化されていません。データ統合には多大な開発工数が必要です。 |
|
|
Log Service |
Lindorm Tunnel Service を使用して、Log Service から Lindorm へのリアルタイムデータサブスクリプションをサポートします。 |
データ統合には多大な開発工数が必要です。 |
データ統合には多大な開発工数が必要です。 |
|
|
サービスとサポート |
可用性 SLA |
SLA によって保証されています。単一 AZ インスタンスでは 99.95%、マルチ AZ インスタンスでは 99.975% の可用性を提供します。 |
提供されていません |
提供されていません |
|
運用コスト |
複雑なデータベース運用が不要になるフルマネージドサービスです。 |
該当なし |
該当なし |
|
|
技術チーム |
Apache PMC メンバーおよびコミッターで構成される専門チームが、技術サポートを提供します。 |
提供されていません |
提供されていません |
|
|
実績 |
導入実績は数万インスタンスに及び、Alibaba の 11.11 グローバルショッピングフェスティバルを 9 年間支えてきました。 |
該当なし |
該当なし |
|
LindormDFS と HDFS の比較
LindormDFS は、HDFS プロトコルと互換性のあるクラウドネイティブファイルストレージサービスです。次の表は、LindormDFS と HDFS を比較したものです。
|
機能 |
LindormDFS |
HDFS |
|
|
製品の位置付け |
分散ファイルシステム |
分散ファイルシステム |
|
|
HDFS 互換性 |
HDFS 通信プロトコル |
サポート |
サポート |
|
基本的な読み取り/書き込み API |
完全サポート |
完全サポート |
|
|
高度な管理 API |
完全サポート |
完全サポート |
|
|
コスト |
ストレージ価格 (実際の価格は購入ページに準じます。) |
USD 0.019/GB/月 から |
USD 0.023/GB/月 から |
|
ストレージの弾力性 |
スムーズなオンラインスケーリングをサポートします。 |
参入障壁が高く、スケーリングの増分が大きくなります。 |
|
|
コンピューティングとストレージの分離 |
対応。コンピューティングエンジンから分離されており、独立してスケーリングできます。 |
サポートされていません。コンピューティングエンジンと同じ場所に配置されます。 |
|
|
階層化ストレージ |
インテリジェントなデータ階層化が可能な多層ストレージ。 |
サポートされていません |
|
|
スケーラビリティ |
ノード数 |
該当なし |
0 から 1,000 |
|
ストレージ容量 |
0 から 1 EB |
0 から 10 PB |
|
|
ファイル数 |
数千億個のファイルに対応します。 |
数千万 |
|
|
エコシステム |
Hadoop や Spark などのオープンソースビッグデータエコシステム、および Alibaba Cloud データエコシステム。 |
Hadoop や Spark などのオープンソースビッグデータエコシステム。 |
|
|
使いやすさ |
LindormDFS は O&M フリーのため、メンテナンスが容易です。 |
メンテナンスが複雑なステートフルサービス。 |
|