Apache Kyuubi は、Spark、Flink、Trino などのデータレイククエリエンジンに SQL クエリサービスを提供する分散型マルチテナントゲートウェイです。
特徴
-
マルチテナンシー:Kyuubi は、統一された認証・認可レイヤーを使用し、リソース取得、データアクセス、メタデータアクセスに対し、エンドツーエンドのマルチテナンシーサポートを提供します。
-
高可用性:Kyuubi は ZooKeeper を使用して負荷分散を行い、エンタープライズレベルの高可用性と無制限のクライアント同時実行性を提供します。
-
複数のワークロード:Kyuubi は、単一のデータレプリカと統一された SQL インターフェイスを使用し、単一のプラットフォームで複数のワークロードを処理します。
シナリオ
-
対話型分析:Kyuubi は、ビッグデータの対話型ビジュアル分析向けに、エンタープライズレベルの分析プラットフォームを実現します。一般的なコンピューティングフレームワーク、Java Database Connectivity (JDBC)、オープンデータベースコネクティビティ (ODBC) インターフェイスをサポートし、SQL または BI ツールによる効率的なクエリを可能にします。Kyuubi は、ユーザーレベルでバックエンドのエンジンインスタンスをキャッシュすることで、リソース共有を改善し、レスポンスを高速化します。大規模なデータセットに対するクエリを並列処理し、結果を迅速に返します。
-
バッチデータ処理:Kyuubi は、大規模な抽出、変換、ロード (ETL) プロセスなどの一般的なバッチ処理向けに SQL インターフェイスを提供します。Kyuubi とそのエンジンはストレージに依存せず、多数のデータソースをサポートします。また、Kyuubi は接続レベルでバックエンドのエンジンインスタンスを分離し、リソース分離と安定性を向上させます。
Kyuubi、Livy、Spark ThriftServer の比較
|
比較項目 |
Kyuubi |
Livy |
Spark ThriftServer |
|
対応インターフェイス |
SQL |
SQL、Scala、Python、R |
SQL |
|
対応エンジン |
Spark、Flink、Trino |
Spark |
Spark |
|
Spark バージョン |
Spark 3.x |
Spark 2.x および Spark 3.x |
Spark コンポーネントに同梱 |
|
対応プロトコル |
Thrift および JDBC |
HTTP、Thrift、JDBC |
Thrift および JDBC |
|
クライアント |
Kyuubi Beeline |
HTTP クライアント |
Spark Beeline |
|
高可用性 |
サポート |
サポート |
非サポート |
|
リソース分離 |
サポート |
サポート |
非サポート |
|
LDAP 認証 |
サポート |
サポート |
サポート |
|
Alibaba Cloud E-MapReduce (EMR) バージョン |
|
|
すべてのバージョン |