このトピックでは、AnalyticDB for PostgreSQL の一般的なシナリオと機能について説明します。
一般的なシナリオ
クラウドデータウェアハウスの構築
Data Transmission Service (DTS) または Data Integration を使用して、ApsaraDB RDS や PolarDB などの Alibaba Cloud データベースサービス、またはセルフマネージド型データベースから AnalyticDB for PostgreSQL にデータを移行します。DataWorks を使用して、ペタバイト規模のデータセットに対する抽出、変換、ロード (ETL) パイプラインをスケジュールします。Quick BI、DataV、Tableau、FineReport などの BI ツールを接続して、ライブデータにクエリを実行し、レポートを公開します。
互換性のあるデータソースとツール:
|
役割 |
互換性のあるオプション |
|
データ同期 |
DTS、Data Integration |
|
ソースデータベース |
ApsaraDB RDS、PolarDB、セルフマネージド型データベース |
|
タスクスケジューリング |
DataWorks |
|
BI とレポーティング |
Quick BI、DataV、Tableau、FineReport |
ビッグデータ分析の高速化
Data Integration または Object Storage Service (OSS) を使用して、MaxCompute、Hadoop、Spark からデータをインポートします。そのデータで直接、高性能な分析、処理、オンラインデータ探索を実行します。
OSS 内データの直接クエリ
OSS 外部テーブルを使用して、OSS に保存されているデータに並列クエリを実行します。既存の OSS データを基盤として、Alibaba Cloud データレイク分析プラットフォームを構築します。
機能
AnalyticDB for PostgreSQL は、次の OLAP 機能を提供します。
ETL とオフラインデータ処理
AnalyticDB for PostgreSQL は、大規模で複雑な SQL ワークロードを処理します。
|
機能 |
詳細 |
|
SQL 互換性 |
標準 SQL 構文、OLAP ウィンドウ関数、ストアドプロシージャ |
|
クエリ最適化 |
ORCA クエリオプティマイザにより、手動チューニングなしで複雑なクエリを処理します。 |
|
処理アーキテクチャ |
MPP アーキテクチャにより、ペタバイト規模のデータを数秒で処理します。 |
|
ストレージ効率 |
高圧縮の列ストアにより、大規模テーブルの高速スキャンを実現します。 |
オンライン高性能クエリ
リアルタイム探索、データウェアハウジング、データ更新が混在するワークロード向け:
|
機能 |
詳細 |
|
書き込みスループット |
高スループットの INSERT、UPDATE、DELETE 操作 |
|
ポイントクエリのレイテンシ |
行ストアと B-tree およびビットマップインデックスにより、ミリ秒単位の結果を返します。 |
|
トランザクションのサポート |
分散トランザクション、標準の分離レベル、ハイブリッドトランザクション/分析処理 (HTAP) |
マルチモーダルデータ分析
構造化データの枠を超えるワークロード向け:
|
機能 |
詳細 |
|
地理空間分析 |
地理データのクエリ向けの PostGIS 拡張機能 |
|
機械学習 |
AI ネイティブな分析向けのインデータベース ML ライブラリである MADlib |
|
非構造化データ |
画像、音声、テキスト向けのベクトル検索 |
|
半構造化データ |
ログ分析と処理向けの JSON サポート |