すべてのプロダクト
Search
ドキュメントセンター

MaxCompute:オープンレイクハウスアーキテクチャの概要

最終更新日:Aug 22, 2026

MaxCompute は、統合メタデータ管理、オープンストレージ、多様なコンピューティングオプション、堅牢なセキュリティ、優れたコスト効率を特徴とする、エンタープライズグレードのオープンレイクハウスアーキテクチャを提供します。

対象となるお客様

  1. データウェアハウスに構造化データが高い割合で含まれているものの、複数のチームやエンジンからのアクセスをサポートするためにデータレイクのオープン性を必要とするお客様。

  2. 行レベルおよび列レベルの権限やデータマスキングなどのエンタープライズグレードの機能を必要とし、災害復旧、バックアップ、セキュリティ、コンプライアンスに対して厳しい要件を持つお客様。

機能概要

統合メタデータ

MaxCompute は、テーブル、ビュー、スナップショット、モデルなどのデータオブジェクトに対して、統合されたデータカタログとデータガバナンスのソリューションを提供します。このソリューションにより、きめ細かなアクセス制御と監査が可能になります。セキュリティポリシーを一度定義すれば、グローバルに適用されます。

接続を使用して Alibaba Cloud サービスのアクセス認証情報を管理できます。MaxCompute は、OSS などの外部データストレージにある構造化データおよび非構造化データファイルを自動的に検出し、外部テーブルとして登録します。テーブルを介してデータにアクセスすることで、データ分析プロセスが簡素化されます。データレイクテーブルのキャッシュされた統計情報は、コンピューティングパフォーマンスを向上させます。

オープンストレージ

オープンストレージを使用すると、データを一度保存するだけで、複数のコンピューティングエンジンで利用できます。ストレージ API を使用して、MaxCompute が管理するテーブルのデータをサードパーティのコンピューティングエンジンに利用可能にすることができます。

MaxCompute は、Spark、Flink、Flink CDC、StarRocks、DBT、Presto、Trino、PAI、PyTorch などのコンピューティングエコシステムと統合されています。

ストレージ API は、データを読み取るための効率的で低レイテンシーかつ安全な方法を提供します。データは Arrow フォーマットで転送されます。この API は、述語プッシュダウン、パーティショニング、列プルーニングなどのパフォーマンス最適化をサポートします。また、行レベルおよび列レベルの権限やデータマスキングなどのセキュリティ機能もサポートします。この機能は、チーム間のコラボレーション効率とコンプライアンス要件のバランスを取ります。

オープンコンピューティング

MaxCompute 独自開発の SQL エンジンと MaxFrame エンジンは、レイクハウスエコシステム内の多様なデータソースにわたって統一されたコンピューティング体験を提供します。これらのエンジンは、外部テーブルと外部プロジェクトを通じて、さまざまな外部ストレージシステムへの透過的アクセスを可能にします。内部テーブルと外部テーブルの両方のデータを、ETL (extract, transform, and load)、データ分析、機械学習タスクで柔軟に利用できます。

image

チュートリアル

MaxLake を使用すると、データレイクやウェアハウスへのデータインジェストとマルチシナリオ分析のオーケストレーションが可能になります。たとえば、IoV (Internet of Vehicles) のデータを使用して、車両から報告される GPS 位置データから走行距離と速度を分析できます。その後、リアルタイムのクエリレポート、マスキングされたデータ共有によるチーム間のコラボレーション、AI トレーニングなどのシナリオで複数のエンジンを使用できます。このアプローチにより、単一のデータコピーから複数の価値を生み出すことができます。詳細については、「MaxCompute でのデータレイク分析のためのデータ変換とマルチシナリオオーケストレーション」をご参照ください。