すべてのプロダクト
Search
ドキュメントセンター

Object Storage Service:データ移行の概要

最終更新日:Sep 18, 2026

ビジネスデータは、多くの場合、オンプレミスデータセンター、サードパーティクラウドストレージ、異なるリージョンやアカウントにある Alibaba Cloud Object Storage Service (OSS) バケットに分散しています。データが分散していると運用が複雑になり、コストが増加します。データ移行では、これらのデータを宛先 OSS バケットに集約します。Alibaba Cloud は、移行シナリオに応じて Data Online Migration、コマンドラインツール、Data Transport などの方法を提供します。

考慮事項

OSS への移行を計画する前に、次の要件を確認してください:

  • 転送アクセラレーション — 移行元と宛先のリージョンが、中国本土とそれ以外のリージョンにまたがる場合は、転送アクセラレーションを有効にする必要があります。

  • S3 互換 API — OpenStack Swift などの自己管理型オブジェクトストレージサービスから OSS にデータを移行する前に、そのサービスで S3 互換 API を有効にしてください。

  • OSS-HDFS の有効化 — OSS-HDFS バケット間でデータを移行する前に、OSS-HDFS を有効化してください。

データソース別の移行方法

次の表は、各移行元に対する推奨方法を示します。後続のセクションでは、各方法の条件と機能について説明します。

移行元

条件

推奨方法

OSS バケット

同一リージョン、同一アカウント、小~中規模のデータ量

ossutil

OSS バケット

同一リージョン、異なるアカウント、または大規模なデータ量

同一リージョンレプリケーション

OSS バケット

異なるリージョン

クロスリージョンレプリケーション

サードパーティクラウドストレージ、または自己管理型の S3 互換オブジェクトストレージ

環境構築が不要なマネージド移行

Data Online Migration

オンプレミスファイルシステム

5 GB 未満

OSS コンソールでアップロード

オンプレミスファイルシステム

通常のビジネスデータ、ログファイル、バックアップデータなどの中規模データ

ossutil

オンプレミスファイルシステム

中規模データ、複雑なオンプレミスネットワーク、またはタスクの集中管理

Data Online Migration

オンプレミスファイルシステム

インターネット経由で転送する大規模データ

Data Online Migration

オンプレミスファイルシステム

インターネット帯域幅に制限がある大規模データ、またはデータセンター全体

Data Transport

HTTP/HTTPS ソース

URL リストからの一括ダウンロード

Data Online Migration

HDFS

宛先が OSS

Jindo DistCp

HDFS

宛先が OSS-HDFS

Jindo DistCp

OSS-HDFS バケット

宛先が別の OSS-HDFS バケット

Jindo DistCp

セミマネージド JindoFS クラスター

宛先が OSS-HDFS

JindoDistJob

Hive テーブルおよびパーティションデータ

宛先が OSS-HDFS

JindoTable MoveTo

OSS 外部テーブル (gpossext)

データウェアハウスと OSS 間の並列インポート/エクスポート

gpossext

Alibaba Cloud OSS バケット間の移行

Alibaba Cloud OSS バケット間でデータを移行する場合、ソースバケットと宛先バケットが同じリージョンにあるかどうかに基づいて移行方法を選択します。

同一リージョン内の移行

ソースバケットと宛先バケットが同じリージョンにある場合、シナリオに応じて移行方法を選択します:

  • ossutil — 同一アカウントに属するバケット内の小~中規模のデータには、ossutil コマンドラインツールを使用して バケット間でオブジェクトをコピー します。ossutil はオブジェクトの一括コピーとレジューム転送をサポートします。

  • 同一リージョンレプリケーション — 大規模データ、または異なるアカウントに属するバケット間の移行には、同一リージョンレプリケーション を使用します。データは中間ロケーションにダウンロードされず、追加のネットワーク転送も不要です。ソースバケットでオブジェクトが追加、変更、削除されると、変更内容は自動的に宛先バケットに同期されます。この方法は、チームや子会社間でデータを集約して共有するシナリオに適しています。

リージョン間の移行

ソースバケットと宛先バケットが異なるリージョンにある場合 (例:China (Hangzhou) から China (Beijing) への移行) は、クロスリージョンレプリケーション を使用します。データは Alibaba Cloud の内部ネットワーク経由で転送されます。レプリケーションは継続的に実行され、ソースバケットでのオブジェクトの追加、変更、削除は自動的に宛先バケットへ同期されます。この方法は、複数拠点での共同作業やリアルタイムバックアップのシナリオに適しています。

リソースプランのストレージリージョン変更

リソースプランのリージョン制限によりストレージリージョンを切り替える必要がある場合は、クロスリージョンレプリケーション または ossutil を使用して、宛先リージョンのバケットへデータを移行します。クロスリージョンレプリケーション はソースバケットで設定します。移行が完了したら、宛先リージョンでリソースプランを購入してください。購入済みのリソースプランは別のリージョンに転送できません。

サードパーティまたは自己管理型オブジェクトストレージから OSS への移行

Data Online Migration を使用すると、移行環境を自前で構築することなく、別のオブジェクトストレージサービスから Alibaba Cloud OSS へデータを移行できます。

サードパーティクラウドストレージサービス

別のクラウドサービスプロバイダーに保存されているデータを Alibaba Cloud OSS に移行するには、Data Online Migration を使用します。AWS S3、Tencent Cloud COS、Huawei Cloud OBS、Volcengine TOS、Google Cloud GCS、Microsoft Azure Blob などのストレージサービスに対応しています。移行環境を構築する必要はありません。オンラインで移行タスクを送信し、いつでも移行の進捗を監視できます。ビジネスシナリオに応じた手順については、Data Online Migration チュートリアルをご参照ください。

自己管理型の S3 互換オブジェクトストレージ

Data Online Migration は、S3 プロトコルと互換性のある自己管理型オブジェクトストレージサービスにも対応しています。例:S3 互換 API を有効にした OpenStack Swift。

オンプレミスファイルシステムから OSS への移行

小規模データ

5 GB 未満のデータは、OSS コンソールで直接アップロードできます。この方法では追加ツールや複雑な設定は不要で、ブラウザーでファイルをアップロードできます。一時的なファイルアップロード、テスト目的のデータ移行、移行頻度が低いタスク、分散したファイルに適しています。

中規模データ

中規模のデータを移行する場合は、要件に応じて次のいずれかの方法を選択します:

  • ossutil — 通常のビジネスデータ、ログファイル、バックアップデータを転送するには、ossutil コマンドラインツールを使用して ローカルファイルを OSS にアップロード します。ossutil は一括アップロード、レジューム転送、並列アクセラレーションをサポートします。

  • Data Online Migration — オンプレミスネットワークが複雑な場合、またはクラウド上で移行タスクを集中管理する場合は、Data Online Migration を使用して LocalFS から OSS にデータを移行 します。このマネージド移行ソリューションは、タスクの作成、監視、管理をサポートし、運用の複雑さを低減します。移行プロセスを集中制御する必要がある法人のお客様に適しています。

大規模データ

大規模データを移行する場合は、要件に応じて次のいずれかの方法を選択します:

  • Data Online Migration — データをインターネット経由で転送できる場合は、Data Online Migration を使用します。移行環境を構築する必要はなく、オンラインで移行タスクを送信し、移行の進捗をリアルタイムで監視できます。この方法は、柔軟なスケジューリングが必要なビジネスシナリオに適しています。

  • Data Transport — インターネット帯域幅によりデータ転送が制限される場合、またはオンプレミスデータセンターからデータを移行する場合は、Data Transport を使用します。Data Transport は TB 規模から PB 規模のデータ移行向けに設計されています。データは物理デバイスに収集して転送されるため、インターネット帯域幅のボトルネックを解消できます。この方法は、データセンター全体のクラウドへの移行、企業のアーカイブファイルの移行、過去の画像データの移行などのシナリオに適しています。

HTTP/HTTPS ソースから OSS への移行

データが HTTP/HTTPS ソースに保存されている場合は、Data Online Migration を使用して HTTP/HTTPS ソースから OSS にデータを移行 します。追加の環境を構築する必要はありません。オンラインで移行タスクを送信し、タスクの進捗とステータスをリアルタイムで監視できます。

重要

OSS は、URL から単一ファイルを直接取得する API を提供していません。PutObject、Multipart Upload、AppendObject などのすべてのアップロード操作はクライアントからデータをアップロードするためのものであり、OSS はサーバー側でリモート URL からファイルを取得しません。以前はサーバー側で URL からファイルを取得していた AsyncFetch 機能は、新規の有効化ができなくなっており、新規アカウントでは使用できません。

  • 単一ファイル — リモート URL のファイルを OSS に保存するには、ファイルをローカルにダウンロードしてから、PutObject などの操作でアップロードします。

  • 複数ファイル — 複数の HTTP/HTTPS URL から OSS にファイルを取得するには、Data Online Migration を使用して HTTP/HTTPS ソース用の移行タスクを作成します。次に、URL リストを含むマニフェストファイルを使用して、ファイルを一括でダウンロードして移行します。

ビッグデータストレージから OSS への移行

HDFS データから OSS への移行

Hadoop 分散ファイルシステム (HDFS) にある大規模データの移行には、Jindo DistCp を使用して HDFS データを OSS に移行 します。Jindo DistCp は MapReduce に基づく分散ファイルコピー ツールで、大規模クラスター内またはクラスター間でファイルを転送します。Jindo DistCp はファイルとディレクトリのリストを MapReduce ジョブの入力として使用し、ジョブを並列タスクに分割します。各タスクは、移行元リスト内の一部のデータをコピーします。Jindo DistCp はフォールトトレランス、レジューム転送、エラー回復に対応しており、TB 規模、さらには PB 規模の移行において安定性とデータ整合性を維持します。このツールは、ビッグデータ計算やデータレイクの構築などのシナリオに適しています。

OSS と AnalyticDB for PostgreSQL 間のデータ交換

データが OSS 外部テーブル (gpossext) として保存されており、OSS とデータウェアハウス間でデータをインポート/エクスポートする必要がある場合は、AnalyticDB for PostgreSQL:データを並列で OSS にエクスポート を使用します。gpossext 機能は、OSS から AnalyticDB for PostgreSQL へのデータの並列インポート、または OSS へのデータの並列エクスポートを実行します。この移行は分散アーキテクチャに基づいており、高い同時実行性と高スループットを提供し、転送時間を短縮するとともに、データセキュリティとデータ整合性を維持します。この方法は、大規模データ分析、履歴データのアーカイブ、システム間のデータ交換などのシナリオに適しています。

ビッグデータストレージから OSS-HDFS への移行

OSS-HDFS (JindoFS とも呼ばれます) は、クラウドネイティブなデータレイクストレージサービスです。統合メタデータ管理に基づいており、OSS-HDFS は HDFS API と完全に互換性があり、POSIX に完全に対応しています。OSS-HDFS は、ビッグデータ計算や AI トレーニングなどのデータレイクシナリオに適しています。ビッグデータワークロードが HDFS API 互換性または POSIX セマンティクスに依存する場合は、移行先として OSS ではなく OSS-HDFS を選択します。以降のセクションでは、既存データを OSS-HDFS に移行する方法と、OSS-HDFS バケット間でデータを移行する方法について説明します。

従来型 HDFS クラスターから OSS-HDFS への移行

従来型 HDFS クラスターからデータを移行するには、Jindo DistCp を使用して HDFS データを OSS-HDFS に移行 します。このツールは、クラスター内またはクラスター間で多数のファイルを分散処理し、自動エラー検出、再試行、タスク復旧をサポートしており、移行タスクの安定性を向上させます。Jindo DistCp はファイルとディレクトリのリストを MapReduce ジョブの入力として使用し、各タスクがファイルの一部をコピーします。このアプローチは、大量データをバッチで移行する場合に適しています。

OSS-HDFS バケット間のデータ移行

ある OSS-HDFS バケットから別の OSS-HDFS バケットへデータを移行するには、Jindo DistCp を使用して OSS-HDFS バケット間でデータを移行 します。この方法は、データパーティションの調整、ストレージリソースの最適化、リージョン間のデータスケジューリングなどの要件に適しており、ビジネスデータの一貫性と高可用性を維持します。

セミマネージド JindoFS クラスターから OSS-HDFS への移行

セミマネージド JindoFS クラスターを使用している場合は、JindoDistJob を使用してセミマネージド JindoFS クラスターから OSS-HDFS にデータを移行 します。このツールはフル移行と増分移行に対応しており、データブロックを移行することなく JindoFS のサービスベースのソリューションに切り替えます。移行がビジネスに影響を与えることはないため、ストレージアーキテクチャを迅速に切り替える必要があるシナリオに適しています。

Hive テーブルおよびパーティションデータから OSS-HDFS への移行

構造化データを移行するには、JindoTable MoveTo コマンドを使用して Hive テーブルおよびパーティションデータを OSS-HDFS に移行 します。基盤となるデータがコピーされた後、コマンドはメタデータを自動的に更新し、テーブルとパーティションを新しいパスへ完全に移行します。このコマンドはフィルター条件に対応しており、多数のパーティションを一度に移行できます。また、複数のデータ検証メカニズムを使用して、データ整合性とデータセキュリティを維持します。このコマンドは、大規模な構造化データセットの移行に適しています。

ミラーリングベースのオリジンフェッチによるゼロダウンタイム移行

移行中のビジネス継続性を維持するには、ミラーリングベースのオリジンフェッチ を設定します。サービスを OSS に切り替えた後、OSS は、リクエストされたデータがまだ移行されていない場合、オリジンから自動的に取得します。この移行プロセスはユーザーに対して透過的に行われます。

説明

最初に移行方法を決定してください。その後、ビジネス要件に基づいてミラーリングベースのオリジンフェッチを設定し、ゼロダウンタイム移行を実現します。

一般的なゼロダウンタイム移行は、次の順序で実施します:

  1. 履歴データを宛先 OSS バケットに移行します。

  2. サービスのアクセス先を OSS に切り替えます。

  3. クライアントからリクエストがあった場合、ミラーリングベースのオリジンフェッチ機能により、未移行のデータが取得されます。すべてのデータがクラウドに保存されるまで、データは徐々に補完されます。

たとえば、サービスが別のクラウドストレージプラットフォーム上で稼働していて、ビジネスの拡大に伴って OSS に移行する必要がある一方で、オンラインサービスを停止できない場合があります。この場合、ミラーリングベースのオリジンフェッチルールを設定し、移行されていないデータを自動的に取得して、移行中に OSS へ同期します。これにより、サービスの可用性と安定性を維持できます。