すべてのプロダクト
Search
ドキュメントセンター

ApsaraDB for SelectDB:オンラインサービスの高可用性に関するベストプラクティス

最終更新日:Sep 11, 2026

オンラインサービスにおけるサービス中断を最小化し、システムの安定性と信頼性を向上させるためのベストプラクティスです。

クイックスタートガイド

ApsaraDB for SelectDB を開始するには、次のドキュメントを参照してください。

  • (必須) クイックスタート

    ApsaraDB for SelectDB の基本概念、インスタンスの購入と使用方法、テーブル設計について説明し、ApsaraDB for SelectDB を使い始めるのに役立ちます。

  • (任意) データ移行

    MySQL、PostgreSQL、Doris など、さまざまなデータソースから ApsaraDB for SelectDB にデータを移行します。

  • (任意) パフォーマンステスト

    Star Schema Benchmark、TPC-H Benchmark、TPC-DS Benchmark を使用してパフォーマンステストを実行します。

リリースおよび変更の仕様

  • (必須) 事前テスト

    リリース前に、テスト用インスタンスで新機能をテストしてください。高負荷サービスの場合は、パフォーマンスのストレステストを実施して本番レベルの性能を評価してください。

  • (必須) グレースケールリリース

    段階的ロールアウト (10%→50%→100%) を使用し、オフピーク時間帯に変更をリリースしてください。フェーズ間は 10~30 分間サービスを観察してください。最初の業務ピーク時は特に厳密に監視してください。オフピークでのテストでは、すべての問題が顕在化しない場合があります。

運用保守の推奨事項

  • (必須) ビジネス監視

    ApsaraDB for SelectDB は監視とアラートを提供します。追跡すべき主要メトリクス:平均および P99 のクエリ応答時間、クエリ成功率、データインポート速度、CPU 使用率、メモリ使用量。アラート ルールの設定でアラートを設定してください。

  • 容量管理

    高負荷サービスの場合は、最適化とストレステストを実施して最大 QPS を特定してください。ビジネスの成長に応じて、または販促イベントの前に、リソースをスケールアウトしてください。

  • バージョン更新

    ApsaraDB for SelectDB は、パッチバージョン更新 (3 つまたは 4 つのパートから成るバージョン番号) によりバグを修正します。最新のパッチバージョンに速やかにアップグレードしてください。まず非本番環境でテストし、緊急時のロールバックについてはテクニカルサポートにお問い合わせください。例:バージョン 4.0.4.2 (2025 年 2 月 6 日リリース) は 6 か月で 12 回更新され、4.0.6.1 に到達しました。

  • サービス分離

    独立したビジネスシナリオには、別々のインスタンスを使用してください。異なるサービスでデータを共有する場合は、マルチコンピュートグループアーキテクチャを使用してください。1 つのインスタンス内に、読み書きインスタンスのデータを共有する複数の物理コンピュートキューを配置します。

運用ドリル

  • インスタンス変更

    アップグレードやスケールアウトなどの一般的な操作により、一時的に接続が中断される場合があります。事前にこれらをリハーサルし、ApsaraDB for SelectDB のインスタンス変更中に接続が失敗した場合は、アプリケーションでリトライするようにしてください。

  • 障害復旧

    ApsaraDB for SelectDB は、障害復旧のオプションとして、新しいコンピュートグループへの切り替え、障害が発生したインスタンスの再起動、または停滞したコンピュートグループの再起動をサポートしています。これらの手順を事前にリハーサルしてください。

高可用性アーキテクチャ

  • (任意) サービススロットリング

    ApsaraDB for SelectDB はワークロードグループをサポートしています。ワークロードグループは、リクエストタイプやサービスごとにリソース使用量を制御する論理タスクキューです。ワークロードグループを使用してリソース上限を設定し、バースト時にトラフィックをスロットリングしてください。

  • (任意) マルチゾーンディザスタリカバリ

    ApsaraDB for SelectDB はマルチゾーンディザスタリカバリをサポートしています。ゾーンで障害が発生した場合、システムは約 10 秒の目標復旧時間 (RTO) で自動的にフェイルオーバーします。