kube-scheduler は、Pod をノードに割り当てるコントロールプレーンコンポーネントです。各 Pod のリソースリクエストと各ノードの Allocatable 容量を比較評価し、不適格なノードをフィルタリングするフェーズと、残りの候補をランク付けするフェーズの 2 フェーズのパイプラインを使用して、最適なノードを選択します。
仕組み
kube-scheduler は、スケジューリングキュー内の Pod を処理します。Pod ごとに、宣言されたリソースリクエストとノードの Allocatable プロパティを読み取って有効なノードを特定し、すべての有効なノードをスコアリングして、最もスコアの高いノードに Pod をバインドします。デフォルトでは、kube-scheduler はリソースリクエストに基づいて Pod を均等に分散します。
アップストリームの完全な仕様については、Kubernetes ドキュメントの「kube-scheduler」をご参照ください。
Filter プラグインと Score プラグイン
スケジューリングは次の 2 つのフェーズで実行されます:
Filter — 各 Filter プラグインは、Pod を実行できないノードを除外します。ノードが候補として残るには、すべての Filter プラグインを通過する必要があります。
Score — 各 Score プラグインは、残りの各ノードにスコアを割り当てます。最終的なノードスコアは、すべての Score プラグインの
plugin_score × plugin_weightの合計です。
重みの優位性:2 つの ACK プラグイン(elasticresource と resourcepolicy)のデフォルトの重みはそれぞれ 1,000,000 です。いずれかがアクティブな場合、そのスコアが事実上結果を決定し、他のプラグインの寄与はごくわずかになります。次に重みが大きいのは gpushare (20,000) と PreferredNode (10,000) です。エラスティックスケーリングやノードプールの優先度ルーティングを使用するワークロードを設定する際は、この点に留意してください。
以下の表に、各 kube-scheduler バージョンでデフォルトで有効になっているプラグインを示します。オープンソースのプラグインはアップストリームのデフォルトに従い、ACK 固有のプラグインは明示的にリストされています。
バージョン別のデフォルトで有効なプラグイン
コンポーネントバージョン | Filter プラグイン | Score プラグイン |
v1.30.1-aliyun.6.5.4.fcac2bdf | オープンソースのプラグイン:アップストリームと同じです。「v1.30.1 default Filter plugins」をご参照ください。ACK プラグイン:NodeNUMAResource、topologymanager、EciPodTopologySpread、ipawarescheduling、BatchResourceFit、PreferredNode、gpushare、NetworkTopology、CapacityScheduling、elasticresource、resourcepolicy、gputopology、ECIBinderV1、loadawarescheduling、EciScheduling | オープンソースのプラグイン:アップストリームと同じです。「v1.30.1 default Score plugins」をご参照ください。ACK プラグインとデフォルトの重み:NodeNUMAResource (1)、ipawarescheduling (1)、gpuNUMAJointAllocation (1)、PreferredNode (10,000)、gpushare (20,000)、gputopology (1)、numa (1)、EciScheduling (2)、NodeAffinity (2)、elasticresource (1,000,000)、resourcepolicy (1,000,000)、NodeBEResourceLeastAllocated (1)、loadawarescheduling (10) |
v1.28.3-aliyun-6.5.2.7ff57682 | オープンソースのプラグイン:アップストリームと同じです。「v1.28.3 default Filter plugins」をご参照ください。ACK プラグイン:NodeNUMAResource、topologymanager、EciPodTopologySpread、ipawarescheduling、BatchResourceFit、PreferredNode、gpushare、NetworkTopology、CapacityScheduling、elasticresource、resourcepolicy、gputopology、ECIBinderV1、loadawarescheduling、EciScheduling | オープンソースのプラグイン:アップストリームと同じです。「v1.28.3 default Score plugins」をご参照ください。ACK プラグインとデフォルトの重み:NodeNUMAResource (1)、ipawarescheduling (1)、gpuNUMAJointAllocation (1)、PreferredNode (10,000)、gpushare (20,000)、gputopology (1)、numa (1)、EciScheduling (2)、NodeAffinity (2)、elasticresource (1,000,000)、resourcepolicy (1,000,000)、NodeBEResourceLeastAllocated (1)、loadawarescheduling (10) |
v1.26.3-aliyun-6.6.1.605b8a4f | オープンソースのプラグイン:アップストリームと同じです。「v1.26.3 default Filter plugins」をご参照ください。ACK プラグイン:NodeNUMAResource、topologymanager、EciPodTopologySpread、ipawarescheduling、BatchResourceFit、PreferredNode、gpushare、NetworkTopology、CapacityScheduling、elasticresource、resourcepolicy、gputopology、ECIBinderV1、loadawarescheduling、EciScheduling | オープンソースのプラグイン:アップストリームと同じです。「v1.26.3 default Score plugins」をご参照ください。ACK プラグインとデフォルトの重み:NodeNUMAResource (1)、ipawarescheduling (1)、gpuNUMAJointAllocation (1)、PreferredNode (10,000)、gpushare (20,000)、gputopology (1)、numa (1)、EciScheduling (2)、NodeAffinity (2)、elasticresource (1,000,000)、resourcepolicy (1,000,000)、NodeBEResourceLeastAllocated (1)、loadawarescheduling (10) |
プラグインの説明
プラグイン | 機能 | 使用シナリオ | 関連ドキュメント |
NodeNUMAResource | NUMA トポロジーを認識して CPU 負荷の高いワークロードをスケジューリングし、CPU が同じメモリバスを共有するノードに Pod を配置します。 | リアルタイムデータ処理や HPC (ハイパフォーマンスコンピューティング) ジョブなど、CPU の局所性によるメリットを享受する、レイテンシに敏感なワークロード。 | |
topologymanager | コロケーションされた CPU とメモリを要求する Pod に NUMA ノードリソースを割り当て、一貫したメモリ帯域幅を確保します。 | AI 推論やインメモリデータベースなど、メモリ帯域幅の一貫性を必要とするワークロード。 | |
EciPodTopologySpread | 仮想ノードのスケジューリングのためのトポロジースプレッド制約を拡張し、Elastic Container Instance (ECI) 仮想ノードを使用する際にアベイラビリティゾーン全体に Pod を分散させます。 | ECI 仮想ノードのデプロイにおけるアベイラビリティゾーン間の Pod 分散のバランシング。 | |
ipawarescheduling | VPC (Virtual Private Cloud) サブネット内の残りの IP アドレスが不十分なノードを除外し、IP 枯渇による Pod の起動の失敗を防止します。 | IP 枯渇のリスクがある、制限された IP 範囲を持つ VPC サブネット。 | |
BatchResourceFit | 同じノード上での複数のワークロードタイプのコロケーションを可能にし、クラスター全体の利用率を向上させます。 | ノードの利用率を最大化したい、オンラインワークロードとオフラインワークロードが混在する環境。 | |
PreferredNode | オートスケーリングが有効なノードプール用にノードを予約し、通常の Pod がエラスティックスケールアウト用の容量を占有するのを防ぎます。 | ノードの予約が必要な、オートスケーリングノードプールを持つクラスター。 | |
gpushare | 1 つの GPU カードを複数のワークロードで共有する Pod をスケジューリングします。デフォルトの重み:20,000。 | 排他的な GPU 割り当てを必要としない、複数の推論タスクや軽量な GPU ジョブ。 | |
NetworkTopology | 物理ネットワークトポロジーを認識して Pod をスケジューリングし、分散ワークロードのコンポーネントを最適なインターコネクトを持つノードに配置します。 | ノード間のネットワーク帯域幅がパフォーマンスに大きく影響する分散 AI トレーニングジョブ。 | |
CapacityScheduling | Namespace 全体でエラスティッククォータの制限を実施し、最小リソースを保証して、チームごとの最大使用量に上限を設けます。 | 複数のチームが容量を共有し、リソースの分離を必要とするマルチテナントクラスター。 | |
elasticresource | [廃止] マネージド ECI エラスティックスケジューリング。新規デプロイメントには | — | |
resourcepolicy | ノードプール全体で優先順位に従って Pod をスケジューリングし、Elastic Compute Service (ECS) の容量が不足している場合は ECI にエラスティックにオーバーフローさせます。デフォルトの重み:1,000,000 — アクティブな場合、ノードの選択を支配します。 | ECS ノードを優先するが、ECS 容量が不足したときに ECI にバーストさせる必要があるワークロード。 | |
gputopology | マルチ GPU ワークロードを、必要な GPU が NVLink などの最適なインターコネクトで接続されているノードにスケジューリングし、GPU 間の帯域幅を最大化します。 | 高い GPU 間帯域幅を必要とする大規模な分散トレーニング。 | |
ECIBinderV1 | エラスティックスケジューリングシナリオにおいて、ECI 容量をターゲットとする Pod のバインドフェーズを処理します。 | ECI エラスティックスケジューリングのデプロイ — | |
loadawarescheduling | 宣言されたリクエストではなく、リアルタイムの CPU およびメモリ使用率に基づいて Pod を分散させ、過剰に使用されているノードのホットスポットを回避します。 | 宣言されたリクエストが実際の使用量を反映していない、バースト性のあるワークロードやオーバープロビジョニングされたワークロード。 | |
EciScheduling | ECI をターゲットとする Pod の仮想ノードの選択を管理します。 | ECI エラスティックスケジューリングのデプロイ。 |
コンポーネントのアップグレード
kube-scheduler はデフォルトでインストールされており、設定は不要です。最新のスケジューリングの最適化やバグ修正を入手するには、最新の状態に保ってください。
kube-scheduler をアップグレードするには、ACK コンソールにログインし、対象のクラスターをクリックして、[運用管理] > [コンポーネント管理] に移動します。Container Service for Kubernetes (ACK) コンソール
変更履歴
バージョン 1.34 の変更履歴
バージョン | リリース日 | 変更内容 |
v1.34.0-apsara.6.11.8.a32868e8 | 2026 年 1 月 5 日 | 新機能: 共有 GPU スケジューリングの効率を最適化しました。サーバーレスリソースのスケジューリングのメトリクス(処理レイテンシ、タイムスタンプ追跡、および同時実行構成)を追加し、サーバーレスワークロードの可観測性を向上させました。バグ修正: |
v1.34.0-apsara.6.11.7.43cab345 | 2025 年 12 月 8 日 | 新機能: ネットワークトポロジー感知スケジューリングで EP サイズのスケジューリングがサポートされるようになりました。PyTorchJob の場合、Pod はインデックスに基づいて自動的に連続して配置されます。バグ修正: オートスケーリングの効率を向上させました。ACS Pod のスケジューリングがトリガーされたときに、スケジューラが Pod の Scheduled 条件を更新しないようになり、意図しないノードプールのスケールアウトを防止しました。再起動後にスケジュールされた Pod の ACS GPU パーティションを読み取れない問題を修正しました。 |
v1.34.0-apsara.6.11.6.3c0b732b | 2025 年 11 月 10 日 | 新機能: |
v1.34.0-apsara.6.11.5.3c117f21 | 2025 年 10 月 23 日 | バグ修正: |
v1.34.0-apsara.6.11.3.ff6b62d8 | 2025 年 9 月 17 日 | バージョン 1.34 の ACK クラスターにおける以前のすべての機能の初期サポート。 |
バージョン 1.33 の変更履歴
バージョン | リリース日 | 変更内容 |
v1.33.0-apsara.6.11.8.709bb6e6 | 2026年1月5日 | 新機能: 共有 GPU スケジューリングの効率を最適化。可観測性を向上させるため、サーバーレスリソーススケジューリングのメトリクス (処理レイテンシ、タイムスタンプ追跡、および同時実行数の設定) を追加。 バグ修正: |
v1.33.0-apsara.6.11.7.4a6779f8 | 2025年12月5日 | 新機能: ネットワークトポロジー感知スケジューリングが EP サイズのスケジューリングをサポート。PyTorchJob の Pod がインデックス順に連続して配置されるよう変更。 バグ修正: オートスケーリングの効率を向上。ACS インスタンスの作成時にスケジューラが Pod の Scheduled 条件を更新しないようにし、ノードプールのスケールアウトを防止。再起動後に ACS の GPU パーティションの読み取りに失敗する問題を修正。SelectedNode を持つ PVC を使用する Pod がスケジュールできない問題を修正。 |
v1.33.0-apsara.6.11.6.2fce98cb | 2025年11月10日 | 新機能: |
v1.33.0-apsara.6.11.5.8dd6f5f4 | 2025年10月23日 | バグ修正: |
v1.33.0-apsara.6.11.4.77470105 | 2025年9月15日 | バグ修正: Pod 内の複数のコンテナが |
v1.33.0-apsara.6.11.3.ed953a31 | 2025年9月8日 | 新機能: ElasticQuotaTree が |
v1.33.0-aliyun.6.11.2.330dcea7 | 2025年8月19日 | GOAT スケジューリングの決定性を向上させ、 |
v1.33.0-aliyun.6.11.1.382cd0a6 | 2025年7月25日 | ElasticResource を使用した ECI エラスティックスケジューリングの実装 (廃止) が機能しない問題を修正。 |
v1.33.0-aliyun.6.11.0.87e9673b | 2025年7月18日 | Pod のスケジューリング中に NodeReady 状態が同時に変化する状況を処理できるよう、GOAT スケジューリングの決定性を向上。スケジュールされた Pod が存在する状態で PodGroup CR が削除され再作成された場合の、ギャング Pod の誤ったカウントを修正。同じポリシーを持つ Pod がプリエンプトされるのを防ぎ、使用量が Min 値を下回っている場合のクォータ内プリエンプションを防ぐため、ElasticQuota のプリエンプションを修正。ノードの残り IP アドレスを感知するスケジューリングを修正し、IP アドレスが不足しているノードへのスケジューリングを正しくブロックするように変更。バージョン 6.9.x 以降で機能していなかった |
v1.33.0-aliyun.6.9.4.8b58e6b4 | 2025年6月10日 | 連続的な Pod のスケジューリング中に InterPodAffinity および PodTopologySpread が無効になる問題を修正。ResourcePolicy における時折発生するスケジューリングの異常を修正。オートスケーリングノードプールとのスケジューラの相互作用を改善。優先度ベースのエラスティックリソーススケジューリングのための ResourcePolicy における誤った Pod カウントを修正。サーバーレスコンピューティングで WaitForFirstConsumer クラウドディスクを使用した場合に発生する可能性があるクラウドディスクのリークを修正。 |
v1.33.0-aliyun.6.9.2.09bce458 | 2025年4月28日 | バージョン 1.33 の ACK クラスターにおける、これまでのすべての機能の初期サポート。 |
バージョン 1.32 の変更履歴
バージョン | リリース日 | 変更内容 |
v1.32.0-apsara.6.11.8.df9f2fa6 | 2026年1月5日 | 新機能: 共有 GPU スケジューリングの効率を最適化。可観測性を向上させるため、サーバーレスリソーススケジューリングのメトリクスを追加。 バグ修正: |
v1.32.0-apsara.6.11.7.4489ebf4 | 2025年12月10日 | バグ修正: オートスケーリングの効率を向上。ACS インスタンスの作成時にスケジューラが Pod の Scheduled 条件を更新しないように変更。再起動後に ACS の GPU パーティションの読み取りに失敗する問題を修正。 |
v1.32.0-apsara.6.11.6.03248691 | 2025年11月10日 | 新機能: |
v1.32.0-apsara.6.11.5.c774d3c3 | 2025年10月23日 | バグ修正: |
v1.32.0-apsara.6.11.4.4a4f4843 | 2025年9月15日 | バグ修正: Pod 内の複数のコンテナが |
v1.32.0-apsara.6.11.3.b651c575 | 2025年9月12日 | 新機能: ElasticQuotaTree が |
v1.32.0-aliyun.6.11.2.58302423 | 2025年8月21日 | uninitialized および unschedulable のノード Taint に対する GOAT スケジューリングの決定性を向上。Min または Request が空のクォータに対する ElasticQuotaTree の公平性チェックエラーを修正。ACS インスタンスの作成時にスケジューラがクラッシュする可能性がある問題を修正。 |
v1.32.0-aliyun.6.11.1.ab632d8c | 2025年7月25日 | ElasticResource を使用した ECI エラスティックスケジューリングの実装 (廃止) が機能しない問題を修正。 |
v1.32.0-aliyun.6.11.0.0350a0e7 | 2025年7月18日 | NodeReady の同時変更に対する GOAT スケジューリングの決定性を向上。PodGroup CR の再作成時の誤ったギャング Pod のカウントを修正。ElasticQuota のプリエンプションロジックを修正。ノードの残り IP アドレスを感知するスケジューリングを修正。バージョン 6.9.x 以降で機能していなかった |
v1.32.0-aliyun.6.9.4.d5a8a355 | 2025年6月4日 | 連続的なスケジューリング中に InterPodAffinity および PodTopologySpread が無効になる問題を修正。ResourcePolicy のスケジューリングの異常を修正。ElasticQuota のプリエンプションの問題を修正。 |
v1.32.0-aliyun.6.9.3.515ac311 | 2025年5月14日 | オートスケーリングノードプールとのスケジューラの相互作用を改善。ResourcePolicy における誤った Pod カウントを修正。サーバーレスコンピューティングと WaitForFirstConsumer ディスクを使用した場合の潜在的なクラウドディスクのリークを修正。 |
v1.32.0-aliyun.6.9.2.09bce458 | 2025年4月16日 | ElasticQuota のプリエンプションの異常を修正。ACS GPU-HPN ノードへの Pod のスケジューリングのサポートを追加。 |
v1.32.0-aliyun.6.8.6.bd13955d | 2025年4月2日 | ACK サーバーレスクラスターにおいて、WaitForFirstConsumer クラウドディスクが Container Storage Interface (CSI) プラグイン経由で作成されない問題を修正。 |
v1.32.0-aliyun.6.9.0.a1c7461b | 2025年2月28日 | ノードの残り IP アドレスを感知するスケジューリングのサポートを追加。Kube Queue タスクがデキューされる前にリソースをチェックするプラグインを追加。コンポーネント設定を通じたプリエンプションアルゴリズムの切り替えサポートを追加。 |
v1.32.0-aliyun.6.8.5.28a2aed7 | 2025年2月19日 | ECI または ACS を使用した際のクラウドディスクの反復作成を修正。PodLabels を宣言した後に ResourcePolicy の Max 値が無効になる問題を修正。 |
v1.32.0-aliyun.6.8.4.2b585931 | 2025年1月17日 | バージョン 1.32 の ACK クラスターにおける、これまでのすべての機能の初期サポート。 |
バージョン 1.31 の変更履歴
バージョン | リリース日 | 変更内容 |
v1.31.0-apsara.6.11.5.28c6b51a | 2025年10月20日 | バグ修正: |
v1.31.0-apsara.6.11.4.69d7e1fa | 2025年9月15日 | バグ修正: Pod 内の複数のコンテナが |
v1.31.0-apsara.6.11.3.9b41ad4a | 2025年9月12日 | 新機能: ElasticQuotaTree が |
v1.31.0-aliyun.6.11.1.c9ed2f40 | 2025年7月25日 | ElasticResource を使用した ECI エラスティックスケジューリングの実装 (廃止) が機能しない問題を修正。 |
v1.31.0-aliyun.6.11.0.ea1f0f94 | 2025年7月18日 | NodeReady の同時変更に対する GOAT スケジューリングの決定性を向上。PodGroup CR の再作成時の誤ったギャング Pod のカウントを修正。ElasticQuota のプリエンプションロジックを修正。ノードの残り IP アドレスを感知するスケジューリングを修正。バージョン 6.9.x 以降で機能していなかった |
v1.31.0-aliyun.6.9.4.c8e540e8 | 2025年6月4日 | InterPodAffinity および PodTopologySpread が無効になる問題を修正。ResourcePolicy のスケジューリングの異常を修正。ElasticQuota のプリエンプションの問題を修正。 |
v1.31.0-aliyun.6.9.3.051bb0e8 | 2025年5月14日 | オートスケーリングノードプールとのスケジューラの相互作用を改善。ResourcePolicy における誤った Pod カウントを修正。サーバーレスコンピューティングと WaitForFirstConsumer ディスクを使用した場合の潜在的なクラウドディスクのリークを修正。 |
v1.31.0-aliyun.6.8.6.520f223d | 2025年4月2日 | ACK サーバーレスクラスターにおいて、WaitForFirstConsumer クラウドディスクが CSI プラグイン経由で作成されない問題を修正。 |
v1.31.0-aliyun.6.9.0.8287816e | 2025年2月28日 | ノードの残り IP アドレスを感知するスケジューリングのサポートを追加。Kube Queue タスクがデキューされる前にリソースをチェックするプラグインを追加。コンポーネント設定を通じたプリエンプションアルゴリズムの切り替えサポートを追加。 |
v1.31.0-aliyun.6.8.5.2c6ea085 | 2025年2月19日 | ECI または ACS を使用した際のクラウドディスクの反復作成を修正。PodLabels を宣言した後に ResourcePolicy の Max 値が無効になる問題を修正。 |
v1.31.0-aliyun.6.8.4.8f585f26 | 2025年1月2日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ACS GPU のサポートを追加。ACK サーバーレスクラスターで PVC を使用した際の潜在的な ECI インスタンスのリークを修正。Capacity Scheduling:ACS リソース正規化シナリオにおける ElasticQuotaTree の誤った使用を修正。 |
v1.31.0-aliyun.6.8.3.eeb86afc | 2024年12月16日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:複数の ACS タイプユニットのサポートを追加。 |
v1.31.0-aliyun.6.8.2.eeb86afc | 2024年12月5日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ユニット内での |
v1.31.0-aliyun.6.8.1.116b8e1f | 2024年12月2日 | ネットワークトポロジー感知スケジューリングのパフォーマンスを向上。ECI Pod が ECS ノードにスケジュールされる可能性がある問題を修正。負荷感知スケジューリングが DaemonSet Pod を制限しないように変更。 |
v1.31.0-aliyun.6.7.1.1943173f | 2024年11月6日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:トリガーベースの Pod オートスケーリングのサポートを追加。[非推奨] ユニット内の |
v1.31.0-aliyun.6.7.0.740ba623 | 2024年11月4日 | Capacity Scheduling:ElasticQuotaTree が存在しない場合でもエラスティッククォータのプリエンプションがトリガーされる問題を修正。カスタムエラスティックリソースの優先度ベースのスケジューリング:ACS タイプユニットのサポートを追加。 |
v1.31.0-aliyun.6.6.1.5bd14ab0 | 2024年10月22日 | PodTopologySpread によって時折無効なスコアが発生する問題を修正。Coscheduling のイベントメッセージを改善し、失敗回数を含めるように変更。仮想ノードのスケジューリング中に発生する不要な警告イベントを削除。ネットワークトポロジー感知スケジューリング:プリエンプション後に Pod がスケジュールできない問題を修正。NUMA トポロジー感知スケジューリング:NUMA トポロジー感知スケジューリングが機能しない問題を修正。 |
v1.31.0-aliyun.6.6.0.ba473715 | 2024年9月13日 | バージョン 1.31 の ACK クラスターにおける、これまでのすべての機能の初期サポート。 |
バージョン 1.30 の変更履歴
バージョン | リリース日 | 変更内容 |
v1.30.3-apsara.6.11.7.3cfed0f9 | 2025年12月10日 | バグ修正: オートスケーリングの効率を向上。ACS インスタンスの作成時にスケジューラが Pod の Scheduled 条件を更新しないように変更。再起動後に ACS の GPU パーティションの読み取りに失敗する問題を修正。 |
v1.30.3-apsara.6.11.6.a298df6b | 2025年11月10日 | 新機能: |
v1.30.3-apsara.6.11.3.bc707580 | 2025年10月23日 | バグ修正: |
v1.30.3-apsara.6.11.2.463d59c9 | 2025年9月15日 | バグ修正: Pod 内の複数のコンテナが |
v1.30.3-aliyun.6.11.1.c005a0b0 | 2025年7月25日 | ElasticResource を使用した ECI エラスティックスケジューリングの実装 (廃止) が機能しない問題を修正。 |
v1.30.3-aliyun.6.11.0.84cdcafb | 2025年7月18日 | NodeReady の同時変更に対する GOAT スケジューリングの決定性を向上。PodGroup CR の再作成時の誤ったギャング Pod のカウントを修正。ElasticQuota のプリエンプションロジックを修正。ノードの残り IP アドレスを感知するスケジューリングを修正。バージョン 6.9.x 以降で機能していなかった |
v1.30.3-aliyun.6.9.4.818b6506 | 2025年6月4日 | InterPodAffinity および PodTopologySpread が無効になる問題を修正。ResourcePolicy のスケジューリングの異常を修正。ElasticQuota のプリエンプションの問題を修正。 |
v1.30.3-aliyun.6.9.3.ce7e2faf | 2025年5月14日 | オートスケーリングノードプールとのスケジューラの相互作用を改善。ResourcePolicy における誤った Pod カウントを修正。サーバーレスコンピューティングと WaitForFirstConsumer ディスクを使用した場合の潜在的なクラウドディスクのリークを修正。 |
v1.30.3-aliyun.6.8.6.40d5fdf4 | 2025年4月2日 | ACK サーバーレスクラスターにおいて、WaitForFirstConsumer クラウドディスクが CSI プラグイン経由で作成されない問題を修正。 |
v1.30.3-aliyun.6.9.0.f08e56a7 | 2025年2月28日 | ノードの残り IP アドレスを感知するスケジューリングのサポートを追加。Kube Queue タスクがデキューされる前にリソースをチェックするプラグインを追加。コンポーネント設定を通じたプリエンプションアルゴリズムの切り替えサポートを追加。 |
v1.30.3-aliyun.6.8.5.af20249c | 2025年2月19日 | ECI または ACS を使用した際のクラウドディスクの反復作成を修正。PodLabels を宣言した後に ResourcePolicy の Max 値が無効になる問題を修正。 |
v1.30.3-aliyun.6.8.4.946f90e8 | 2025年1月2日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ACS GPU のサポートを追加。ACK サーバーレスクラスターで PVC を使用した際の潜在的な ECI インスタンスのリークを修正。Capacity Scheduling:ACS リソース正規化シナリオにおける ElasticQuotaTree の誤った使用を修正。 |
v1.30.3-aliyun.6.8.3.697ce9b5 | 2024年12月16日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:複数の ACS タイプユニットのサポートを追加。 |
v1.30.3-aliyun.6.8.2.a5fa5dbd | 2024年12月5日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ユニット内での PodAnnotations 定義のサポートを追加。 |
v1.30.3-aliyun.6.8.1.6dc0fd75 | 2024年12月2日 | ネットワークトポロジー感知スケジューリングのパフォーマンスを向上。ECI Pod が ECS ノードにスケジュールされる可能性がある問題を修正。負荷感知スケジューリングが DaemonSet Pod を制限しないように変更。 |
v1.30.3-aliyun.6.7.1.d992180a | 2024年11月6日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:Pod 数に基づくトリガー感知スケーリングのサポートを追加。[非推奨] ユニット内の |
v1.30.3-aliyun.6.7.0.da474ec5 | 2024年11月4日 | Capacity Scheduling:ElasticQuotaTree が存在しない場合でもエラスティッククォータのプリエンプションがトリガーされる問題を修正。カスタムエラスティックリソースの優先度ベースのスケジューリング:ACS タイプユニットのサポートを追加。 |
v1.30.3-aliyun.6.6.4.b8940a30 | 2024年10月22日 | PodTopologySpread によって時折無効なスコアが発生する問題を修正。 |
v1.30.3-aliyun.6.6.3.994ade8a | 2024年10月18日 | Coscheduling のイベントメッセージを改善し、失敗回数を含めるように変更。仮想ノードのスケジューリング中に発生する不要な警告イベントを削除。 |
v1.30.3-aliyun.6.6.2.0be67202 | 2024年9月23日 | ネットワークトポロジー感知スケジューリング:プリエンプション後に Pod がスケジュールできない問題を修正。NUMA トポロジー感知スケジューリング:NUMA トポロジー感知スケジューリングが機能しない問題を修正。 |
v1.30.3-aliyun.6.6.1.d98352c6 | 2024年9月11日 | ネットワークトポロジー感知スケジューリングにおけるプリエンプションのサポートを追加。SlurmOperator:Kubernetes および Slurm クラスターにおけるハイブリッドスケジューリングのサポートを追加。Coscheduling:最新のコミュニティ版 CRD バージョンのサポートを追加。 |
v1.30.3-aliyun.6.5.6.fe7bc1d5 | 2024年8月20日 | v1.30.1-aliyun.6.5.1.5dad3be8 で発生した、Pod アフィニティ / Pod アンチアフィニティのスケジューリングの異常を修正。 |
v1.30.3-aliyun.6.5.5.8b10ee7c | 2024年8月1日 | コミュニティバージョン v1.30.3 にリベース。 |
v1.30.1-aliyun.6.5.5.fcac2bdf | 2024年8月1日 | Capacity Scheduling:Coscheduling と CapacityScheduling を併用した際のクォータ計算エラーを修正。GPUShare:計算能力スケジューリングノード上の残りリソースの計算エラーを修正。カスタムエラスティックリソースの優先度ベースのスケジューリング:ResourcePolicy と ClusterAutoscaler を併用した際のノードのスケールアウト動作を最適化し、すべてのユニットが Max 値に達した場合はノードがスケールアウトしないように変更。 |
v1.30.1-aliyun.6.5.4.fcac2bdf | 2024年7月22日 | Coscheduling:ECI を使用した際のクォータの統計エラーを修正。「xxx is in cache, so can't be assumed」というエラーが時折発生する問題を修正。 |
v1.30.1-aliyun.6.5.3.9adaeb31 | 2024年7月10日 | v1.30.1-aliyun.6.5.1.5dad3be8 で発生した、Pod が長期間 Pending 状態のままになる問題を修正。 |
v1.30.1-aliyun.6.5.1.5dad3be8 | 2024年6月27日 | Coscheduling:スケジューリングのパフォーマンスを向上。シーケンシャルな Pod のスケジューリングのサポートを追加。スケジューリングのパフォーマンスを向上させるための同値クラス (equivalence classes) 宣言のサポートを追加。PreEnqueue を使用して既存のスケジューラプラグインを最適化。 |
v1.30.1-aliyun.6.4.7.6643d15f | 2024年5月31日 | バージョン 1.30 の ACK クラスターにおける、これまでのすべての機能の初期サポート。 |
バージョン 1.28 の変更履歴
バージョン | リリース日 | 変更内容 |
v1.28.12-apsara-6.11.5.db9be0f5 | 2025年10月20日 | バグ修正: |
v1.28.12-apsara-6.11.4.a48c5b6c | 2025年9月15日 | バグ修正: Pod 内の複数のコンテナが |
v1.28.12-apsara-6.11.3.1a06b13e | 2025年9月9日 | 新機能: ElasticQuotaTree が |
v1.28.12-aliyun-6.11.1.f23c663c | 2025年7月25日 | ElasticResource を使用した ECI エラスティックスケジューリングの実装 (廃止) が機能しない問題を修正しました。 |
v1.28.12-aliyun-6.11.0.4003ef92 | 2025年7月18日 | 同時実行の NodeReady 変更に対する GOAT スケジューリングの決定性を向上させました。PodGroup CR 再作成時の誤ったギャング Pod 数を修正しました。ElasticQuota プリエンプションロジックを修正しました。残りの IP 感知スケジューリングを修正しました。バージョン 6.9.x 以降で破損していた |
v1.28.12-aliyun-6.9.4.206fc5f8 | 2025年6月4日 | InterPodAffinity および PodTopologySpread が無効になる問題を修正しました。ResourcePolicy スケジューリングの異常を修正しました。ElasticQuota プリエンプションの問題を修正しました。 |
v1.28.12-aliyun-6.9.3.cd73f3fe | 2025年5月14日 | オートスケーリングノードプールとのスケジューラの対話を改善しました。ResourcePolicy の誤った Pod 数を修正しました。WaitForFirstConsumer ディスクとサーバーレスコンピューティングによる潜在的なクラウドディスクのリークを修正しました。 |
v1.28.12-aliyun-6.8.6.5f05e0ac | 2025年4月2日 | ACK サーバーレスクラスターにおいて、WaitForFirstConsumer クラウドディスクが CSI プラグイン経由で作成されない問題を修正しました。 |
v1.28.12-aliyun-6.9.0.6a13fa65 | 2025年2月28日 | ノードの残りの IP 感知スケジューリングのサポートを追加しました。Kube Queue タスクがデキューされる前にリソースをチェックするプラグインを追加しました。コンポーネント設定を介してプリエンプションアルゴリズムを切り替えるサポートを追加しました。 |
v1.28.12-aliyun-6.8.5.b6aef0d1 | 2025年2月19日 | ECI または ACS の使用時にディスクが繰り返し作成される問題を修正しました。PodLabels の宣言後に ResourcePolicy の Max 値が無効になる問題を修正しました。 |
v1.28.12-aliyun-6.8.4.b27c0009 | 2025年1月2日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ACS GPU のサポートを追加しました。ACK サーバーレスクラスターで PVC が使用された場合の潜在的な ECI インスタンスのリークを修正しました。Capacity Scheduling:ACS リソース正規化シナリオにおける ElasticQuotaTree の誤った使用を修正しました。 |
v1.28.12-aliyun-6.8.3.70c756e1 | 2024年12月16日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:複数の ACS タイプのユニットのサポートを追加しました。 |
v1.28.12-aliyun-6.8.2.9a307479 | 2024年12月5日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ユニット内での PodAnnotations の定義のサポートを追加しました。 |
v1.28.12-aliyun-6.8.1.db6cdeb8 | 2024年12月2日 | ネットワークトポロジー感知スケジューリングのパフォーマンスを向上させました。ECI Pod が ECS ノードにスケジュールされる可能性がある問題を修正しました。負荷感知スケジューリングが DaemonSet Pod を制限しなくなりました。 |
v1.28.12-aliyun-6.7.1.44345748 | 2024年11月6日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:エラスティックスケーリングをトリガーする Pod 数の検出のサポートを追加しました。[非推奨] ユニット内の |
v1.28.12-aliyun-6.7.0.b97fca02 | 2024年11月4日 | Capacity Scheduling:ElasticQuotaTree が存在しない場合でも、エラスティッククォータのプリエンプションがトリガーされる問題を修正しました。カスタムエラスティックリソースの優先度ベースのスケジューリング:ACS タイプのユニットのサポートを追加しました。 |
v1.28.12-aliyun-6.6.4.e535a698 | 2024年10月22日 | PodTopologySpread によって、無効なスコアが時折発生する問題を修正しました。 |
v1.28.12-aliyun-6.6.3.188f750b | 2024年10月11日 | 失敗回数を含めるように Coscheduling イベントメッセージを改善しました。仮想ノードのスケジューリング中に発生する不要な警告イベントを削除しました。 |
v1.28.12-aliyun-6.6.2.054ec1f5 | 2024年9月23日 | ネットワークトポロジー感知スケジューリング:プリエンプション後に Pod をスケジュールできない問題を修正しました。NUMA トポロジー感知スケジューリング:NUMA トポロジー感知スケジューリングが機能しない問題を修正しました。 |
v1.28.12-aliyun-6.6.1.348b251d | 2024年9月11日 | ネットワークトポロジー感知スケジューリングでのプリエンプションのサポートを追加しました。SlurmOperator:Kubernetes および Slurm クラスターでのハイブリッドスケジューリングのサポートを追加しました。 |
v1.28.12-aliyun-6.5.4.79e08301 | 2024年8月20日 | v1.28.3-aliyun-6.5.1.364d020b で導入された異常な Pod アフィニティ / Pod アンチアフィニティのスケジューリングの問題を修正しました。 |
v1.28.12-aliyun-6.5.3.aefde017 | 2024年8月1日 | コミュニティバージョン v1.28.12 にリベースしました。 |
v1.28.3-aliyun-6.5.3.79e08301 | 2024年8月1日 | Capacity Scheduling:Coscheduling と CapacityScheduling を併用した際のクォータ計算エラーを修正しました。GPUShare:コンピューティング能力スケジューリングノードの残りのリソースの計算エラーを修正しました。カスタムエラスティックリソースの優先度ベースのスケジューリング:ResourcePolicy と ClusterAutoscaler を併用した際のノードのスケールアウトの動作を最適化しました。 |
v1.28.3-aliyun-6.5.2.7ff57682 | 2024年7月22日 | Coscheduling:ECI 使用時のクォータ統計エラーを修正しました。時折発生する「xxx is in cache, so can't be assumed」エラーを修正しました。v1.28.3-aliyun-6.5.1.364d020b で導入された、Pod が長期間 Pending 状態にとどまる問題を修正しました。 |
v1.28.3-aliyun-6.5.1.364d020b | 2024年6月27日 | Coscheduling:スケジューリングのパフォーマンスを向上させました。順次 Pod スケジューリングのサポートを追加しました。同値クラスの宣言のサポートを追加しました。PreEnqueue を使用して既存のスケジューラプラグインを最適化しました。 |
v1.28.3-aliyun-6.4.7.0f47500a | 2024年5月24日 | ネットワークトポロジー感知スケジューリング:時折発生するスケジューリングの失敗を修正しました。 |
v1.28.3-aliyun-6.4.6.f32dc398 | 2024年5月16日 | 共有 GPU スケジューリング:LINGJUN クラスターにおいて、 |
v1.28.3-aliyun-6.4.5.a8b4a599 | 2024年5月9日 | NUMA 共同スケジューリング:NUMA 共同割り当て API を更新しました。詳細は、「NUMA トポロジー感知スケジューリングの有効化」をご参照ください。 |
v1.28.3-aliyun-6.4.3.f57771d7 | 2024年3月18日 | 共有 GPU スケジューリング:ConfigMap を使用したカード分離の指定のサポートを追加しました。カスタムエラスティックリソースの優先度ベースのスケジューリング:エラスティックリソースタイプのサポートを追加しました。 |
v1.28.3-aliyun-6.4.2.25bc61fb | 2024年3月1日 | デフォルトで SchedulerQueueingHints 機能を無効にしました。詳細は、「Pull Request #122291」をご参照ください。 |
v1.28.3-aliyun-6.4.1.c7db7450 | 2024年2月21日 | NUMA 共同割り当てのサポートを追加しました。カスタムエラスティックリソースの優先度ベースのスケジューリング:ユニット間の待機のサポートを追加しました。誤った IP 数によりスケジュール可能な Pod 数が減少する、残りの IP 感知スケジューリングの問題を修正しました。 |
v1.28.3-aliyun-6.3.1ab2185e | 2024年1月10日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ECI ゾーンアフィニティと離散化が機能しない問題を修正しました。CPU トポロジー感知スケジューリング:単一の Pod に同じ CPU コアが繰り返し割り当てられ、Pod が起動しなくなる問題を修正しました。ECI エラスティックスケジューリング: |
v1.28.3-aliyun-6.2.84d57ad9 | 2023年12月21日 | カスタムエラスティックリソースの優先度ベースのスケジューリング:ロールアウト中に異なるアプリケーションバージョンを自動的にグループ化する MatchLabelKeys のサポートを追加しました。 |
v1.28.3-aliyun-6.1.ac950aa0 | 2023年12月13日 | Capacity Scheduling: |
v1.28.3-aliyun-5.8-89c55520 | 2023年10月28日 | バージョン 1.28 の ACK クラスターにおいて、これまでのすべての機能の初期サポートを追加しました。 |
バージョン 1.26 の変更履歴
バージョン 1.24 の変更履歴
バージョン 1.22 の変更履歴
バージョン 1.20 の変更履歴
バージョン 1.18 の変更履歴
バージョン | リリース日 | 変更内容 |
v1.18-ack-4.0 | 2021年9月2日 | 負荷感知スケジューリングのサポートを追加しました。 |
v1.18-ack-3.1 | 2021年6月5日 | ECI スケジューリングをノードプールと互換性があるようにしました。 |
v1.18-ack-3.0 | 2021年3月12日 | ECI と ECS の統合スケジューリングのサポートを追加しました。 |
v1.18-ack-2.0 | 2020年11月30日 | GPU トポロジー感知スケジューリングと共有 GPU スケジューリングのサポートを追加しました。 |
v1.18-ack-1.0 | 2020年9月24日 | CPU トポロジー感知スケジューリングと Coscheduling のサポートを追加しました。 |