Définissez le nombre minimal d'instances d'une fonction sur une valeur supérieure à 0 pour préallouer des ressources élastiques. Cette configuration évite la latence des requêtes due aux démarrages à froid lors des pics de charge. Vous pouvez également configurer des politiques pour ajuster automatiquement ce nombre minimal selon un planning ou des seuils de métriques, garantissant ainsi des performances élevées et une meilleure utilisation des instances.
Lorsque vous définissez le paramètre Minimum Instances sur une valeur supérieure à 0, les instances préallouées s'exécutent en continu (24h/24 et 7j/7). Ces instances sont facturées même si la fonction ne reçoit aucune requête d'invocation. La facturation repose sur le prix unitaire des instances élastiques actives ou inactives, et la règle de facturation minimale horaire peut s'appliquer. Pour plus d'informations sur la facturation des instances élastiques actives et inactives, consultez Vue d'ensemble de la facturation.
Pour arrêter les frais liés aux instances préallouées, définissez le paramètre Minimum Instances sur 0, ou supprimez la politique élastique ou la fonction correspondante.
En l'absence de politique élastique configurée (le paramètre Minimum Instances est à 0), votre fonction reste invocable normalement. Le seul impact est le déclenchement d'un démarrage à froid à chaque arrivée de requête, ce qui peut entraîner une latence supplémentaire.
Les politiques élastiques pour le nombre minimal d'instances ne peuvent être configurées que pour un alias de fonction ou la version LATEST.
Définir le nombre minimal d'instances
Connectez-vous à la console Function Compute. Dans le volet de navigation de gauche, choisissez .
Dans la barre de navigation supérieure, sélectionnez une région. Sur la page Functions, cliquez sur Create Function.
Sur la page Create Function, dans la section Scaling Policy, définissez le paramètre Minimum Instances, configurez les autres paramètres requis, puis cliquez sur Create.
Configurer des politiques élastiques
Sur la page de détails de la fonction cible, cliquez sur l'onglet Scaling Policy. Dans la section Elastic policy, repérez la politique souhaitée et cliquez sur Modify dans la colonne Actions.
-
Dans le panneau Edit elastic policy, configurez une politique élastique dynamique pour le nombre minimal d'instances.
RemarqueSi plusieurs politiques élastiques sont configurées, le système calcule le nombre de Minimum Instances pour chaque politique déclenchée. Il retient ensuite la valeur maximale parmi tous les paramètres Minimum Instances des politiques actuellement actives comme nombre minimal d'instances courant. Pour plus d'informations, consultez Comment le nombre minimal d'instances actuel est-il calculé ?.
Tant qu'une politique élastique est active, le paramètre initial de Minimum Instances est ignoré. Si aucune politique élastique n'est active, le nombre minimal d'instances courant revient à la valeur initiale définie pour le paramètre Minimum Instances.
-
Configurez une politique de Scheduled Scaling ou de Water-level Scaling
Mise à l'échelle planifiée
Une politique de mise à l'échelle planifiée convient aux fonctions présentant des schémas périodiques clairs ou des pics de trafic prévisibles. Lorsque le nombre d'invocations simultanées dépasse le nombre minimal d'instances, les requêtes excédentaires sont automatiquement traitées par des instances élastiques à la demande. Pour plus d'informations, consultez Mise à l'échelle planifiée.
Cet exemple définit le paramètre Time zone sur Asia/Shanghai (UTC+8). La politique est permanente : elle augmente le nombre minimal d'instances à 50 à 10h00 du lundi au vendredi, puis le réduit à 5 à 22h00.
Mise à l'échelle basée sur des seuils
Le système collecte périodiquement des métriques telles que l'Provisioned concurrency utilization, l'Memory utilization ou les métriques d'utilisation des ressources pour les instances GPU. Lorsqu'une condition spécifiée est remplie, le système ajuste le nombre de Minimum Instances en conséquence. Pour plus d'informations, consultez Mise à l'échelle basée sur des seuils.
Définissez le Minimum Number of Instances sur
1. Ensuite, dans la section Minimum Number of Instances Dynamic Policy, sélectionnez l'onglet Threshold-based Scaling pour configurer la politique.Cet exemple définit le paramètre Time zone sur Asia/Shanghai (UTC+8). La politique est active du 15 juillet 2025 à 00h00 au 31 juillet 2025 à 00h00. Elle suit la métrique d'Provisioned concurrency utilization avec une valeur cible de 60 %. Lorsque l'utilisation dépasse 60 %, le système monte en charge jusqu'à un maximum de 100 instances. Lorsqu'elle descend sous 60 %, il réduit la capacité à un minimum de 10 instances.
Pour les fonctions CPU, la mise à l'échelle basée sur des seuils surveille des métriques comme l'Provisioned concurrency utilization et l'Memory utilization. Pour les fonctions GPU, la politique prend en charge la surveillance de l'Provisioned concurrency utilization ainsi que d'autres métriques d'utilisation des ressources liées au GPU, comme détaillé dans le tableau suivant.
Fonctions CPU
Fonctions GPU
Dans la configuration de threshold-based scaling, la liste déroulante Utilization Type propose deux types d'utilisation : instance concurrency utilization et memory utilization. L'onglet Trigger Method inclut également la scheduled scaling.
Dans la configuration de mise à l'échelle basée sur des seuils d'une fonction GPU, le paramètre Utilization Type offre cinq options : instance concurrency utilization, GPU SM utilization, GPU memory utilization, GPU hardware encoder utilization et GPU hardware decoder utilization.
-
Configurez une mise à l'échelle périodique à l'aide d'une CRON Expression
Si votre application présente des schémas de trafic prévisibles, utilisez une expression CRON pour ajuster périodiquement le nombre minimal d'instances. Par exemple, définissez le paramètre Time zone sur Asia/Shanghai (UTC+8) afin d'augmenter le nombre minimal d'instances à 10 tous les lundis à 10h00 et de le réduire à 1 tous les vendredis à 22h00.
Modifier ou supprimer une politique élastique pour le nombre minimal d'instances
Connectez-vous à la console Function Compute. Dans le volet de navigation de gauche, choisissez . Sur la page Elastic policy, localisez la politique à gérer. Dans la colonne Actions, cliquez sur Modify ou Delete pour modifier ou supprimer la politique élastique du nombre minimal d'instances.
La suppression d'une politique élastique pour le nombre minimal d'instances d'un alias libère toutes les instances préallouées associées à cet alias. La fonction bascule alors automatiquement vers une mise à l'échelle à la demande, ce qui peut impliquer un démarrage à froid. Pour les services basés sur CPU, le temps moyen de démarrage à froid est généralement de quelques centaines de millisecondes, selon la vitesse de lancement de l'application. Pour les services basés sur GPU, ce temps peut atteindre plusieurs minutes, en fonction de la taille du modèle et de la vitesse de chargement.
FAQ
Comment vérifier si une fonction dispose d'un nombre minimal d'instances configuré et consulter l'historique de configuration ?
Vérifier la configuration actuelle
Connectez-vous à la console Function Compute. Dans le volet de navigation de gauche, cliquez sur Elastic policy. Sur la page Elastic policy, localisez la fonction cible. Si la colonne Minimum Instances affiche une valeur supérieure à 0, des instances préallouées sont configurées pour cette fonction. Si la colonne affiche - (non configuré) ou 0, aucune instance préallouée n'est active.
Consulter l'historique de configuration
Connectez-vous à la console Function Compute. Dans le volet de navigation de gauche, cliquez sur Monitoring Metrics. Sur le tableau de bord de surveillance, localisez le graphique de la métrique Minimum Instances. Ajustez la plage de temps de la requête (par exemple, passez de 2 semaines à 1 semaine) pour correspondre au cycle de facturation à vérifier. Si le graphique affiche des valeurs supérieures à 0 sur une période donnée, cela confirme que le nombre minimal d'instances était configuré durant cet intervalle.
Références
Pour limiter le nombre d'instances d'une fonction spécifique, configurez des quotas de fonction. Si le nombre total d'instances en cours d'exécution pour la fonction dépasse la limite configurée, Function Compute renvoie une erreur de limitation.