Todos os produtos
Search
Central de documentação

Container Service for Kubernetes:Configure Managed Service for Prometheus

Última atualização: Jun 27, 2026

Integre o Managed Service for Prometheus para coletar métricas do plano de controle, dos nós e das aplicações do seu cluster ACK, melhorando a eficiência do gerenciamento de desempenho com painéis visuais e alertas em tempo real.

Escolha uma edição

O Managed Service for Prometheus integra-se totalmente ao ecossistema open-source do Prometheus e oferece um serviço de monitoramento totalmente gerenciado. Não é necessário gerenciar o armazenamento de dados subjacente, a visualização de dados ou as operações e manutenção.

  • Pro Edition (Recomendada): Oferece período de retenção de métricas de 90 dias, coletores totalmente gerenciados e SLA de nível de produção de 99,95%. Inclui painéis do Grafana personalizáveis e regras de alerta pré-configuradas para componentes do Container Service for Kubernetes (ACK). Para mais informações, consulte Usar o Container Monitoring Pro Edition.

  • Basic Edition: Disponibiliza retenção de métricas por 7 dias. Você deve manter os coletores e apenas painéis básicos são fornecidos.

Ative o monitoramento do Prometheus

Cluster existente

  1. (Opcional) Para um cluster dedicado ACK, primeiro conceda permissões de monitoramento ao cluster.

  2. Na página Clusters, clique em no nome do cluster desejado. No painel de navegação à esquerda da página de detalhes do cluster, escolha Operations > Prometheus Monitoring.

  3. Na página Prometheus Monitoring, selecione uma edição de monitoramento de contêineres e clique em Install.

    Após ativar o monitoramento, as métricas básicas padrão são coletadas automaticamente. Para coletar métricas personalizadas, consulte Coletar métricas personalizadas . É possível visualizar diversos painéis pré-configurados na página atual, como Cluster Overview , Node Monitoring , Application Monitoring , Network Monitoring e Storage Monitoring .

Novo cluster

  • Cluster gerenciado ACK (Pro Edition):

    Na etapa Component Configurations do assistente de criação de cluster, na seção Container Monitoring, selecione Container Cluster Monitoring Pro Edition ou Container Cluster Monitoring Basic Edition. Para mais informações, consulte Crie um cluster gerenciado ACK.

    O Auto Mode usa por padrão o Container Cluster Monitoring Basic Edition.
  • Cluster gerenciado ACK (Basic Edition), clusters ACS e clusters ACK Serverless:

    Na etapa Component Configurations do assistente de criação de cluster, na seção Container Monitoring, selecione Enable Managed Service for Prometheus. Essa ação instale o Container Cluster Monitoring Basic Edition.

    Após ativar o monitoramento, as métricas básicas padrão são coletadas automaticamente. Para coletar métricas personalizadas, consulte Coletar métricas personalizadas . Vários painéis pré-configurados ficam disponíveis, como Cluster Overview , Node Monitoring , Application Monitoring , Network Monitoring e Storage Monitoring , acessíveis pelo menu Operations > Prometheus Monitoring no painel de navegação à esquerda da página de detalhes do cluster.

Configure notificações de alerta

Configure regras de alerta para métricas essenciais a fim de enviar notificações automaticamente por canais como e-mail, SMS ou DingTalk quando ocorrerem anomalias.

  1. Faça login no console do ARMS. No painel de navegação à esquerda, escolha Alert Management > Notification Objects.

  2. Na página Notification Objects, selecione um método de notificação e crie uma política de notificação.

  3. No painel de navegação à esquerda do console do ARMS, escolha Prometheus Monitoring > Prometheus alert rules.

  4. Na página Prometheus alert rules, clique em Create Prometheus Alert Rule.

    Para instruções detalhadas de configuração, consulte Crie uma regra de alerta do Prometheus .

Coletar métricas personalizadas

O Managed Service for Prometheus suporta vários métodos para coletar métricas personalizadas, como consultas por segundo (QPS) e latência de processamento. Para mais informações, consulte Gerencie regras de coleta personalizadas para ambientes de contêineres.

Desativar o monitoramento do Prometheus

  1. No painel de navegação à esquerda da página de detalhes do cluster, clique em Add-ons.

  2. Na página Add-ons, clique em na aba Logs and Monitoring, localize o componente ack-arms-prometheus e clique em Uninstall. Na caixa de diálogo de confirmação, clique em OK.

Faturamento

  • Taxas de monitoramento de cluster: A Basic Edition é gratuita. A Pro Edition é cobrada no modelo de pagamento conforme o uso, com base no número de nós do cluster.

  • Taxas de instância do Prometheus: A coleta de métricas básicas é gratuita por padrão. A coleta de métricas personalizadas segue o modelo de pagamento conforme o uso, considerando fatores como volume de escrita, volume de relatórios, volume de armazenamento e período de retenção.

Para regras de faturamento e preços detalhados, consulte Faturamento do Container Monitoring.

Métricas básicas padrão

Ao ativar o monitoramento do Prometheus, as métricas básicas para monitoramento de contêineres são coletadas automaticamente. Para descrições detalhadas dessas métricas, consulte Métricas.

  • Métricas básicas de recursos de contêineres provenientes do kubelet.

  • Métricas de estado de aplicações dos clusters via kube-state-metrics.

  • Métricas básicas de recursos dos nós do cluster coletadas pelo node-exporter.

  • Métricas de GPU dos nós do cluster fornecidas pelo ack-gpu-exporter.

  • Métricas dos componentes do plano de controle de clusters gerenciados, incluindo API server, etcd, kube-scheduler, kube-controller-manager e cloud-controller-manager.

  • Métricas básicas de monitoramento do CoreDNS no cluster.

  • Métricas básicas de monitoramento dos controladores de Ingress no cluster.

  • As seguintes métricas básicas são relatadas automaticamente após a ativação dos recursos correspondentes:

Perguntas frequentes

A página Prometheus Monitoring não exibe nenhum painel

Caso visualize o aviso No related monitoring dashboard found na página Operations > Prometheus Monitoring após ativar o monitoramento do Prometheus, siga estas etapas para resolver o problema.

  1. Reinstale o componente de monitoramento do Prometheus.

    1. Desative o monitoramento do Prometheus.

    2. Reinstale o componente:

      1. Após confirme que o componente foi desinstalado, clique em Install. Na caixa de diálogo de confirmação, clique em OK.

      2. Quando a instalação for concluída, retorne à página Prometheus Monitoring para verificar se o problema foi resolvido.

        Se o problema persistir, prossiga com as etapas a seguir.

  2. Verifique a integração da instância do Prometheus.

    1. No painel de navegação à esquerda do console do ARMS, clique em Integration Management.

    2. Na aba Integrations, verifique na lista Container Service se existe um ambiente de contêiner com o mesmo nome do seu cluster.

      • Se esse ambiente de contêiner não existir, consulte Integrar um serviço no console do ARMS ou do Prometheus.

      • Caso o ambiente exista, clique em Settings na coluna Actions do ambiente de contêiner desejado para acesse a página Settings.

        Verifique se o agente instalado está funcionando conforme esperado.

Como ajustar o período de retenção de métricas

Para mais informações, consulte Ajustar o período de retenção de métricas.

Como visualize a versão do componente ack-arms-prometheus

  1. Na página Clusters, clique em no nome do cluster desejado. No painel de navegação à esquerda, clique em Add-ons.

  2. Na página Add-ons, clique em na aba Logs and Monitoring e localize o componente ack-arms-prometheus.

    A versão atual aparece abaixo do nome do componente. Se houver uma versão mais recente disponível e você desejar atualizar o componente, clique em Upgrade ao lado do número da versão.

    Nota

    A opção Upgrade só é exibida se a versão instalada não for a mais recente.

Por que a implantação do monitoramento de GPU falha?

A implantação do monitoramento de GPU pode falhar se o nó GPU possuir taints. Para resolver esse problema, verifique primeiro os taints do nó.

  1. Execute o comando a seguir para verificar os taints do nó GPU desejado.

    Se o nó GPU tiver taints personalizados, você encontrará as entradas relacionadas. Este exemplo usa um taint com key igual a test-key, value igual a test-value e effect definido como NoSchedule:

    kubectl describe node cn-beijing.47.100.***.***

    Saída esperada:

    Taints:test-key=test-value:NoSchedule
  2. Trate os taints do nó GPU de uma das duas formas a seguir:

    • Execute o comando abaixo para remover o taint do nó GPU.

      kubectl taint node cn-beijing.47.100.***.*** test-key=test-value:NoSchedule-
    • Declare uma tolerância para o taint, permitindo que pods sejam agendados no nó.

      # 1. Run the following command to edit the ack-prometheus-gpu-exporter DaemonSet.
      kubectl edit daemonset -n arms-prom ack-prometheus-gpu-exporter
      
      # 2. Add the following fields to the YAML file to declare the toleration for the taint.
      # Other fields are omitted.
      # The `tolerations` field is added above the `containers` field and at the same level.
      tolerations:
      - key: "test-key"
        operator: "Equal"
        value: "test-value"
        effect: "NoSchedule"
      containers:
      # Other fields are omitted.

Como desinstalar completamente o ARMS Prometheus

Excluir apenas o namespace do Managed Service for Prometheus deixa configurações residuais após a remoção dos recursos, o que afeta a reinstalação. Execute as operações a seguir para exclua manualmente e por completo as configurações residuais do ARMS-Prometheus.

  • Exclua o namespace arms-prom.

    kubectl delete namespace arms-prom
  • Exclua os ClusterRoles.

    kubectl delete ClusterRole arms-kube-state-metrics
    kubectl delete ClusterRole arms-node-exporter
    kubectl delete ClusterRole arms-prom-ack-arms-prometheus-role
    kubectl delete ClusterRole arms-prometheus-oper3
    kubectl delete ClusterRole arms-prometheus-ack-arms-prometheus-role
    kubectl delete ClusterRole arms-pilot-prom-k8s
    kubectl delete ClusterRole gpu-prometheus-exporter
    kubectl delete ClusterRole o11y:addon-controller:role
    kubectl delete ClusterRole arms-aliyunserviceroleforarms-clusterrole
  • Exclua os ClusterRoleBindings.

    kubectl delete ClusterRoleBinding arms-node-exporter
    kubectl delete ClusterRoleBinding arms-prom-ack-arms-prometheus-role-binding
    kubectl delete ClusterRoleBinding arms-prometheus-oper-bind2
    kubectl delete ClusterRoleBinding arms-kube-state-metrics
    kubectl delete ClusterRoleBinding arms-pilot-prom-k8s
    kubectl delete ClusterRoleBinding arms-prometheus-ack-arms-prometheus-role-binding
    kubectl delete ClusterRoleBinding gpu-prometheus-exporter
    kubectl delete ClusterRoleBinding o11y:addon-controller:rolebinding
    kubectl delete ClusterRoleBinding arms-kube-state-metrics-agent
    kubectl delete ClusterRoleBinding arms-node-exporter-agent
    kubectl delete ClusterRoleBinding arms-aliyunserviceroleforarms-clusterrolebinding
  • Exclua os Roles e RoleBindings.

    kubectl delete Role arms-pilot-prom-spec-ns-k8s
    kubectl delete Role arms-pilot-prom-spec-ns-k8s -n kube-system
    kubectl delete RoleBinding arms-pilot-prom-spec-ns-k8s
    kubectl delete RoleBinding arms-pilot-prom-spec-ns-k8s -n kube-system

Como desinstalar usando o Helm

Utilize este método para desinstalar o serviço caso você o tenha implantado manualmente via Helm ou se houver recursos residuais devido a problemas de ambiente ou versão do Helm.

  1. Na página Clusters, clique em no nome do cluster desejado. No painel de navegação à esquerda, escolha Applications > Helm.

  2. Na página Helm, localize o release ack-arms-prometheus, clique em Delete na coluna Actions, selecione Clear Release Records e exclua a aplicação conforme solicitado.

Erro "xxx in use" durante a instalação

  1. Na página Clusters, clique em no nome do cluster desejado. No painel de navegação à esquerda, escolha Applications > Helm.

  2. Na página Helm, verifique se o ack-arms-prometheus existe.

Erro "Component Not Installed" durante a instalação

  • Verifique se o componente ack-arms-prometheus está instalado.

    1. Na página Clusters, clique em no nome do cluster desejado. No painel de navegação à esquerda, escolha Applications > Helm.

    2. Na página Helm, verifique se o ack-arms-prometheus existe.

  • Verifique se há erros nos logs do ack-arms-prometheus.

    1. No painel de navegação à esquerda da página de detalhes do cluster, escolha Workloads > Deployments.

    2. No topo da página Deployments, defina o Namespace como arms-prom e clique em arms-prometheus-ack-arms-prometheus.

    3. Clique em na aba Logs para verificar se há erros nos logs.

  • Verifique se ocorreu algum erro durante a instalação do agente.

    1. Faça login no console do ARMS. No painel de navegação à esquerda, clique em Integration Management.

    2. Na aba Integrations, verifique a lista Container Service. Na coluna Actions do ambiente de contêiner desejado, clique em Settings para acesse a página Settings.

Como conceder permissões de monitoramento para clusters dedicados ACK

  1. Na página Clusters, clique em no nome do cluster desejado. No painel de navegação à esquerda, clique em Cluster Information.

  2. Na aba Basic Information, clique em no link KubernetesWorkerRole-*** ao lado de Worker RAM Role. Na página da função RAM, na aba Permission Management, clique em no link k8sWorkerRole**** na coluna Policies.

  3. Na página de detalhes da política, clique em na aba Policy Content e depois em Edit Policy Document.

  4. No editor de scripts, adicione a seguinte regra de autorização ao campo Statement e clique em OK.

    {
        "Version": "1",
        "Statement": [
            {
                "Action": [
                    "arms:Describe*",
                    "arms:List*",
                    "arms:Get*",
                    "arms:Search*",
                    "arms:Check*",
                    "arms:Query*",
                    "arms:ListEnvironments",
                    "arms:DescribeAddonRelease",
                    "arms:InstallAddon",
                    "arms:DeleteAddonRelease",
                    "arms:ListEnvironmentDashboards",
                    "arms:ListAddonReleases",
                    "arms:CreateEnvironment",
                    "arms:UpdateEnvironment",
                    "arms:InitEnvironment",
                    "arms:DescribeEnvironment",
                    "arms:InstallEnvironmentFeature",
                    "arms:ListEnvironmentFeatures",
                    "cms:CreateIntegrationPolicy",
                    "cms:ListAddonReleases",
                    "cms:UpdateAddonRelease",
                    "cms:CreateAddonRelease",
                    "cms:GetPrometheusInstance",
                    "cms:ListIntegrationPolicyStorageRequirements"
                ],
                "Resource": "*",
                "Effect": "Allow"
            }
        ]
    }

Tópicos relacionados

Atualizar o Managed Service for Prometheus da Basic Edition para a Pro Edition