Todos os produtos
Search
Central de documentação

Application Real-Time Monitoring Service:Monitore clusters de contêineres multicloud com clusters registrados e o Managed Service for Prometheus

Última atualização: Aug 27, 2026

Conheça os desafios da observabilidade de clusters de contêineres multicloud e saiba como usar o Managed Service for Prometheus da Alibaba Cloud com clusters registrados para gerenciar e monitorar centralmente clusters de contêineres em diferentes provedores de cloud.

Contexto

Com a consolidação do Kubernetes (K8s) como padrão de fato da indústria para orquestração de contêineres, o Prometheus estabeleceu-se como referência no monitoramento de clusters após ampla adoção em ambientes reais.

O Prometheus monitora métricas nos níveis de sistema, aplicação e negócios. Em conjunto com o Grafana, oferece uma solução completa para coleta, armazenamento, visualização e geração de alertas sobre métricas de clusters de contêineres. Isso ajuda você a identificar e localizar problemas para proteger suas aplicações nativas da cloud.

Você tem duas opções para operar e manter clusters de contêineres:

Opção 1: Criar seu próprio sistema de monitoramento

Construa um sistema de monitoramento pronto para produção do zero usando Prometheus e Grafana. Essa abordagem exige investimento inicial significativo em equipe. Além disso, gerencie a integração de todos os componentes, incluindo configuração de coleta de métricas, armazenamento, visualização de dados, configuração eficaz de painéis, definição de alertas e filtragem de alertas inválidos. Isso resulta em custos contínuos elevados de O&M.

Opção 2: Usar um service gerenciado

A Alibaba Cloud oferece o Managed Service for Prometheus, disponível nos modelos de faturamento por assinatura e pagamento conforme o uso. Esse service reduz os altos custos iniciais de criação de um sistema de monitoramento próprio e fornece suporte técnico e de O&M contínuo, o que diminui significativamente sua sobrecarga operacional.

Desafios da observabilidade de clusters de contêineres multicloud

À medida que os services de cloud corporativos se tornam mais diversificados e complexos, é comum que clusters de contêineres abranjam diferentes regiões e provedores de cloud. Isso desloca o foco operacional do gerenciamento de um único cluster para o gerenciamento de múltiplos clusters em um ambiente multicloud.

Você tem duas opções para monitorar clusters de contêineres híbridos e multicloud:

Opção 1: Prometheus e Grafana auto-hospedados

Essa abordagem apresenta vários desafios:

  • Construir um sistema de monitoramento completo exige integrar componentes de coleta, armazenamento, visualização e alertas. A manutenção contínua requer pessoal dedicado, aumentando os custos de O&M.

  • O banco de dados de séries temporais (TSDB) do Prometheus open source armazena dados localmente em um único nó. Isso cria um ponto único de falha e risco de perda de dados.

  • O Prometheus open source possui gargalos de coleta e executa como uma instância única sem dimensionamento elástico. Isso pode causar problemas de desempenho na coleta de dados durante horários de pico.

Opção 2: Usar um service gerenciado de Prometheus

Esta alternativa também enfrenta obstáculos:

  • Compatibilidade entre clouds: diferentes provedores oferecem services de Prometheus com capacidades e experiências de usuário variadas. Isso exige que você invista tempo aprendendo cada plataforma.

  • Gerenciamento descentralizado: o uso combinado de produtos de monitoramento de diversos provedores impede o gerenciamento unificado. Frequentemente, isso gera ineficiência, confusão e tarefas redundantes de O&M, dificultando a detecção rápida de problemas críticos para os negócios.

Ambas as opções compartilham um problema comum: métricas de monitoramento dispersas tornam impossíveis consultas unificadas, análises consolidadas e alertas centralizados.

Benefícios do Managed Service for Prometheus

Os clusters registrados da Alibaba Cloud permitem gerenciar centralmente clusters de contêineres hospedados fora da Alibaba Cloud, resolvendo o gerenciamento descentralizado em ambientes multicloud. O Managed Service for Prometheus da Alibaba Cloud é um sistema abrangente de monitoramento de contêineres que inclui coleta de métricas, visualização via Grafana e alertas. Ele suporta os modelos de faturamento por pagamento conforme o uso e por assinatura, melhorando a eficiência do monitoramento e reduzindo significativamente os custos de O&M em comparação com sistemas auto-hospedados.

A combinação de clusters registrados da Alibaba Cloud com o Managed Service for Prometheus possibilita um monitoramento simples e eficiente de clusters de contêineres multicloud. Os principais benefícios incluem:

  • Capacidades robustas: resolve problemas comuns de monitoramento multicloud, como gerenciamento descentralizado, configuração complexa, baixa eficiência de O&M e incapacidade de unificar consultas e alertas. Oferece gerenciamento, configuração, consulta e alertas unificados para todos os seus clusters de contêineres. Isso aumenta consideravelmente a eficiência do monitoramento e reduz custos com pessoal e tarefas repetitivas, permitindo que sua equipe de O&M foque no negócio.

  • Custo-benefício: o Managed Service for Prometheus da Alibaba Cloud oferece coleta gratuita para métricas básicas, cobrindo as necessidades fundamentais de monitoramento dos seus clusters. Para clusters menores, utilize o modelo de pagamento conforme o uso para monitorar seus services de forma eficaz minimizando custos. Para mais informações sobre o faturamento por pagamento conforme o uso do Managed Service for Prometheus da Alibaba Cloud, consulte pay-as-you-go. Para clusters de grande escala, escolha o modelo de assinatura, que pode reduzir seus custos em cerca de 67% em comparação ao modelo de pagamento conforme o uso, diminuindo significativamente as despesas de monitoramento de grandes ambientes.

  • Baixo consumo de recursos: o Managed Service for Prometheus exige apenas a implantação de um agente leve no seu cluster. O agente suporta dimensionamento elástico automático. Com uma solicitação de recursos de 2 núcleos de CPU e 4 GB de memória, é possível coletar 6 milhões de métricas. O módulo de descoberta de service do Prometheus open source pode sobrecarregar o servidor de API do cluster. O Managed Service for Prometheus da Alibaba Cloud é otimizado para aliviar essa pressão. Essa abordagem minimiza o uso de recursos enquanto maximiza a coleta de métricas de monitoramento para proteger seu negócio.

Benefício 1: Desempenho aprimorado

Item

Managed Service for Prometheus

Prometheus auto-hospedado

Alta disponibilidade

Suporta múltiplas réplicas para componentes de coleta e armazenamento com dimensionamento horizontal para alta disponibilidade.

Por ser um processo único sem capacidade de dimensionamento horizontal, apresenta baixa disponibilidade.

Armazenamento de dados

Baseado em armazenamento em cloud com capacidade ilimitada.

Limitado pela capacidade de armazenamento do host.

Visualização de dados

Inclui um service Grafana integrado com modelos de monitoramento prontos para uso.

Exige implantação separada do Grafana e configuração manual de painéis.

Gerenciamento de alertas

Integra-se ao centro de alertas do ARMS para melhorar a eficiência e precisão dos alertas.

Requer integração manual do plug-in AlertManager.

Desempenho de coleta de uma única réplica (2 núcleos de CPU, 4 GB de memória)

6 milhões de pontos de dados

1 milhão de pontos de dados

Desempenho de consulta de dados (600 milhões de pontos temporais)

8 a 10 segundos

180 segundos

Outras capacidades

Suporta pré-agregação, downsampling e Global View.

Não suportado.

Benefício 2: Consulta agregada multicluster

Uma instância de agregação virtual abrange múltiplas instâncias do Prometheus da Alibaba Cloud ou clusters de Prometheus auto-hospedados, permitindo consultas unificadas, uma fonte de dados Grafana unificada e alertas centralizados para todas as suas métricas do Prometheus.

  • O Prometheus open source exige configurar múltiplos endereços de fontes de dados no Grafana para acessar dados dispersos. As consultas agregadas permitem analisar a integridade global das suas aplicações a partir de uma perspectiva única e unificada.

  • Em vez de implantar um servidor Prometheus em cada região, use o Remote Write para enviar dados ao Managed Service for Prometheus da Alibaba Cloud e utilize o Global View sem implantar componentes do Thanos ou gerenciar dependências adicionais.

  • O recurso de consulta global baseia-se em um mecanismo de consulta distribuído e otimizado para desempenho, que escala horizontal e verticalmente sob demanda, garantindo alto desempenho e estabilidade sob grandes volumes de consulta.

  • Disponível prontamente como parte do Managed Service for Prometheus da Alibaba Cloud, este recurso não exige componentes adicionais, reduzindo significativamente a sobrecarga de O&M.

Benefício 3: Instalação leve

Comparado à instalação do Prometheus open source, o Managed Service for Prometheus da Alibaba Cloud é muito mais simples. Basta instalar um agente leve no seu cluster de contêineres. O armazenamento backend é totalmente gerenciado, o que economiza recursos no seu cluster de negócios.

Benefício 4: Service Grafana integrado

O Managed Service for Grafana da Alibaba Cloud é uma plataforma de visualização de dados nativa da cloud e livre de manutenção, que fornece um ambiente Grafana pronto para uso com os seguintes benefícios:

  • Integra-se por padrão a fontes de dados da Alibaba Cloud, como Managed Service for Prometheus e Log Service (SLS), e suporta fontes de dados de terceiros ou personalizadas para criar um painel unificado de O&M.

  • Fornece instâncias dedicadas com alto SLA, garantindo alta disponibilidade e elasticidade para seu sistema de monitoramento, além de reduzir custos de manutenção.

  • Integra-se ao SSO da conta Alibaba Cloud e a sistemas de contas personalizadas para gerenciamento refinado de fontes de dados e painéis, garantindo a segurança dos dados.

  • Resolve os seguintes problemas:

    • Dificuldade na agregação de dados: dados de monitoramento de vários services de cloud são difíceis de centralizar, aumentando a complexidade de O&M.

    • O&M e monitoramento complexos: gráficos de métricas essenciais para vários services de cloud precisam ser configurados repetidamente.

    • Dificuldade no gerenciamento de alertas: regras de alerta para diferentes services de cloud estão dispersas e não podem ser gerenciadas uniformemente.

  • Oferece as seguintes capacidades:

    • Integrações padrão: integrado por padrão aos services principais da Alibaba Cloud, incluindo Elastic Compute Service (ECS) e bancos de dados.

    • Painéis unificados: estabelece um sistema de painéis unificado em várias fontes de dados para operações visuais mais refinadas.

    • Alertas unificados: crie um sistema de alertas integrado para melhorar a eficiência do gerenciamento de alertas.

Benefício 5: Sistema de alertas integrado

O Managed Service for Prometheus da Alibaba Cloud integra-se por padrão ao sistema unificado de alertas da Alibaba Cloud. Este sistema possui os seguintes recursos:

  • Escopo global

    • Use modelos globais de regras de alerta para configurar alertas para eventos em todo o mundo a partir de um único local.

    • Contatos e políticas de notificação são globais. Configure-os uma vez para aplicá-los em todos os lugares.

  • Gerenciamento mais eficiente de eventos integrados

    • O gerenciamento de alertas suporta integração com um clique com ferramentas comuns de monitoramento da Alibaba Cloud e integração manual com outras ferramentas para manutenção unificada.

    • O módulo de ingestão de eventos é estável e fornece services de processamento de eventos ininterruptos 24/7.

    • Garante processamento de baixa latência para grandes volumes de dados de eventos.

  • Notificações precisas e oportunas para contatos

    • Configure regras de notificação para consolidar eventos antes de enviar notificações. Isso reduz a fadiga de notificações da sua equipe de O&M.

    • Escolha diferentes métodos de notificação, como e-mail, SMS, chamada telefônica ou DingTalk, com base na urgência do alerta.

    • Use políticas de escalonamento para enviar múltiplos lembretes para alertas não tratados, garantindo resolução oportuna.

  • Gerenciamento rápido de alertas

    • Os contatos podem tratar alertas a qualquer momento pelo DingTalk.

    • Um formato universal de alerta ajuda os contatos a analisar alertas com mais eficácia.

    • Vários contatos podem colaborar no tratamento de alertas pelo DingTalk.

  • Reprocessamento de eventos de alerta

    • Use fluxos de processamento de eventos para criar workflows simples que reprocessam eventos de alerta de qualquer source para atender a diferentes necessidades de tratamento de dados.

    • O gerenciamento de eventos suporta deduplicação, compressão, redução de ruído e silenciamento para eventos de alerta de qualquer source. Isso ajuda a convergir alertas e reduzir tempestades de alertas.

  • Gerenciamento de configuração de alertas

    • Fornece modelos de monitoramento para métricas essenciais comuns de clusters de contêineres. Também oferece um recurso de modelo de alerta que permite gerar e aplicar modelos para configuração rápida e em larga escala de alertas.

    • Oferece um processo guiado e visual de configuração de alertas com pré-visualização em tempo real. Veja quais eventos correspondem às condições de alerta em tempo real e ajuste sua configuração.

  • Analise dados de alerta e status de processamento em tempo real para melhorar a eficiência do tratamento de alertas e obter insights sobre as operações do seu negócio.

Exemplo: Conexão de um cluster de contêineres multicloud ao Managed Service for Prometheus

Pré-requisitos

Os clusters podem ser conectados via redes públicas ou internas. Para mais informações, consulte FAQ about registered clusters.

Etapa 1: Criar um cluster registrado ACK One

  1. Faça login no ACK console. No painel de navegação à esquerda, clique em Clusters.

  2. Na página Clusters, clique em Create Kubernetes Cluster.

  3. Na aba ACK One Registered Cluster, configure os parâmetros. Para mais informações sobre os parâmetros, consulte Create an ACK One registered cluster.

  4. No painel à direita, clique em Create Cluster. Visualize o cluster registrado criado na página Clusters. O cluster estará no status Pending.

Etapa 2: Conectar o cluster multicloud

Este exemplo conecta um cluster Kubernetes da Tencent Cloud a um cluster registrado ACK One para gerenciamento unificado, habilitando a extração e visualização de métricas por meio do Managed Service for Prometheus.

  1. Faça login no ACK console. Na página Clusters, localize o cluster registrado criado em Step 1: Create an ACK One registered cluster e clique em Details na coluna Operation.

  2. Clique na aba Connection Information. Clique em Obtain Temporary kubeconfig ou Obtain Long-term kubeconfig conforme sua necessidade. Na caixa de diálogo exibida, selecione a aba Internal Access ou Public Access e clique em Copy para copiar as credenciais do cluster.

  3. Faça login no console do service de contêineres da Tencent Cloud. Na página Cluster, clique no nome do cluster alvo. No canto superior direito, clique em Create Resource from YAML. Cole as credenciais de acesso público copiadas na etapa anterior no editor e clique em Finish para instalar o agente. Em seguida, na página Cluster da Tencent Cloud, verifique o status do Deployment ack-cluster-agent. Se estiver em execução, o agente foi instalado com sucesso.

  4. Faça login no ACK console. da Alibaba Cloud. Na página Clusters, verifique o status do cluster registrado criado em Step 1: Create an ACK One registered cluster. Se o status for Running, o cluster está conectado e gerenciado com sucesso.

Etapa 3: Instalar o componente Prometheus

Para instruções detalhadas, consulte Connect an Alibaba Cloud Prometheus instance to a registered cluster.

Etapa 4: Visualizar dados de monitoramento

O Managed Service for Prometheus inclui painéis Grafana padrão para recursos comuns, como Deployments e DaemonSets. Para visualizar seus dados de monitoramento, execute as seguintes etapas:

  1. Faça login no ARMS console. No painel de navegação à esquerda, escolha Managed Service for Prometheus > Instances.

  2. Clique na instância do Prometheus referente ao cluster registrado criado em Step 1: Create an ACK One registered cluster.

  3. No painel de navegação à esquerda, clique em Dashboards. Na página Dashboards, clique no nome de qualquer painel para visualizar métricas detalhadas.

Etapa 5: Visualizar alertas

O Managed Service for Prometheus monitora métricas essenciais de clusters de contêineres por padrão, evitando lacunas de cobertura causadas por configurações manuais. Inclui modelos de alerta para métricas essenciais que podem ser ativados conforme necessário, sem a necessidade de escrever consultas PromQL. Para visualizar alertas no Managed Service for Prometheus, siga estas etapas:

  1. Faça login no ARMS console. No painel de navegação à esquerda, escolha Managed Service for Prometheus > Instances.

  2. Clique na instância do Prometheus referente ao cluster registrado criado em Step 1: Create an ACK One registered cluster.

  3. No painel de navegação à esquerda, clique em Alarm Rules. Na página Alarm Rules, visualize os detalhes dos alertas.

Ativação

  • Cluster registrado Alibaba Cloud: para informações sobre como ativar clusters registrados, consulte Activate a registered cluster.

  • Managed Service for Prometheus: o Managed Service for Prometheus oferece um modelo de faturamento por assinatura que pode gerar uma economia de pelo menos 67% em comparação ao modelo de pagamento conforme o uso.