O alicloud-monitor-controller é um componente de sistema do ACK que integra seu cluster aos serviços de observabilidade da Alibaba Cloud: Managed Service for Prometheus, Simple Log Service (SLS) e CloudMonitor. Ele sincroniza configurações de observabilidade, incluindo regras de alerta, e gerencia todo o ciclo de vida dessas configurações.
Recursos
Gerenciamento de configuração de alertas: Permite configurar alertas de forma flexível pelo gerenciamento de alertas do ACK.
Sincronização de regras: Sincroniza as configurações padrão de alerta e as regras da CustomResourceDefinition (CRD) AckAlertRule com o Managed Service for Prometheus, Simple Log Service (SLS) e CloudMonitor.
Gerenciamento de ciclo de vida: Gerencia as configurações de alerta durante todo o ciclo de vida.
Considerações sobre atualização
Para garantir a sincronização correta das novas configurações, ao acessar a página Alerts, o sistema verifica a versão do alicloud-monitor-controller e solicita a atualização para a versão mais recente se estiver desatualizada. A atualização também atualiza o CustomResource (CR) padrão do AckAlertRule e ressincroniza as regras de alerta.
Se você usou anteriormente a Advanced Configuration para acessar um serviço de monitoramento e modificou manualmente uma regra de alerta oficial do ACK, a atualização substituirá suas alterações personalizadas pelo modelo oficial de regra de alerta do ACK.
Para preservar regras de alerta personalizadas após atualizações, defina-as como CRs em vez de modificar as regras oficiais pela Advanced Configuration.
Uso
Consulte Gerenciamento de alertas.
Notas de versão
Fevereiro de 2026
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.8.9 |
|
2026-02-27 |
Adição da regra de alerta Cluster node low-level system event anomaly ao modelo padrão. Atualização do CR AckAlertRule para a versão v1.0.18. |
Inclui novas regras de alerta nos conjuntos habilitados e herda os grupos de destinatários de notificação das configurações existentes. Se você modificou uma regra oficial do ACK pela Advanced Configuration, a atualização substituirá suas alterações pelo modelo oficial. |
Julho de 2025
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.8.8 |
|
2025-07-25 |
Regras de alerta baseadas no CloudMonitor agora podem ser configuradas com CRs para maior flexibilidade no monitoramento. Clusters dedicados do ACK oferecem suporte a reforço de segurança com o modo endurecido de metadados de instância ECS. Consulte Impor modo endurecido ao acessar metadados de instância ECS. |
Sem impacto nas cargas de trabalho. |
Dezembro de 2023
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.8.5 |
|
2023-12-25 |
O ACK One e clusters registrados recebem automaticamente configurações padrão de regras de alerta em diferentes ambientes de rede. |
Sem impacto nas cargas de trabalho. |
Agosto de 2023
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.8.4 |
|
2023-08-14 |
As permissões de Role-Based Access Control (RBAC) foram restringidas. Agora é possível configurar regras de alerta padrão para o ACK One e clusters registrados. |
Sem impacto nas cargas de trabalho. |
Julho de 2023
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.8.3 |
|
2023-07-25 |
Suporte adicionado para nós com arquitetura ARM. As regras de alerta do SLS foram localizadas: escolha um idioma de notificação ou permita que o sistema selecione um com base no seu site. |
Sem impacto nas cargas de trabalho. |
Fevereiro de 2023
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.8.0-7c28347-aliyun |
|
2023-02-24 |
A central de alertas do ACK passou a oferecer suporte a notificações via DingTalk, WeCom e Lark. Inclusão de regras de alerta padrão para logs de auditoria. |
Sem impacto nas cargas de trabalho. |
Julho de 2022
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.6.5-2c5c836-aliyun |
|
2022-07-07 |
Compatibilidade estendida às redes internas da Alibaba Cloud. Correção de falhas na sincronização de regras de alerta causadas por problemas de rede. Ajustes na lógica de sincronização de regras no Managed Service for Prometheus. Aplicação de patches para vulnerabilidades na imagem do componente. |
Sem impacto nas cargas de trabalho. |
Abril de 2022
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.6.1-aa20856-aliyun |
|
2022-04-15 |
Suporte a regras de alerta padrão do Prometheus, abrangendo componentes essenciais do cluster e cargas de trabalho. Nova regra de alerta padrão para falhas no kernel do SO em nós do cluster. Ambientes de cluster sem acesso à Internet agora têm suporte. |
Sem impacto nas cargas de trabalho. |
Março de 2022
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.5.15-ed0a4c72-aliyun |
|
2022-03-02 |
Resolução de falhas na sincronização de regras de alerta em cenários específicos. Correção de vulnerabilidades na imagem do componente. |
Sem impacto nas cargas de trabalho. |
Novembro de 2021
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.5.13-6990db0e-aliyun |
|
2021-11-04 |
A central de alertas do ACK passou a oferecer regras de alerta padrão para recursos básicos do cluster. |
Sem impacto nas cargas de trabalho. |
Agosto de 2021
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.5.12-f7aedb4a-aliyun |
|
2021-08-23 |
Otimização das configurações de alerta. |
Sem impacto nas cargas de trabalho. |
|
v1.5.10-a75e4ee2-aliyun |
|
2021-08-19 |
Melhorias aplicadas às configurações de alerta. |
Sem impacto nas cargas de trabalho. |
Abril de 2021
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.5.7-e1d5de8a-aliyun |
|
2021-04-23 |
Implementação de alertas baseados em eventos. Configure alertas com base em eventos do Kubernetes usando CRDs. |
Sem impacto nas cargas de trabalho. |
Julho de 2020
|
Versão |
Imagem |
Data de lançamento |
Alterações |
Impacto |
|
v1.4.0-49ff2362-aliyun |
|
2020-07-24 |
Coleta de métricas compatível com clusters que possuem pools de nós Windows e Linux simultaneamente. Sensibilidade elástica ajustável para 15s, 20s, 30s ou 60s. Correção do acionamento indevido do Horizontal Pod Autoscaler (HPA) durante atualizações contínuas. |
Sem impacto nas cargas de trabalho. |
Solução de problemas
Nenhum grupo de aplicativos aparece no CloudMonitor
Verifique os itens abaixo:
Confirme se o pod do alicloud-monitor-controller está em execução no namespace
kube-system.Valide a versão do componente e atualize se necessário.
Analise os logs do alicloud-monitor-controller em busca de erros de tempo limite de conexão e falhas de SDK.
Ausência de dados no grupo de aplicativos do CloudMonitor
Siga estas etapas de verificação:
-
Certifique-se de que o nome da instância no grupo de aplicativos corresponde ao nome do pod da aplicação.
Caso haja divergência nos nomes, siga os passos de solução de problemas descritos acima em "Nenhum grupo de aplicativos aparece no CloudMonitor".
Se os nomes coincidirem, prossiga para a próxima etapa.
Verifique se o pod do metrics-server está ativo.
Inspecione os logs do metrics-server. A presença da mensagem
Successful write 164190 bytes metrics to monitor serverindica que a coleta de dados opera normalmente.