Todos os produtos
Search
Central de documentação

Managed Service for Prometheus:Notas de versão do agente Prometheus

Última atualização: Jul 05, 2026

Lista o histórico de versões, as alterações e as atualizações de compatibilidade do agente Prometheus.

2026

Agente Prometheus

Versão

Data de lançamento

Alterações

v1.1.39

Abril de 2026

  • Otimização do mecanismo de rotação de tokens para o11y-init-environment e o11y-addon-controller, com suporte a cenários de implantação não sequencial.

  • Inclusão das seguintes métricas básicas:

    • scaling_tier_threshold

    • resource_utilization_level

v1.1.38

Abril de 2026

  • Adição das seguintes métricas básicas:

    • scheduler_schedule_attempts_total

    • scheduler_elastic_quota_tree_usage

    • scheduler_e2e_scheduling_duration_seconds_count

    • scheduler_framework_extension__point_duration_sseconds_count

    • scheduler_cache_size

    • tier_threshold

v1.1.37

Janeiro de 2026

  • Melhoria no mecanismo de rotação de endpoints do o11y-addon-controller para cenários como atualizações de versão de instância do Prometheus.

  • Novas métricas básicas adicionadas:

    • cluster_pv_detail_rnumtotal

    • cluster_pvc_detail_humtotal

    • node_volume_capacity_bytes_total

    • node_volume_capacitybytes_used

    • node_volume_capacity_bytes_available

v1.1.36

Dezembro de 2025

  • Atualização do GPU Exporter para v3.3.9-1.12.16-2.6.6.1-4-5b00472-aliyun, habilitando o suporte a métricas L20A.

v1.1.35

Dezembro de 2025

  • Redução das permissões de ClusterRole. Para mais informações, consulte o anúncio de lançamento.

  • O agente gerenciado agora oferece suporte à descoberta de serviços via EndpointSlice.

  • Correção de um problema em que a remoção de um rótulo global não surtia efeito.

  • O agente gerenciado passa a usar nomes de domínio para acessar serviços dentro de um cluster e executar verificações de integridade nesses serviços.

  • Disponibilidade de switches separados para configurar endpoints públicos e internos destinados a requisições de API e transmissão de dados.

v1.1.34

Dezembro de 2025

  • Resolução de uma falha de segurança mediante a adoção de um método seguro e autenticado para chamadas de metadados.

v1.1.33

Agosto de 2025

  • Remoção de todas as dependências do pprof.

  • Atualização do GPU Exporter para v3.3.9-1.12.16-2.6.6.1-2-473e40f-aliyun, garantindo compatibilidade com versões anteriores de drivers.

v1.1.32

Junho de 2025

  • Atualização da versão da imagem do GPU Exporter.

  • Implementação de métricas de automonitoramento para a fila interna.

  • O timeout de remote write passa a ser definido pela configuração de remote write, com valor padrão de 30s.

v1.1.31

Lançamento gradual iniciado em março de 2025

  • Otimização do agendamento para alvos em grande escala, acelerando a alocação de tarefas de coleta.

  • Por padrão, a descoberta de serviços ocorre apenas para Pods no estado Running.

  • Refinamento da descoberta de serviços para reduzir o consumo de memória.

  • Ajuste na saída de logs para diminuir a duplicidade de registros.

  • Suporte adicionado para métricas relacionadas à API Priority and Fairness (APF) do API Server.

v1.1.30

Março de 2025

  • Aprimoramento da lógica de eleição de líder para implantações com múltiplas réplicas.

  • Correção de um problema em que secrets em texto simples eram analisados incorretamente em certos casos.

  • Solução para uma falha em que a última tarefa de coleta não era interrompida corretamente ao excluir todas as configurações de coleta.

  • Ajuste no método de coleta para nós Virtual Kubelet, retornando apenas as métricas do nó atual.

  • Modificação na configuração de coleta do GPU Exporter para incluir informações do Pod do GPU Exporter em rótulos com o prefixo source_, evitando conflitos com rótulos de linha do tempo.

  • Implementação de um mecanismo de nova tentativa para evitar falhas na atualização de tokens.

v1.1.27

Janeiro de 2025

  • Ajuste nas configurações de agendamento para workloads em clusters de borda.

  • Aplicação de hardening de segurança em alguns jobs de coleta em clusters de borda.

  • Adoção de um modo de descoberta de serviços cAdvisor mais compatível, oferecendo suporte a clusters de containers executando versões anteriores à 1.20.0.

2024

Agente Prometheus

Versão

Data de lançamento

Métricas

Alterações

v1.1.25

Outubro de 2024

Ambiente de container

  • Suporte adicionado para novas métricas do Node Exporter e Kube State Metrics.

  • Habilitação da descoberta de serviços para Ingress v1.

  • Adaptação do recurso de coleta de dados do cAdvisor para nós Virtual Kubelet.

  • Compatibilidade incluída para linhas do tempo no formato exemplar do protocolo OpenMetrics.

  • Correção de um cenário em que os rótulos das métricas não seguiam a ordem lexicográfica.

  • Solução para falhas na atualização de configurações de coleta em determinados cenários.

  • Resolução de um problema em que os dados não eram coletados corretamente quando diferentes recursos ServiceMonitor estavam configurados para o mesmo alvo de coleta.

v1.1.22

Setembro de 2024

Ambiente de container

  • Inclusão de suporte para métricas básicas do Node Exporter e Kube State Metrics.

  • Remoção da página /aliyun na porta 9335 do serviço arms-prom-admin no namespace arms-prom, atendendo aos requisitos de conformidade de segurança.

v1.1.20

Maio de 2024

Ambiente de container

  • Correção de uma limitação que impedia a substituição de jobs de coleta integrados.

  • Criação da métrica de automonitoramento aliyun_prometheus_agent_hpa_max_limit para o número máximo de réplicas.

  • Melhoria no suporte de runtime para cenários hospedados em VPC.

  • Adição de um switch de funcionalidade para ativar o envio de métricas via HTTPS.

  • Suporte implementado para coleta adaptativa de métricas em ambientes ASM mTLS.

  • Solução para falha na URL de pré-visualização de métricas quando continha caracteres inválidos.

  • Correção de um erro que paralisava o agente caso uma configuração de coleta tentasse carregar um certificado CA local inexistente.

  • As métricas de automonitoramento agora podem ser enviadas para regiões incluindo e Arábia Saudita.

  • Inserção de um rótulo de nome de nó nas métricas do job de coleta integrado do Node Exporter.

  • Desativação da capacidade de registro para instâncias de armazenamento do Prometheus.

  • Habilitação da convergência de bucketing de métricas para operar no modo de múltiplas réplicas.

  • O registro de instâncias Prometheus passa a ser responsabilidade de um componente separado. Esse recurso vem desativado por padrão no componente de coleta.

  • Possibilidade de instalar e desinstalar o componente Observability Integration Center.

  • Suporte adicionado para ativar a Edição Pro do Container Monitoring.

  • Atualização da API AutoScaling para v2.

  • Upgrade das versões das APIs CronJob e PodDisruptionBudget para v1.

  • Revisão das políticas de segurança.

Serviços Alibaba Cloud

  • Aprimoramento na tempestividade do processamento de dados, reduzindo a latência de métricas incrementais para segundos em cenários de coleta em grande escala.

  • Redução do tempo de ativação da coleta de métricas para novos serviços Alibaba Cloud de minutos para segundos.

  • Capacidade de injetar tags personalizadas de serviços Alibaba Cloud selecionados nas métricas.

  • Devido a ajustes arquiteturais, as métricas de automonitoramento relacionadas ao agente Prometheus anterior deixam de ser entregues às instâncias do usuário. Essas métricas são gratuitas. Caso seus alertas dependam de métricas de automonitoramento do agente (por exemplo, métricas com prefixo aliyun_arms), remova essas dependências antes de atualizar.

  • As métricas arms_instance_id e arms_instance_name, presentes em algumas versões anteriores de instâncias, tornaram-se obsoletas nesta versão.

  • Em virtude de mudanças na arquitetura, a consulta à lista de alvos não é mais suportada.

v1.1.19

Março de 2024

Ambiente de container

  • Redução da latência na coleta de métricas durante a integração inicial de clusters de grande porte.

  • Otimização do modo de descoberta de serviços para minimizar o impacto de alterações de configuração em diferentes jobs de coleta.

  • Ampliação das métricas de automonitoramento para identificar problemas de dados incompletos causados por exceções de coleta.

  • Suporte a configurações de recorte de lista de permissões de métricas mais flexíveis.

  • Correção de diversas exceções de coleta ocorridas em casos extremos.

2023

Registro de alterações de componentes de 2023

Versão do Helm

Versão da imagem

Alterações

Data de lançamento

Impacto

v1.1.18

registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v4.0.0

  • Ajuste nas solicitações e limites de recursos para Node Exporter, GPU Exporter e outros recursos.

  • O número da porta do Node Exporter torna-se configurável, mantendo 9100 como valor padrão.

Dezembro de 2023

Esta atualização não afeta seus serviços.

v1.1.17

registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v4.0.0

  • Inclusão de tarefa de coleta de eventos de cluster para dar suporte ao painel de Kubernetes Deployment.

  • Adição de métricas de automonitoramento baseadas em SLA para o painel de estabilidade de SLA.

  • Suporte à autenticação BasicAuth no ServiceMonitor. O secret deve residir no mesmo namespace do ServiceMonitor.

  • Implementação do recurso Metrics Metadata para exibir o significado de métricas específicas.

  • Capacidade de transmitir a versão do Agent Chart ao servidor. O servidor utiliza esse número de versão para inicializar ou atualizar painéis.

  • Nova métrica de automonitoramento para remote write, contabilizando o tempo gasto no envio de cada lote de dados.

  • Métricas de automonitoramento para erros e latência na coleta de métricas básicas.

  • Métricas de automonitoramento para erros e latência na coleta de métricas de negócios.

  • Otimização dos parâmetros padrão de remote write queue_config para min_shards=10, max_samples_per_send=5000 e capacity=10000, melhorando a adaptabilidade para clusters de grande escala.

  • Refinamento do método de descoberta de serviços para jobs de coleta da Container Storage Interface (CSI), focado principalmente na coleta de PersistentVolume (PV).

  • Ajuste na frequência de entrega do senderLoop e modificação na frequência do syncWorkersSeries para reduzir interferências desnecessárias.

  • Simplificação de alguns logs e otimização de outros para apresentar informações de tempo mais detalhadas sobre a cadeia de scrape.

  • Os jobs de coleta de métricas básicas passam a ter período e timeout fixos próprios, em vez de usar a configuração global. Isso reduz interferências desnecessárias na coleta de métricas básicas.

  • Melhoria na lógica de interação no modo Master-Slave com múltiplas réplicas. Master e workers deixam de se afetar mutuamente, e workers não impactam outros workers, aumentando a estabilidade.

  • Otimização da política de entrega de alvos do Master, economizando cerca de 30% de CPU e 40% de memória, além de melhorar o desempenho da coleta.

  • Redução de 70% no uso de CPU através da otimização do metrics_relabel.

  • Economia de aproximadamente 20% de overhead de CPU com a otimização da lógica do listener Informer em cenários multitenant.

  • Tratamento aprimorado para falhas ocasionais na resolução de nomes de domínio pelo CoreDNS. O sistema passa a alternar automaticamente para um endereço IP em cache, reduzindo a dependência da resolução em tempo real do CoreDNS e aumentando a estabilidade no envio de dados.

  • Uso de SendConfig na lógica de entrega de configurações de coleta para aumentar a estabilidade da entrega.

  • Aprimoramento da estratégia de pré-scraping do Master para poupar recursos do Master e melhorar suas capacidades de descoberta de serviços e agendamento de alvos.

  • Tratamento adaptativo para lotes únicos grandes (> 1 MB), reduzindo a perda de pacotes causada por limitações do backend.

  • Correção no ScrapeLoop onde alguns alvos de coleta não podiam ser interrompidos, resultando em coleta duplicada.

  • Solução para um problema em cenários multitenant onde atualizações tardias no cache de rótulos de Pod causavam a divisão de uma única série temporal.

  • Correção de uma falha ocasional do Master em entregar alvos para réplicas sem memória (OOM) ou reiniciadas, o que causava a perda de alguns alvos de coleta.

  • Resolução de problemas na análise de tipos de secret e na transmissão de headers no remote write.

  • Correção de uma falha ocasional na operação de desligamento do kubernetes-pods.

  • Solução para parâmetros globais padrão e external_labels que não surtiam efeito. Modificações personalizadas agora são suportadas.

Agosto de 2023

Esta atualização não afeta seus serviços.

v1.1.15

registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v4.0.0

Suporte adicionado para clusters Container Service for Kubernetes (ACK) v1.26.

Maio de 2023

Esta atualização não afeta seus serviços.

v1.1.14

registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v4.0.0

  • Redução do consumo de recursos em cerca de 30% para memória e 50% para CPU, ampliando a capacidade de coleta.

  • Diminuição adicional da dependência da resolução de nomes de domínio do CoreDNS para aumentar a estabilidade no envio de dados.

  • O ServiceMonitor passa a suportar autenticação BasicAuth.

  • Correção de um problema na análise de tipos de secret no remote write.

  • Adição de três pontos de instrumentação de automonitoramento.

  • O Metrics Metadata agora exibe o significado das métricas.

  • Criação de uma tarefa de coleta para métricas de eventos de cluster.

  • Implementação de um mecanismo Multi-Master para lidar com descoberta de serviços e agendamento de alvos em clusters de escala extremamente grande. Este recurso vem desativado por padrão.

  • Correção de mais de três bugs.

Esta atualização não afeta seus serviços.

v1.1.13

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v4.0.0

  • registry.{REGION}.aliyuncs.com/acs/gpu-prometheus-exporter:v2.3.6-994eaf7-aliyun

  • Atualização do GPU Exporter para v2.3.6-994eaf7-aliyun.

  • Suporte adicionado para clusters ACK One registrados.

Abril de 2023

Esta atualização não afeta seus serviços.

v1.1.12

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v3.2.1

  • registry.{REGION}.aliyuncs.com/acs/gpu-prometheus-exporter:v2.3.6-fdb40f2-aliyun

  • Upgrade do GPU Exporter para v2.3.6-fdb40f2-aliyun.

  • Aceleração na velocidade de pull das imagens dos componentes.

Fevereiro de 2023

Esta atualização não afeta seus serviços.

2022

Registro de alterações de componentes de 2022

Versão

Endereço da imagem

Alterações

Data de lançamento

Impacto

v1.1.11

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v3.2.1

  • Implementação de recurso de degradação de serviço para priorizar a estabilidade do pipeline principal de coleta durante falhas no remote write.

  • Permissão para modificar a Global Config em jobs de coleta.

  • Aprimoramento do remote write. Quando o CoreDNS falha ao resolver um nome de domínio, o sistema alterna automaticamente para o envio de dados usando um endereço IP pré-armazenado em cache.

  • O remote write passa a suportar a configuração de múltiplos endereços de envio.

Dezembro de 2022

Esta atualização não afeta seus serviços.

v1.1.9

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v3.2.0

  • O agente passa a suportar múltiplas arquiteturas de CPU, incluindo amd64, arm, arm64, ppc64le e s390x.

  • Fortalecimento das capacidades de automonitoramento do agente.

  • Otimização da política de garbage collection de memória do agente.

  • Refinamento da política de agendamento de alvos para múltiplas réplicas, prevenindo vazamentos de memória nos workers.

  • Correção de um problema de degradação de memória do agente.

  • Solução para um deadlock que ocorria sob condições de contorno no modo de múltiplas réplicas.

  • Quatro novas capacidades de descoberta de serviços adicionadas: IonOS, PuppetDB, Uyuni e Vultr.

Setembro de 2022

Esta atualização não afeta seus serviços.

v1.1.7

  • arms-prom-operator:v3.1.0

  • gpu-prometheus-exporter:v2.3.6-2.0.0-0c0440f

Suporte às novas métricas e painéis do GPU Exporter. Para mais informações, consulte Ativar monitoramento de GPU para um cluster.

Julho de 2022

Esta atualização não afeta seus serviços.

v1.1.6

  • arms-prom-operator:v3.1.0

  • gpu-prometheus-exporter:v1.0.1-26c5321

Correção de um problema de coleta de dados no GPU Exporter v1.x.

Junho de 2022

Esta atualização não afeta seus serviços.

v1.1.5

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v3.1.0

  • Integração com o Integration Center.

  • Suporte a clusters de escala extremamente grande (>10.000 nós).

  • Sincronização de recursos ServiceMonitor e PodMonitor criados fora do console do Managed Service for Prometheus.

  • Configuração de descoberta declarativa de serviços para recursos ServiceMonitor e PodMonitor criados fora do console do Managed Service for Prometheus.

  • O limite superior para o número de réplicas do Horizontal Pod Autoscaler (HPA) do agente torna-se configurável.

  • Edição de alguns campos dos jobs de métricas básicas do Prometheus.

  • Validação online de arquivos de configuração ServiceMonitor, PodMonitor e Prometheus.yaml.

  • Melhorias no uso de CPU e memória, além de maior estabilidade do sistema.

Maio de 2022

Esta atualização não afeta seus serviços.

v1.1.4

  • Hardening de segurança aplicado ao Node Exporter.

  • Correção de um problema de montagem de volume no GPU Exporter.

Abril de 2022

Esta atualização não afeta seus serviços.

v1.1.3

Compatibilidade adicionada para clusters v1.22.

Fevereiro de 2022

Esta atualização não afeta seus serviços.

v1.1.2

Atualização do Kube State Metrics para v2.3.0-755434c-aliyun.

Janeiro de 2022

Esta atualização não afeta seus serviços.

2021

Registro de alterações de componentes de 2021

Versão

Endereço da imagem

Alterações

Data de lançamento

Impacto

v1.1.11

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v3.2.1

  • Recurso de degradação de serviço adicionado para priorizar a estabilidade do pipeline principal de coleta durante falhas no remote write.

  • Possibilidade de modificar a Global Config em jobs de coleta.

  • Melhoria no remote write. Se o CoreDNS falhar na resolução de um nome de domínio, o sistema passa a enviar dados usando um endereço IP previamente armazenado em cache.

  • Configuração de múltiplos endereços de envio suportada no remote write.

Dezembro de 2022

Esta atualização não afeta seus serviços.

v1.1.9

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v3.2.0

  • Suporte a múltiplas arquiteturas de CPU no agente, incluindo amd64, arm, arm64, ppc64le e s390x.

  • Capacidades de automonitoramento do agente aprimoradas.

  • Política de garbage collection de memória do agente otimizada.

  • Política de agendamento de alvos para múltiplas réplicas refinada para evitar vazamentos de memória nos workers.

  • Problema de degradação de memória do agente corrigido.

  • Deadlock sob condições de contorno no modo de múltiplas réplicas solucionado.

  • Inclusão de quatro novas capacidades de descoberta de serviços: IonOS, PuppetDB, Uyuni e Vultr.

Setembro de 2022

Esta atualização não afeta seus serviços.

v1.1.7

  • arms-prom-operator:v3.1.0

  • gpu-prometheus-exporter:v2.3.6-2.0.0-0c0440f

Novas métricas e painéis do GPU Exporter suportados. Para mais informações, consulte Ativar monitoramento de GPU para um cluster.

Julho de 2022

Esta atualização não afeta seus serviços.

v1.1.6

  • arms-prom-operator:v3.1.0

  • gpu-prometheus-exporter:v1.0.1-26c5321

Problema de coleta de dados no GPU Exporter v1.x corrigido.

Junho de 2022

Esta atualização não afeta seus serviços.

v1.1.5

  • registry.{REGION}.aliyuncs.com/acs/arms-prometheus-agent:v3.1.0

  • Suporte ao Integration Center adicionado.

  • Clusters de escala extremamente grande (>10.000 nós) agora são suportados.

  • Sincronização de recursos ServiceMonitor e PodMonitor criados fora do console do Managed Service for Prometheus habilitada.

  • Configuração de descoberta declarativa de serviços para recursos ServiceMonitor e PodMonitor criados fora do console do Managed Service for Prometheus disponível.

  • Limite superior de réplicas do Horizontal Pod Autoscaler (HPA) do agente configurável.

  • Alguns campos dos jobs de métricas básicas do Prometheus podem ser editados.

  • Validação online de arquivos de configuração ServiceMonitor, PodMonitor e Prometheus.yaml implementada.

  • Uso de recursos de CPU e memória otimizado, com maior estabilidade do sistema.

Maio de 2022

Esta atualização não afeta seus serviços.

v1.1.4

  • Hardening de segurança aplicado ao Node Exporter.

  • Problema de montagem de volume no GPU Exporter corrigido.

Abril de 2022

Esta atualização não afeta seus serviços.

v1.1.3

Compatibilidade com clusters v1.22 adicionada.

Fevereiro de 2022

Esta atualização não afeta seus serviços.

v1.1.2

Kube State Metrics atualizado para v2.3.0-755434c-aliyun.

Janeiro de 2022

Esta atualização não afeta seus serviços.

2020

Registro de alterações de componentes de 2020

Versão do Helm

Versão da imagem

Alterações

Data de lançamento

Impacto

v0.1.5

arms-prom-operator:v0.1

  • Suporte a clusters Container Service for Kubernetes (ACK) v1.18.

  • Pull de imagens a partir de endereços de rede interna dentro de uma região.

Outubro de 2020

Esta atualização não afeta seus serviços.

v0.1.4

arms-prom-operator:v0.1

  • Monitoramento pronto para uso de recursos Kubernetes, incluindo Pods e nós.

  • Monitoramento via UI para nove componentes comuns, incluindo MySQL, Redis, Kafka, ZooKeeper e Nginx, visando dependências de middleware de aplicações.

  • Solução totalmente gerenciada Managed Service for Prometheus, incluindo regras de coleta Prometheus.yaml, painéis Grafana e sistema de alertas, simplificando a migração de Prometheus autogerenciado para a Alibaba Cloud.

  • Bug de autenticação corrigido.

Julho de 2020

Esta atualização não afeta seus serviços.

v0.1.3

arms-prom-operator:v0.1

Limites de recursos definidos para o agente.

Abril de 2020

Esta atualização não afeta seus serviços.

2019

Registro de alterações de componentes de 2019

Versão do Helm

Versão da imagem

Alterações

Data de lançamento

Impacto

v0.1.2

arms-prom-operator:v0.1

Lançamento inicial.

Agosto de 2019

Esta atualização não afeta seus serviços.