Erros do lado do servidor — especialmente respostas 5xx — estão entre os mais difíceis de solucionar, pois a causa raiz geralmente se oculta profundamente na lógica de negócios. A depuração tradicional baseada em logs exige acesso SSH, buscas manuais em logs e suposições em serviços distribuídos.

O Application Real-Time Monitoring Service (ARMS) elimina essa sobrecarga por meio de instrumentação de bytecode. Após instale o agente do ARMS, ele captura, agrega e rastreia exceções automaticamente, sem necessidade de alterações no código. A partir de um único console, é possível identificar quando uma exceção ocorreu pela primeira vez, com que frequência ela se repete e qual chamada de método a desencadeou.
Essa abordagem é particularmente útil quando você precisa:
Determinar o horário e a frequência de uma exceção específica em um cluster distribuído.
Comparar as exceções de hoje com as de ontem, ou exceções pós-lançamento com linhas de base pré-lançamento.
Recuperar o contexto completo da solicitação — parâmetros, chamadas upstream e chamadas downstream — para uma exceção específica.
Rastrear uma transação com falha mencionada em um ticket de suporte até sua causa raiz.
Como funciona
O fluxo de trabalho de diagnóstico possui três etapas:
Instale o agente do ARMS em sua aplicação para começar a coletar dados de exceção automaticamente.
Revise as estatísticas de exceção para identificar tendências, picos e os tipos de erro mais frequentes.
Rastreie exceções até a causa raiz investigando snapshots de chamadas e pilhas de métodos.
Pré-requisitos
Instale o agente do ARMS em sua aplicação. Escolha o método correspondente à sua implantação:
Aplicação Java: Instalar manualmente um agente do ARMS
Aplicação Java no Container Service for Kubernetes (ACK): Instalar automaticamente um agente do ARMS no ACK
Aplicação Java em um cluster Kubernetes open-source: Instalar automaticamente um agente do ARMS em um ambiente Kubernetes
Após a instalação, o agente começa a coletar métricas automaticamente, com comparações diárias e semanais. As métricas rastreadas incluem tempo médio de resposta, contagem de solicitações, erros, instâncias em tempo real, eventos de GC completo, consultas SQL lentas, exceções e chamadas lentas.
Revisar estatísticas de exceção
Utilize o console do ARMS para identificar quais exceções ocorrem com maior frequência e como as tendências mudam ao longo do tempo.
Faça login no console do ARMS.
No painel de navegação à esquerda, escolha Application Monitoring > Applications.
Na barra de navegação superior, selecione a região onde sua aplicação está implantada.
Na página Applications, clique em nome da sua aplicação.
-
Na página Application Overview, clique em aba Overview. A seção inferior exibe o número total de exceções e as variações diárias e semanais.

-
Role para baixo até a seção Statistics Analysis e localize Exception Type. Este detalhamento mostra quantas vezes cada tipo de exceção ocorreu.

-
No painel de navegação à esquerda, clique em Application Details. Na página Application Details, clique em aba Exception Analysis para visualize gráficos de estatísticas de exceção, contagens de erros e pilhas de exceção.

Rastrear uma exceção até sua causa raiz
As estatísticas de exceção mostram o que está falhando, mas não o motivo. Um stack trace em um arquivo de log indica qual linha lançou a exceção, mas carece do contexto completo de chamadas upstream e downstream e dos parâmetros da solicitação.
O ARMS preenche essa lacuna por meio da instrumentação de bytecode: ele captura snapshots completos de chamadas upstream e downstream para cada exceção com sobrecarga mínima de desempenho. Isso fornece o contexto completo da solicitação — parâmetros, cadeia de chamadas e pilha de métodos — necessário para identificar as causas raízes.
Na aba Exception Analysis, encontre o tipo de exceção a ser diagnosticado e clique em Interface Snapshot na coluna Actions. A aba Interface Snapshot exibe os rastreamentos de chamadas associados a esse tipo de exceção.
-
Clique em TraceId de uma chamada específica para abrir seu rastreamento completo.
NotaPara filtragem avançada de rastreamento, consulte Consulta de rastreamento.

-
Na página de detalhes do rastreamento, revise a cadeia completa de chamadas. Na coluna Method Stack, clique em ícone de lupa para inspecionar a pilha de métodos e compreender o contexto completo de execução da chamada com falha.

Após identificar a causa raiz, corrija o código subjacente. Para resolver exceções adicionais, retorne à aba Interface Invocation e revise outras chamadas com falha.
Configure alertas proativos
Configure regras de alerta para que sua equipe seja notificada no momento em que uma exceção ocorrer, em vez de descobri-la posteriormente. É possível crie regras de alerta para uma API específica ou para todas as APIs da sua aplicação. Para obter detalhes, consulte Regras de alerta do Application Monitoring.