Quando uma aplicação de microsserviços apresenta uma exceção de negócio, um único log de erro ou um pico isolado em uma métrica raramente revela o cenário completo. Correlacione métricas, traces e logs para evoluir da percepção de "algo está errado" para a identificação da causa raiz exata. O Application Real-Time Monitoring Service (ARMS) integra esses três sinais em um único console, permitindo investigar desde uma anomalia até o erro específico em poucos minutos.
Este documento apresenta dois fluxos de trabalho para solução de problemas:
Inicie pelas métricas -- Identifique uma anomalia no gráfico de métricas da aplicação e investigue os traces e logs correspondentes àquela janela de tempo.
Inicie por um endpoint -- Localize uma chamada de interface com falha e inspecione seu trace e os logs de negócio correlacionados.
Ambos os fluxos exigem que seus logs de negócio estejam vinculados aos IDs de trace. Conclua a configuração descrita em Vincular logs de negócio a IDs de trace antes de iniciar a solução de problemas.
Como métricas, traces e logs se conectam
O ARMS conecta os três pilares da observabilidade, permitindo navegar entre eles sem trocar de ferramentas:
|
Sinal |
O que o ARMS captura |
Papel na solução de problemas |
|
Métricas |
Indicadores no nível da aplicação: Application Service Request, Application Service Average Response Time, Application Dependent Service Request |
Um pico ou queda em um gráfico de métricas indica quando e onde ocorreu a falha. |
|
Traces |
Traces distribuídos que registram cada chamada de interface e resposta entre serviços |
Um trace exibe toda a cadeia de chamadas e identifica o span exato que falhou. |
|
Logs |
Logs de negócio gerados pelo código da sua aplicação |
Os logs fornecem detalhes no nível da aplicação — mensagens de erro, stack traces e contexto de negócio — que explicam por que a falha ocorreu. |
Pré-requisitos
Antes de começar, verifique se você possui:
O Simple Log Service (SLS) ativado
Vincule logs de negócio a IDs de trace
Para que o ARMS exiba logs de negócio junto aos traces, configure a associação entre log e trace nas configurações da sua aplicação.
Faça login no console do ARMS. No painel de navegação à esquerda, escolha Application Monitoring > Applications.
-
Na página Applications, selecione uma região na barra de navegação superior e clique em nome da aplicação.
Se o ícone
aparecer na coluna Language , a aplicação está conectada ao Application Monitoring. Caso apareça um hífen ( - ), a aplicação está conectada ao Managed Service for OpenTelemetry. No painel de navegação à esquerda, clique em Application Settings. Na página exibida, clique em aba Custom Configuration.
-
Na seção Log Collect Configuration, defina as seguintes configurações:
Defina a origem do log como Associated Log.
Ative a opção Link Business Logs with TraceId.
Selecione a região onde seus recursos do Simple Log Service estão implantados.
Escolha o projeto e o Logstore criados nos pré-requisitos.

Clique em Save.
Solucione problemas a partir de métricas da aplicação
Utilize este fluxo quando um gráfico de métricas apresentar uma anomalia — como um aumento repentino no tempo médio de resposta — e você precisar rastrear a causa raiz.
Faça login no console do ARMS. No painel de navegação à esquerda, escolha Application Monitoring > Applications.
-
Na página Applications, selecione uma região na barra de navegação superior e clique em nome da aplicação.
Se o ícone
aparecer na coluna Language , a aplicação está conectada ao Application Monitoring. Caso apareça um hífen ( - ), a aplicação está conectada ao Managed Service for OpenTelemetry. No painel de navegação à esquerda, clique em Application Overview. Acesse a aba Overview e selecione um intervalo de tempo no canto superior direito. A aba Overview exibe três métricas da aplicação: Application Service Request, Application Service Average Response Time e Application Dependent Service Request.
-
No gráfico da métrica que apresenta a anomalia, selecione o intervalo de tempo em que a flutuação ocorreu. O exemplo abaixo utiliza o gráfico de Application Service Average Response Time.

-
Inspecione os traces gerados durante esse intervalo de tempo:
Clique em View CallChain selected time.
No painel exibido, localize traces com status de erro (indicados pelo ícone
) e clique em ID do trace na coluna TraceId. Para acessar diretamente os logs de negócio de um trace específico, clique em View Logs na coluna Actions. 
Na aba Traces, clique em ícone
na coluna Details.No painel de detalhes, clique em aba Method Stack. Passe o mouse sobre a mensagem de erro para visualizar os detalhes da exceção.

-
Analise os logs de negócio gerados no mesmo intervalo de tempo:
Clique em View Log selected time.
Na página de análise de logs, localize a mensagem de erro e identifique a causa raiz da exceção de negócio.

Solucione problemas a partir de chamadas de interface
Utilize este fluxo quando você já sabe qual endpoint está falhando e deseja inspecionar diretamente seus traces e logs.
Faça login no console do ARMS. No painel de navegação à esquerda, escolha Application Monitoring > Applications.
-
Na página Applications, selecione uma região na barra de navegação superior e clique em nome da aplicação.
Se o ícone
aparecer na coluna Language , a aplicação está conectada ao Application Monitoring. Caso apareça um hífen ( - ), a aplicação está conectada ao Managed Service for OpenTelemetry. No painel de navegação à esquerda, clique em Interface Invocation.
Na lista de interfaces, clique em interface que deseja inspecionar. Em seguida, clique em aba Interface Snapshot.
-
Localize traces com status de erro (indicados pelo ícone
).
-
Examine os detalhes do trace:
Clique em ID do trace na coluna TraceId.
Na aba Traces, clique em ícone
na coluna Details.No painel de detalhes, clique em aba Method Stack. Passe o mouse sobre a mensagem de erro para visualizar os detalhes da exceção.

-
Verifique os logs de negócio correlacionados:
Clique em View Logs na coluna Actions.
Na página de análise de logs, localize a mensagem de erro e identifique a causa raiz da exceção de negócio.

Tópicos relacionados
Criar e gerenciar regras de alerta no Application Monitoring -- Configure regras de alerta para detectar anomalias de métricas automaticamente e inicie a solução de problemas antes que os usuários relatem falhas.