O Trace Explorer no Application Real-Time Monitoring Service (ARMS) permite filtrar, agregar e analisar dados de trace armazenados em tempo real para diagnosticar gargalos de latência, padrões de erro e dependências entre services.
Fluxo típico de solução de problemas
Uma investigação típica segue este fluxo:
Abra o Trace Explorer e defina um intervalo de tempo.
Filtre por status, duração, service ou nome do span para refinar os resultados.
Analise a lista de traces e a distribuição de status HTTP para identificar picos de erro ou valores atípicos de latência.
Explore um trace detalhadamente para inspecionar tempos no nível de span, atributos e exceções.
Agrupe métricas de spans em até 5.000 traces para identificar padrões sistêmicos.
Filtrar e pesquisar traces
Faça login no console do ARMS.
No painel de navegação à esquerda, escolha Application Monitoring > Trace Explorer. Selecione uma região na barra de navegação superior.
Selecione um intervalo de tempo no canto superior direito da página.
-
Filtre os traces usando um dos métodos a seguir:
Quick Filter: Selecione campos predefinidos — status, duração, nome da aplicação, nome do span ou endereço do host. As condições selecionadas aparecem na barra de pesquisa.
Painel de filtros suspenso: Clique em na barra de pesquisa para abrir o painel. Modifique as condições existentes ou adicione novas.
Instrução de consulta: Digite uma consulta diretamente na barra de pesquisa. Para detalhes sobre a sintaxe, consulte Métodos de uso do Trace Explorer.
Para salve as condições de filtro atuais como uma visualização, clique em no íconeao lado da lista suspensa Aggregation Dimension.
Para carregar uma visualização salva, clique em Saved View e selecione uma opção na lista.
Para agrupar os dados consultados, selecione uma dimensão de agregação.
Lista de traces
Após a aplicação dos filtros, o Trace Explorer exibe três visualizações:
Gráfico de barras de status HTTP — Distribuição dos códigos de resposta HTTP entre os traces.
Série temporal de duração — Duração dos spans ao longo do tempo, revelando tendências de latência.
Listas de spans e traces — Spans e traces individuais com metadados principais.

Cores dos códigos de status HTTP
O gráfico de barras codifica as respostas por cores conforme a classe de status HTTP:
|
Classe de status |
Cor |
|
2XX |
Verde |
|
3XX |
Amarelo |
|
4XX |
Laranja |
|
5XX |
Vermelho |
Os códigos de status são obtidos de attributes.http.status_code ou attributes.http.response.status_code. Quando existem tanto um código de status HTTP quanto um status de span, o código de status HTTP tem precedência.
Indicadores de status de span
Barras coloridas no lado esquerdo da coluna TraceId indicam o status do span:
|
Barra de cor |
Código de status |
Significado |
|
|
|
Não definido |
|
|
|
OK |
|
|
|
Erro |
A coluna Status usa ícones para indicar o estado do span:
|
Ícone |
Estado |
Condição |
|
|
Normal |
|
|
|
Erro |
|
|
|
Exceção |
|
Ações na lista de traces
Clique em em um id de trace ou em Details na coluna Actions para visualize os detalhes e a topologia do trace.
Clique em em Logs na coluna Actions para visualize os logs correlacionados ao trace.
Clique em no ícone
para expandir todos os spans sob um id de trace. Por padrão, apenas os spans raiz são exibidos por trace.Clique em no ícone
no canto superior direito para personalizar as colunas exibidas na lista.Passe o mouse sobre um span e clique em no ícone
para adicionar esse valor como condição de filtro.

Gráfico de dispersão
A aba Scatter plot plota cada trace por tempo (eixo X) e duração (eixo Y), facilitando a identificação de valores atípicos de latência. Passe o mouse sobre um ponto para ver informações básicas do trace ou clique em nele para abrir os detalhes.

Agregação de traces
A agregação de traces consulta até 5.000 traces distribuídos, recupera seus spans por id de trace e agrega os resultados, preservando a integridade do trace durante todo o processo. Isso revela padrões sistêmicos que a análise individual de spans não consegue detectar.
Consultas com múltiplas condições podem demorar para ser processadas. Aguarde o carregamento completo dos resultados.

Métricas de agregação
|
Métrica |
Descrição |
|
spanName |
Nome do span. |
|
serviceName |
Aplicação associada ao span. |
|
Contagem de solicitações / proporção de solicitações |
Número de solicitações que chamam este span, apresentado como contagem absoluta e porcentagem do total. Fórmula: contagem de solicitações / total de solicitações x 100%. |
|
Contagem de spans / multiplicador de solicitações |
Média de vezes que cada solicitação invoca este span. Fórmula: contagem de spans / contagem de solicitações. Um valor de 2,0 significa que cada solicitação chama este span duas vezes, em média. |
|
Tempo próprio médio / proporção |
Tempo que o span gasta em sua própria lógica, excluindo spans filhos. Fórmula: tempo total do span - tempo em todos os spans filhos. Para chamadas assíncronas, o tempo próprio é igual ao tempo total do span. |
|
Duração média |
Duração total média do span. |
|
Contagem de exceções / proporção de exceções |
Número de solicitações com exceções neste span. Fórmula: solicitações com exceções / total de solicitações. A contagem de exceções difere do número total de exceções — se o multiplicador de solicitações for maior que 1, uma única solicitação pode gerar múltiplas exceções. |
Exemplo de agregação
Considere um trace em que o Span A chama o Span B e o Span C:
|
spanName |
serviceName |
Contagem / proporção de solicitações |
Contagem / multiplicador de spans |
Tempo próprio médio / proporção |
Duração média |
Contagem / proporção de exceções |
|
A |
demo |
10 / 100% |
10 / 1,00 |
5,00 ms / 25% |
20 ms |
2 / 20% |
|
- B |
demo |
4 / 40% |
8 / 2,00 |
16,00 ms / 100% |
16 ms |
2 / 50% |
|
- C |
demo |
1 / 10% |
1 / 1,00 |
4,00 ms / 100% |
4 ms |
1 / 100% |
Como interpretar esta tabela:
Distribuição de solicitações: Todas as 10 solicitações passam pelo Span A, mas apenas 4 chegam ao Span B e 1 chega ao Span C. As solicitações restantes ignoram esses spans filhos devido a lógica condicional ou exceções.
Frequência de spans: O Span A é chamado uma vez por solicitação (multiplicador = 1,00). O Span B é chamado duas vezes por solicitação, em média (8 spans / 4 solicitações = 2,00), indicando um padrão de loop ou nova tentativa.
Distribuição de tempo: O tempo próprio do Span A é de 5 ms (25% de sua duração total de 20 ms), o que significa que 75% do tempo é gasto em spans filhos. O Span B e o Span C têm 100% de tempo próprio porque não possuem filhos.
Distribuição de exceções: O Span B apresenta 2 exceções em 4 solicitações (proporção de exceções de 50%). Como cada solicitação chama o Span B duas vezes, um padrão provável é: 2 solicitações são totalmente bem-sucedidas, enquanto as outras 2 falham na primeira chamada, mas têm sucesso na nova tentativa.
Passe o mouse sobre um nome de span azul para ver um id de trace recomendado. Clique em no id do trace para visualize seus detalhes.
Topologia de traces
A aba Full Link Topology exibe a topologia de chamadas entre aplicações para os traces agregados. Cada nó representa uma aplicação e mostra três métricas: contagem de solicitações, contagem de erros e tempo de resposta.

Analisar traces lentos e com falha
O Trace Explorer analisa automaticamente traces lentos e com falha para destacar as dimensões mais correlacionadas com problemas de desempenho. Filtre por host, interface ou combine várias condições para localizar problemas. Por exemplo: serviceName="arms-demo" AND ip="192.168.1.1".
Análise de traces lentos
O ARMS seleciona os 1.000 traces mais longos e identifica cinco dimensões com maior correlação ao desempenho lento.

Detalhes de traces lentos
O ARMS seleciona os 1.000 traces mais longos acima de um limiar configurável e amostra 1.000 traces abaixo dele. Ao comparar os dois grupos, o sistema destaca três características com maior correlação à alta latência.
Defina o limiar com base nos seus requisitos de desempenho. Por exemplo, para analisar traces mais lentos que 1 minuto, defina o limiar como 60000 milissegundos.

Análise de traces com falha
O ARMS seleciona aleatoriamente 1.000 traces com falha e identifica cinco dimensões com maior correlação às falhas.

Detalhes de traces com falha
O ARMS compara traces com falha contra traces normais e destaca três características com maior correlação aos erros.

Visualize detalhes do trace
Clique em em um id de trace para abrir a visualização de detalhes. Ela consiste em quatro seções:

Tags de componentes
As tags no topo da visualização agrupam os spans por tipo de chamada, conforme definido pelo campo attributes.component.name. Cada tag mostra o nome do tipo de chamada e sua contagem de spans. Clique em em uma tag para mostrar ou ocultar spans desse tipo.
Gráfico de barras da linha do tempo do trace
Um gráfico de barras horizontais fornece uma visão geral visual de todo o trace:
Cada barra representa um span. Apenas spans que excedem 1% da duração total do trace são mostrados.
As cores distinguem as aplicações. Por exemplo, o azul pode representar
opentelemetry-demo-adservice.Segmentos de linha preta dentro das barras indicam o tempo próprio — o tempo de processamento do span excluindo os spans filhos. Se o Span A leva 10 ms e seu filho Span B leva 8 ms, o tempo próprio do Span A é de 2 ms.
O eixo da linha do tempo mostra o intervalo de tempo do trace.
Árvore de spans e navegação
A árvore de spans exibe cada span como uma linha, mostrando as relações pai-filho por meio de recuo. Um número antes de cada span pai indica quantos spans filhos ele contém.
Controles disponíveis:
Recolher/Expandir: Clique em no ícone
para recolher ou expandir os filhos de um span.Focar: Clique em no ícone
para isolar um span e suas chamadas downstream.Desfocar: Clique em no ícone
para restaurar a visualização completa.Filtrar: Insira um nome de span, nome de aplicação ou atributo na caixa de pesquisa para filtrar a árvore. A visualização mostra o span correspondente e todos os spans ancestrais até o span de entrada. Limpe a caixa de pesquisa e clique em no ícone de Pesquisa para remover o filtro.
Zoom: Clique em no ícone
para ampliar e ocultar o gráfico de barras. Clique em no ícone
para restaurar o gráfico de barras.
Painel de detalhes do span
Selecione um span para visualize seus detalhes no painel direito:
Additional Information: Exibe atributos, recursos, detalhes e eventos do span, agrupados por tipo. Para definições de campos, consulte Parâmetros do Trace Explorer.
-
Metrics: Mostra métricas relacionadas ao span. Para aplicações Java monitoradas pelo ARMS, isso inclui métricas de JVM e do host. Para traces de agentes open-source, inclui métricas do Método RED (taxa, erros, duração).

Logs: Logs de negócio correlacionados com este trace. Se um Logstore do Simple Log Service (SLS) estiver configurado para a aplicação, clique em para consultar logs por id de trace.
Exceptions: Detalhes de exceções para o span selecionado, se houver.
Event Config: Configure eventos de interação personalizados para um ou mais atributos de span. Use esses eventos para vincular dados de trace a logs relacionados, métricas ou sistemas externos. Para instruções de configuração, consulte Configurar um evento de interação personalizado para um trace.
Desenvolvimento personalizado
Os dados de trace são armazenados no Simple Log Service (SLS) com as seguintes convenções de nomenclatura:
|
Parâmetro |
Formato |
Exemplo |
|
Nome do projeto |
|
|
|
Nome do Logstore |
|
|
Para definições de campos de dados, consulte Parâmetros do Trace Explorer. Para exemplos de criação de análises personalizadas sobre dados de trace armazenados, consulte Analisar dados de trace em tempo real usando o Trace Explorer.
ao lado da lista suspensa Aggregation Dimension.




