Após a instalação do agente Python na sua aplicação de Large Language Model (LLM), o Application Real-Time Monitoring Service (ARMS) inicia o monitoramento automaticamente. A página Conversation Analysis lista as sessões de um período especificado e permite examinar os detalhes de cada uma.
Pré-requisitos
Instale um agente na sua aplicação LLM. Para mais informações, consulte Integrar uma aplicação LLM ou serviço de inferência ao ARMS.
Procedimento
Faça login no console do ARMS. No painel de navegação à esquerda, escolha .
Na página Application List, selecione uma região na parte superior da página e clique em nome da sua aplicação.
Na barra de navegação superior, clique em Conversation Analysis.
Clique em caixa de pesquisa. Na lista suspensa, filtre as sessões por critérios como ID da sessão, usuário, duração da sessão, número de traces, total de tokens, tokens de entrada e tokens de saída.
-
A lista de sessões exibe informações sobre cada sessão, incluindo Duration, Tokens (com input tokens e output tokens), Number of Traces, User e Start Time.
Clique em nome da sessão ou em Details na coluna Actions para visualizar os detalhes da sessão.
Clique em um ID de trace para visualizar seus detalhes. Para mais informações, consulte Análise de traces de LLM.
O topo da página de detalhes da sessão apresenta métricas resumidas, como Session ID, total duration, total tokens e number of traces. A seção Basic Information mostra campos como Start Time, user ID e model name. Um gráfico de Gantt no centro da página ilustra a distribuição do tempo de execução de cada trace. Abaixo do gráfico, cartões detalhados fornecem o ID do trace, a contagem de tokens e o detalhamento do uso de tokens por modelo para cada trace.