Após a instalação do agente Python na sua aplicação de Large Language Model (LLM), o Application Real-Time Monitoring Service (ARMS) inicia o monitoramento. Na página Overview, visualize as principais métricas da aplicação LLM, como número de chamadas ao modelo, uso de tokens, contagem de traces e sessões.
Pré-requisitos
Instale o agente na sua aplicação LLM. Para mais informações, consulte Conectar uma aplicação LLM ou serviço de inferência ao ARMS.
Visão geral da aplicação LLM
Faça login no ARMS console. No painel de navegação à esquerda, escolha .
Na página Application list, selecione uma região no topo da página e clique em nome da aplicação desejada.
Na barra de navegação superior, clique em Overview.
Painel

Painel | Descrição |
Number of model calls | Número de vezes que a aplicação chamou o LLM no intervalo de tempo selecionado. |
Token usage | Total de tokens consumidos pela aplicação no intervalo de tempo selecionado. |
Trace count | Número de traces gerados pela aplicação no intervalo de tempo selecionado. |
Span count | Número de spans gerados pela aplicação no intervalo de tempo selecionado. |
Session count | Número de sessões iniciadas pela aplicação no intervalo de tempo selecionado. |
Number of users | Total de usuários únicos que interagiram com a aplicação no intervalo de tempo selecionado. |
Operation type distribution |
|
Avg LLM call per request | Média de chamadas ao LLM por requisição, calculada em intervalos de um minuto. |
Request count trend | Acompanha o número de requisições à aplicação LLM por minuto. |
Model call ranking | Lista os 5 LLMs mais frequentemente chamados na aplicação. |
User ranking by request count | Lista os 5 usuários que fizeram mais requisições na aplicação. |
Session count trend | Acompanha o número de sessões da aplicação LLM por minuto. |