Descubra por que a sua aplicação
está lenta ou fora do ar.
O KeepWatch acompanha as suas aplicações em produção e aponta qual serviço causou a lentidão ou o erro que o usuário sentiu, com o caminho completo do pedido na tela, sem depender de quem domina a ferramenta.
Como o KeepWatch funciona?
As aplicações passam a contar o que acontece em cada pedido do usuário. O KeepWatch junta isso, desenha como os serviços dependem uns dos outros e responde na tela quem está causando o problema.
Recebe
Cada aplicação passa a informar o que acontece em cada pedido: quanto demorou, o que deu errado e por onde o pedido passou. O envio usa padrão aberto, sem agente proprietário.
padrão aberto · sem agente proprietárioJunta
Tudo que aconteceu num mesmo pedido fica ligado. O time deixa de juntar informação de três telas diferentes para entender um único incidente.
um incidente, uma telaMapeia
O mapa mostra quais serviços conversam entre si e qual deles está segurando os outros. Ele se desenha sozinho, sem ninguém cadastrar a topologia.
desenhado sozinhoResponde
As perguntas são montadas clicando. Quem está de plantão tira a própria resposta, sem esperar pela pessoa que domina a ferramenta.
sem linguagem de consultaAs quatro telas que o seu time abre no plantão.
Mapa de dependências, caminho do pedido, mensagens de erro e números da operação. As demonstrações abaixo respondem ao clique, com dados de um ambiente de exemplo.
O mapa mostra quem depende de quem e onde trava.
Cada caixa é um serviço da sua aplicação, com quanto ele é chamado, quanto erro está dando e quanto tempo leva para responder. As linhas ligam quem chama a quem responde. A cor diz se o serviço está bem, em atenção ou crítico. Serviço de fora da sua empresa aparece com borda tracejada.
- ✓Volume, erro e tempo de resposta em cada serviço
- ✓O mapa se desenha sozinho, sem ninguém cadastrar nada
- ✓A mesma informação em lista, quando a leitura é por número
Veja um pedido inteiro e onde ele perdeu tempo.
Cada barra é uma etapa do pedido. Onde ela começa é o momento em que aquela etapa rodou. O comprimento é quanto ela demorou. No exemplo ao lado o pedido levou 158 ms, dos quais a análise de risco sozinha consumiu 62%: é o serviço que está segurando o cliente. Clique numa linha da lista para abrir outro pedido.
- ✓Ordenar pelos pedidos mais lentos, que são os que doem
- ✓Filtrar por aplicação, por serviço ou só pelo que deu erro
- ✓Cada etapa mostra o serviço responsável e quanto ela custou
Da mensagem de erro para o pedido que a gerou.
A tela mostra quanto a aplicação está registrando, separado por gravidade, além de quais serviços mais erram. Cada mensagem sabe a qual pedido pertence. Um clique leva da mensagem solta para o pedido inteiro, com tudo que aconteceu nele.
- ✓Quanto está sendo registrado e quem mais erra
- ✓Busca por palavra e filtro por gravidade
- ✓Da mensagem de erro para o pedido inteiro
A pergunta é montada clicando, sem linguagem de consulta.
Você escolhe o que quer medir, como quer resumir e como quer separar, tudo numa lista. Quem está de plantão tira a própria resposta, sem depender da pessoa que domina a linguagem de consulta. Troque a forma de resumir ao lado para ver o gráfico mudar.
- ✓Média, soma e os cortes de pior caso na mesma lista
- ✓Separação por aplicação, por serviço ou por cliente
- ✓Gráfico, número ou tabela, salvos para reusar depois
O que a sua equipe precisa fazer para começar.
Cada aplicação passa a enviar para um endereço, com uma chave própria. Se uma chave vazar, você revoga só ela. Se uma aplicação mandar dado demais, o limite corta só ela. Nada é recusado em silêncio: o que não entrou aparece na tela, com o motivo.
- ✓Endereço único, no padrão aberto que o mercado usa
- ✓Uma chave por aplicação, revogável sem parar as outras
- ✓Limite de volume por aplicação, definido por você
https://keepwatch.opservices.com:4318https://keepwatch.opservices.com:4317…:4318/v1/metrics…:4318/v1/traces…:4318/v1/logsAuthorization: Bearer <chave de ingestão>De onde vem cada dado que está aqui dentro.
A tela mostra quais aplicações estão entregando, o que cada uma manda e quando chegou o último dado. Aplicação nova não precisa de cadastro: assim que passa a enviar, aparece na lista. É por aqui que se percebe quando uma aplicação parou de reportar.
- ✓O que cada aplicação entrega e se segue entregando
- ✓Volume da última hora e a hora do último dado recebido
- ✓Ritmo de cada aplicação, medido pelo que chega
| ESTADO | SERVIÇO | SINAIS QUE ENTREGA | ÚLTIMO DADO | RITMO |
|---|---|---|---|---|
| entregando | banco-antifraude | métricaslogstraces | há 11s | 1 min |
| entregando | banco-app | tracesmétricaslogs | há 7s | 1 min |
| entregando | banco-contas | traceslogsmétricas | há 6s | 1 min |
| entregando | crm-api | tracesmétricaslogs | há 11s | 1 min |
Como o KeepWatch entra na sua aplicação.
Não é projeto de meses. Onde a aplicação já informa o que faz, o trabalho é trocar um endereço. Onde não informa, as bibliotecas prontas cobrem a maior parte sem alterar código.
Levantamento
Definimos com você quais aplicações entram primeiro e qual pergunta a operação não consegue responder hoje. É essa pergunta que mede se deu certo.
Instrumentação
As aplicações passam a enviar para o KeepWatch, cada uma com a sua chave. As bibliotecas prontas cobrem chamadas web, banco e fila sem alterar o código que o seu time escreveu.
Ajuste
O que conta como lento e o que conta como erro é calibrado com a sua operação. Nada de padrão de fábrica. O limite de volume é definido por aplicação.
Operação
O plantão passa a responder sozinho onde está o problema. A dependência de uma pessoa específica para achar a causa deixa de existir.
Do sensor ao usuário final, três produtos que conversam.
O KeepMonitor monitora a infraestrutura, o KeepWatch observa a aplicação e o KeepGreen concentra os eventos dos dois e aciona o plantão.
KeepMonitor
Monitoramento de infraestrutura
KeepWatch
Observabilidade de aplicações
você está aquiKeepGreen
Central de eventos 24/7 com IA
Perguntas que times de engenharia fazem.
As dúvidas que aparecem em toda primeira conversa.
Onde a aplicação já informa o que faz, o trabalho é trocar um endereço de destino. Onde ainda não informa, as bibliotecas prontas cobrem chamadas web, banco e fila sem alterar o código que o seu time escreveu. A primeira aplicação costuma entrar em dias, não em meses.
Não. O KeepWatch recebe no padrão aberto OpenTelemetry, que é o mesmo que as outras ferramentas do mercado usam. O que o seu time configurar continua valendo se um dia você trocar de fornecedor. O dado continua sendo seu.
Não é a intenção. As perguntas são montadas clicando: escolhe-se o que medir, como resumir e como separar. Quem está de plantão tira a própria resposta sem escrever consulta e sem esperar pela pessoa que domina a ferramenta.
Cada pedido do usuário recebe um identificador que acompanha todas as chamadas que ele dispara. É por esse identificador que o gráfico, a mensagem de erro e o caminho do pedido se encontram, numa tela só.
Existe limite por aplicação. O que passa do limite é recusado na entrada. A recusa aparece na tela com o motivo, sem sumir calada. Como a chave é por aplicação, dá para cortar só a que está exagerando, sem parar as outras.
O KeepMonitor monitora a infraestrutura, o KeepWatch observa a aplicação e o KeepGreen concentra os eventos dos dois e aciona o plantão. São três produtos da mesma família, cobrindo do sensor ao usuário final.
Agende uma conversa com nossos especialistas!
Você conta qual aplicação a sua operação não consegue explicar hoje. A gente mostra as mesmas telas com dados de um ambiente parecido com o seu.
- ✓Conversa de 30 minutos, sem compromisso
- ✓Do outro lado da conversa, um engenheiro de operação
- ✓Avaliação do esforço real para as suas aplicações
- ✓Padrão aberto: o dado continua seu, sem ficar preso