KeepWatch Agendar uma Demo
Observabilidade de Aplicações

Descubra por que a sua aplicação
está lenta ou fora do ar.

O KeepWatch acompanha as suas aplicações em produção e aponta qual serviço causou a lentidão ou o erro que o usuário sentiu, com o caminho completo do pedido na tela, sem depender de quem domina a ferramenta.

A tela que o time abre de manhã · última hora
keepwatch.opservices.com
Dashboards / Home
Saúde das aplicações
46 serviços e dependências no período · limiares padrão: erro > 5% · p95 > 500 ms
1 hora
REQUISIÇÕES
7.560
−19% vs. período anterior
TAXA DE ERRO
5,7%
▲ 0,1 pp vs. período anterior
LATÊNCIA P95
671 ms
▼ 55 ms vs. período anterior
PIORANDO
12 de 46
serviços com piora relevante
loja 7 serviços · 3 bancos · 3 APIs externas
0,4REQ/S
13,0%ERRO
846 msP95
COMPONENTES COM PROBLEMA (8)
loja-web13,0%
loja-pagamento12,7%
loja-catalogo9,8%
api.mailfog.io externo5,7%
frota 3 serviços · 3 bancos · 2 APIs externas
0,6REQ/S
8,8%ERRO
231 msP95
COMPONENTES COM PROBLEMA (3)
frota-gps8,8%
api.mapafacil.com.br externo5,3%
frota-gateway3,5%
+25 anossustentando operação de TI de grandes empresas no Brasil
+700projetos de monitoramento gerenciados pela OpServices
Padrão abertoo dado é seu, em formato que qualquer ferramenta lê
pt-BRsuporte em português, de quem opera ambiente igual ao seu
Como funciona

Como o KeepWatch funciona?

As aplicações passam a contar o que acontece em cada pedido do usuário. O KeepWatch junta isso, desenha como os serviços dependem uns dos outros e responde na tela quem está causando o problema.

01

Recebe

Cada aplicação passa a informar o que acontece em cada pedido: quanto demorou, o que deu errado e por onde o pedido passou. O envio usa padrão aberto, sem agente proprietário.

padrão aberto · sem agente proprietário
02

Junta

Tudo que aconteceu num mesmo pedido fica ligado. O time deixa de juntar informação de três telas diferentes para entender um único incidente.

um incidente, uma tela
03

Mapeia

O mapa mostra quais serviços conversam entre si e qual deles está segurando os outros. Ele se desenha sozinho, sem ninguém cadastrar a topologia.

desenhado sozinho
04

Responde

As perguntas são montadas clicando. Quem está de plantão tira a própria resposta, sem esperar pela pessoa que domina a ferramenta.

sem linguagem de consulta
A plataforma

As quatro telas que o seu time abre no plantão.

Mapa de dependências, caminho do pedido, mensagens de erro e números da operação. As demonstrações abaixo respondem ao clique, com dados de um ambiente de exemplo.

Serviços

O mapa mostra quem depende de quem e onde trava.

Cada caixa é um serviço da sua aplicação, com quanto ele é chamado, quanto erro está dando e quanto tempo leva para responder. As linhas ligam quem chama a quem responde. A cor diz se o serviço está bem, em atenção ou crítico. Serviço de fora da sua empresa aparece com borda tracejada.

  • Volume, erro e tempo de resposta em cada serviço
  • O mapa se desenha sozinho, sem ninguém cadastrar nada
  • A mesma informação em lista, quando a leitura é por número
keepwatch.opservices.com/servicos
Explorar / Serviços
Serviços
24 serviços no período
arraste para mover · Ctrl + roda para aproximar OkAtençãoCrítico
user quem chama de fora banco-app 23/min · 1,6% · p95 249 ms frota-gps 34/min · 8,8% · p95 231 ms loja-catalogo 22/min · 9,8% · p95 219 ms banco-antifraude 6,7/min · 1,5% · p95 688 ms banco-contas 23/min · 0,1% · p95 45 ms frota-rastreamento 19/min · 0,0% · p95 220 ms api.mapafacil.com externo · 5,3% · p95 10 ms api.mailfog.io externo · 5,7% · p95 10 ms
Limiares padrão: erro > 5% · p95 > 500 ms
Traces

Veja um pedido inteiro e onde ele perdeu tempo.

Cada barra é uma etapa do pedido. Onde ela começa é o momento em que aquela etapa rodou. O comprimento é quanto ela demorou. No exemplo ao lado o pedido levou 158 ms, dos quais a análise de risco sozinha consumiu 62%: é o serviço que está segurando o cliente. Clique numa linha da lista para abrir outro pedido.

  • Ordenar pelos pedidos mais lentos, que são os que doem
  • Filtrar por aplicação, por serviço ou só pelo que deu erro
  • Cada etapa mostra o serviço responsável e quanto ela custou
keepwatch.opservices.com/traces
Explorar / Traces
Traces
7.905 pedidos no período · 2,8% com erro
POST /pix trace 9f2c41a8e0b7
158,3 ms
0 ms158,3 ms
POST /pix banco-app
158,3 ms · 100%
valida pagador banco-app
8,4 ms · 5%
POST /analise banco-antifraude
98,6 ms · 62%
debita conta banco-contas
41,2 ms · 26%
publica evento banco-app
2,1 ms · 1%
INÍCIOMÉTODOOPERAÇÃOSERVIÇOSDURAÇÃOSPANS
Logs

Da mensagem de erro para o pedido que a gerou.

A tela mostra quanto a aplicação está registrando, separado por gravidade, além de quais serviços mais erram. Cada mensagem sabe a qual pedido pertence. Um clique leva da mensagem solta para o pedido inteiro, com tudo que aconteceu nele.

  • Quanto está sendo registrado e quem mais erra
  • Busca por palavra e filtro por gravidade
  • Da mensagem de erro para o pedido inteiro
keepwatch.opservices.com/logs
Explorar / Logs
Logs
VOLUME POR NÍVELpor 15 s
erro 80 aviso 112 info 4.787
ERROS POR SERVIÇOtop 5
loja-catalogo 15
loja-pagamento 11
loja-estoque 9
loja-web 9
frota-gateway 8
12:43:18.323 info banco-contas
saldo da conta 24685 respondido TRACE
12:43:18.252 info loja-estoque
reservados 2 item(ns) para o pedido 2290a59c TRACE
12:43:17.980 erro loja-pagamento
gateway recusou: emissor indisponível (502) TRACE
12:43:16.665 info banco-app
pix enviado pela conta 28373 TRACE
12:43:15.104 aviso loja-catalogo
consulta ao catálogo levou 121 ms TRACE
12:43:14.870 erro frota-gps
posição recusada pela api.mapafacil.com.br TRACE
Métricas

A pergunta é montada clicando, sem linguagem de consulta.

Você escolhe o que quer medir, como quer resumir e como quer separar, tudo numa lista. Quem está de plantão tira a própria resposta, sem depender da pessoa que domina a linguagem de consulta. Troque a forma de resumir ao lado para ver o gráfico mudar.

  • Média, soma e os cortes de pior caso na mesma lista
  • Separação por aplicação, por serviço ou por cliente
  • Gráfico, número ou tabela, salvos para reusar depois
keepwatch.opservices.com/metricas
Explorar / Métricas
Métricas
Monte a pergunta escolhendo o que medir, o filtro e como resumir.
1 hora
traces_service_graph_request_client por nenhum rótulo
média de todas as séries 0,043
1 de 1 série · um ponto a cada 1 min · 11:43 → 12:43
Coletor

O que a sua equipe precisa fazer para começar.

Cada aplicação passa a enviar para um endereço, com uma chave própria. Se uma chave vazar, você revoga só ela. Se uma aplicação mandar dado demais, o limite corta só ela. Nada é recusado em silêncio: o que não entrou aparece na tela, com o motivo.

  • Endereço único, no padrão aberto que o mercado usa
  • Uma chave por aplicação, revogável sem parar as outras
  • Limite de volume por aplicação, definido por você
keepwatch.opservices.com/coletor
Configuração / Coletor
Endereço de ingestão
É para cá que as suas aplicações passam a enviar.
OTLP HTTPhttps://keepwatch.opservices.com:4318
OTLP gRPChttps://keepwatch.opservices.com:4317
SE A FERRAMENTA PEDE A URL COMPLETA
métricas…:4318/v1/metrics
traces…:4318/v1/traces
logs…:4318/v1/logs
autenticaçãoAuthorization: Bearer <chave de ingestão>
A conexão é cifrada (HTTPS/TLS). Se a sua ferramenta tem uma opção chamada insecure ou plaintext, ela precisa ficar desligada.
Datasources

De onde vem cada dado que está aqui dentro.

A tela mostra quais aplicações estão entregando, o que cada uma manda e quando chegou o último dado. Aplicação nova não precisa de cadastro: assim que passa a enviar, aparece na lista. É por aqui que se percebe quando uma aplicação parou de reportar.

  • O que cada aplicação entrega e se segue entregando
  • Volume da última hora e a hora do último dado recebido
  • Ritmo de cada aplicação, medido pelo que chega
keepwatch.opservices.com/datasources
Configuração / Datasources
As aplicações mandam
28 aplicações entregando, nenhuma delas cadastrada à mão.
ESTADOSERVIÇOSINAIS QUE ENTREGAÚLTIMO DADORITMO
entregando banco-antifraude métricaslogstraces há 11s 1 min
entregando banco-app tracesmétricaslogs há 7s 1 min
entregando banco-contas traceslogsmétricas há 6s 1 min
entregando crm-api tracesmétricaslogs há 11s 1 min
Volume de 60 min do banco-antifraude: 590 datapoints de métrica, 325,8 KiB de log e 350,9 KiB de trace.
Implantação

Como o KeepWatch entra na sua aplicação.

Não é projeto de meses. Onde a aplicação já informa o que faz, o trabalho é trocar um endereço. Onde não informa, as bibliotecas prontas cobrem a maior parte sem alterar código.

PASSO 01

Levantamento

Definimos com você quais aplicações entram primeiro e qual pergunta a operação não consegue responder hoje. É essa pergunta que mede se deu certo.

PASSO 02

Instrumentação

As aplicações passam a enviar para o KeepWatch, cada uma com a sua chave. As bibliotecas prontas cobrem chamadas web, banco e fila sem alterar o código que o seu time escreveu.

PASSO 03

Ajuste

O que conta como lento e o que conta como erro é calibrado com a sua operação. Nada de padrão de fábrica. O limite de volume é definido por aplicação.

PASSO 04

Operação

O plantão passa a responder sozinho onde está o problema. A dependência de uma pessoa específica para achar a causa deixa de existir.

Família Keep

Do sensor ao usuário final, três produtos que conversam.

O KeepMonitor monitora a infraestrutura, o KeepWatch observa a aplicação e o KeepGreen concentra os eventos dos dois e aciona o plantão.

FAQ

Perguntas que times de engenharia fazem.

As dúvidas que aparecem em toda primeira conversa.

Fale com a gente

Agende uma conversa com nossos especialistas!

Você conta qual aplicação a sua operação não consegue explicar hoje. A gente mostra as mesmas telas com dados de um ambiente parecido com o seu.

  • Conversa de 30 minutos, sem compromisso
  • Do outro lado da conversa, um engenheiro de operação
  • Avaliação do esforço real para as suas aplicações
  • Padrão aberto: o dado continua seu, sem ficar preso

Agendar uma Demonstração

Respondemos no mesmo dia útil.
Seus dados ficam aqui. Não vendemos e não passamos para parceiro.