Skip to main content
O Flowker pode emitir dados do OpenTelemetry para suas operações HTTP e de serviço. A telemetria é opcional: habilite-a na implantação, envie-a ao seu collector e use a API de execuções para status e resultados específicos do workflow.

Habilite e exporte a telemetria


Configure estas variáveis de ambiente na implantação do Flowker:
Com a telemetria habilitada, o Flowker inicializa seus instrumentos de telemetria e exporta pelo endpoint OTLP configurado. Você não adiciona instrumentação a workflows individuais, mas a implantação precisa fornecer um collector acessível. Use um endpoint https:// para um collector remoto; reserve um endpoint http:// em texto plano para um collector local ao host ou acessível apenas por uma rede isolada. O Flowker não provisiona dashboards do Grafana, retenção nem regras de alerta; essas decisões pertencem à sua plataforma de observabilidade.

Verifique a saúde do serviço


O Flowker expõe probes compatíveis com Kubernetes. GET /health é uma verificação de liveness: depois que a autoverificação de inicialização passa, ela retorna 200 healthy e deliberadamente não chama banco de dados, cache nem serviços externos. GET /readyz é a verificação de readiness de dependências e o endpoint a usar quando você precisa saber se o Flowker pode atender requisições agora.

Use sua plataforma de observabilidade


Envie o stream OTLP ao backend que a sua plataforma opera, como Grafana, e construa ali os dashboards e alertas. Mantenha esses dashboards separados da investigação de execuções: a telemetria de requisições da API não substitui o registro de execução. Para uma execução individual de workflow, use Obter resultados da execução para consultar seu status, os resultados das etapas e a saída final quando estiver presente. Uma etapa com falha pode incluir um errorMessage; esta resposta não tem um campo de detalhes de erro de nível superior.

Como interpretar o status das execuções


Cada execução de workflow no Flowker possui um status que indica em que ponto ela se encontra.
Se você observar um número significativo de execuções failed em um curto período, reúna os ids das execuções e os detalhes do erro antes de escalar. Um padrão é mais acionável que uma falha isolada.

Quando envolver a engenharia


Escale para a engenharia quando:
  • GET /readyz reportar uma dependência como indisponível
  • o collector OTLP estiver inacessível ou rejeitar o stream de telemetria
  • As execuções failed excederem o limite de alerta definido pelo deployment e a causa não estiver clara
  • O Flowker não estiver processando novas execuções enquanto a readiness estiver bem-sucedida
Compartilhe os ids de execução, o período em UTC, os payloads de erro de API relevantes e a resposta de /readyz. Se a telemetria estiver habilitada, inclua o link do collector ou dashboard como evidência complementar.