Skip to main content
Flowker puede emitir datos de OpenTelemetry para sus operaciones HTTP y de servicio. La telemetría es opcional: habilítala en el despliegue, envíala a tu collector y usa la API de ejecuciones para el estado y los resultados específicos de cada workflow.

Habilitar y exportar la telemetría


Define estas variables de entorno en el despliegue de Flowker:
Con la telemetría habilitada, Flowker inicializa sus instrumentos de telemetría y exporta a través del endpoint OTLP configurado. No agregas instrumentación a workflows individuales, pero el despliegue debe proveer un collector alcanzable. Usa un endpoint https:// para un collector remoto. Reserva un endpoint http:// en texto plano para un collector que sea local al host o alcanzable solo por una red aislada. Flowker no aprovisiona dashboards de Grafana, retención ni reglas de alerta. Esas son decisiones de tu plataforma de observabilidad.

Verificar la salud del servicio


Flowker expone sondas compatibles con Kubernetes. El endpoint GET /health es una verificación de liveness. Después de que pasa su autosonda de arranque, devuelve 200 healthy y deliberadamente no llama a la base de datos, al cache ni a servicios downstream. El endpoint GET /readyz es la verificación de readiness de las dependencias. Úsalo cuando necesites saber si Flowker puede atender solicitudes ahora.

Usar tu plataforma de observabilidad


Enruta el stream OTLP al backend que opera tu plataforma, como Grafana, y construye ahí los dashboards y las alertas. Mantén esos dashboards separados de la investigación de ejecuciones: la telemetría de solicitudes de API no reemplaza el registro de ejecución. Para una ejecución individual de un workflow, usa Get execution results para ver su estado, sus resultados de paso y su salida final cuando esté presente. Un paso fallido puede incluir un errorMessage. Esta respuesta no tiene un campo de detalles de error en el nivel superior.

Cómo interpretar el estado de una ejecución


Cada ejecución de workflow en Flowker tiene un estado que te dice en qué punto está.
Si ves un número significativo de ejecuciones failed en un periodo corto, recopila sus ids de ejecución y sus detalles de error antes de escalar.

Cuándo involucrar a ingeniería


Escala a ingeniería cuando:
  • GET /readyz reporta una dependencia caída
  • el collector OTLP no es alcanzable o rechaza el stream de telemetría
  • las ejecuciones failed superan el umbral de alerta que define tu despliegue y la causa no está clara
  • Flowker no procesa nuevas ejecuciones mientras el readiness es exitoso
Comparte los ids de ejecución, el intervalo de tiempo en UTC, los payloads de error relevantes de la API y la respuesta de /readyz. Con la telemetría habilitada, incluye el enlace al collector o al dashboard como evidencia de respaldo.