Skip to main content
Flowker puede emitir datos de OpenTelemetry para sus operaciones HTTP y de servicio. La telemetría es opcional: habilítala en el despliegue, envíala a tu collector y usa la API de ejecuciones para el estado y los resultados específicos de cada workflow.

Habilita y exporta la telemetría


Configura estas variables de entorno en el despliegue de Flowker:
Con la telemetría habilitada, Flowker inicializa sus instrumentos de telemetría y exporta mediante el endpoint OTLP configurado. No agregas instrumentación a workflows individuales, pero el despliegue debe proporcionar un collector accesible. Usa un endpoint https:// para un collector remoto; reserva un endpoint http:// en texto plano para un collector local al host o accesible solo por una red aislada. Flowker no aprovisiona dashboards de Grafana, retención ni reglas de alerta; esas decisiones pertenecen a tu plataforma de observabilidad.

Comprueba la salud del servicio


Flowker expone sondas compatibles con Kubernetes. GET /health es una comprobación de liveness: después de que pase su autocomprobación de inicio, devuelve 200 healthy y deliberadamente no llama a la base de datos, la caché ni servicios externos. GET /readyz es la comprobación de readiness para dependencias y el endpoint que debes usar cuando necesitas saber si Flowker puede atender solicitudes ahora.

Usa tu plataforma de observabilidad


Envía el stream OTLP al backend que opera tu plataforma, como Grafana, y construye allí los dashboards y las alertas. Mantén esos dashboards separados de la investigación de ejecuciones: la telemetría de solicitudes API no reemplaza el registro de ejecución. Para una ejecución individual de workflow, usa Obtener resultados de ejecución para consultar su estado, los resultados de los pasos y la salida final cuando esté presente. Un paso fallido puede incluir un errorMessage; esta respuesta no tiene un campo de detalles de error de nivel superior.

Cómo interpretar el estado de ejecución


Cada ejecución de workflow en Flowker tiene un estado que te indica en qué punto se encuentra.
Si ves una cantidad significativa de ejecuciones failed en un período corto, recopila sus ids de ejecución y detalles de error antes de escalar. Un patrón es más accionable que una falla aislada.

Cuándo involucrar a ingeniería


Escala a ingeniería cuando:
  • GET /readyz informa que una dependencia está caída
  • el collector OTLP no es accesible o rechaza el stream de telemetría
  • Las ejecuciones en estado failed superan el umbral de alerta que define tu despliegue y la causa no está clara
  • Flowker no procesa nuevas ejecuciones mientras readiness es correcto
Comparte los ids de ejecución, el período en UTC, los payloads de error de la API relevantes y la respuesta de /readyz. Si la telemetría está habilitada, incluye el enlace al collector o dashboard como evidencia complementaria.