No Management Proxy Node: Coordinator randomly goes down

Abierto
#606 3 comentarios 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
5/5
Tiempo estimado
Más de una semana
Aptitud para principiantes
20/100
Tipo de issue
Error
Claridad
Necesita aclaración
Estado de actividad
Estancado
Stack tecnológico
azure, hadoop, kubernetes, postgresql, rust

Línea de trabajo

No se nombran archivos fuente, pruebas ni puntos de entrada. Comienza reproduciendo el fallo en Stackable 24.3 con Apache Druid 28.0.1 en AKS, usando la configuración de HDFS y PostgreSQL indicada; se considera terminado cuando se haya identificado la causa de la conexión faltante con el proxy de gestión y se haya confirmado la recuperación sin reiniciar todos los servicios.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

type/bug
Affected Stackable version

24.3

Affected Apache Druid version

28.0.1

Current and expected behavior

After roughly 3-4 days, the router will display "No Management Proxy Node." It seems, from testing, that the error is that the router cannot connect to the coordinator. However, all services display healthy logs and there are no clear errors, nor error codes from the panel.

The difficulty to debug comes from the fact that there are no errors.

Possible solution

The only way we have to recover from this state is to restart all services.

Additional context
  • Extensions: '["druid-kafka-indexing-service", "druid-datasketches", "prometheus-emitter", "druid-basic-security", "druid-opa-authorizer", "postgresql-metadata-storage", "druid-hdfs-storage", "druid-stats"]'
  • Deep Storage: HDFS
  • Metadata Store: Postgres
Environment

AKS

Would you like to work on fixing this bug?

None

Lenguaje dominante
Rust
Estrellas
12
Forks
1
Merge medio
1 d 17 h
PR fusionados (30 d)
10

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de stackabletech/druid-operator

Todos los issues de stackabletech/druid-operator

Issues similares

Más issues de Rust

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.