kudu维表join 出来的数据会有重复

Abierto
#346 3 comentarios 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
4/5
Tiempo estimado
3-5 días
Aptitud para principiantes
25/100
Tipo de issue
Error
Claridad
Necesita aclaración
Estado de actividad
Estancado
Stack tecnológico
sql

Línea de trabajo

Comienza con el DDL de la tabla de dimensiones de Kudu proporcionado y reproduce el join contra d_goods_wlm_sku_rel. Inspecciona las filas resultantes y determina si los duplicados provienen de la semántica del join, de las claves de origen o de la configuración de caching. El trabajo estará terminado cuando el resultado esperado del join no contenga registros duplicados no intencionados, pero el issue necesita una consulta y una salida esperada antes de que pueda comenzar el trabajo.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

---kudu维表语句
CREATE TABLE side_rt_d_spu_sku_relation(
spu_id int,
sku_ids varchar,
PRIMARY KEY(spu_id),
PERIOD FOR SYSTEM_TIME
)WITH(
type ='kudu',
master ='xxxxxx'
tableName='d_goods_wlm_sku_rel',
cache ='LRU',
cacheSize ='10000',
cacheTTLMs ='60000',
parallelism ='1',
partitionedJoin='false'
);

Lenguaje dominante
Java
Estrellas
2k
Forks
913
Métricas de merge de PR
Sin PR fusionados en 30 d

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de DTStack/flinkStreamSQL

Todos los issues de DTStack/flinkStreamSQL

Issues similares

Más issues de Java

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.