Clarification on high Nfail counts in modkit pileup output despite valid coverage
Nadie ha tomado este issue todavía.
Evaluación
- Dificultad
- 5/5
- Tiempo estimado
- Más de una semana
- Aptitud para principiantes
- 30/100
- Tipo de issue
- Documentación
- Claridad
- Necesita aclaración
- Estado de actividad
- Estancado
- Stack tecnológico
- rust
- Área
- bioinformatics, cli
Línea de trabajo
Start with the modkit pileup entry point and the definitions of Nfail, valid_coverage, count_modified, and count_canonical in the documentation. Reproduce the reported command with the stated filters, then document which filters produce Nfail and how min-mod-prob affects interpretation; done means the questions have a clear, supported explanation.
Escrito por el modelo de indexación a partir del texto del issue.
Descripción
Hi modkit team,
I am analyzing CpG methylation using modkit pileup on Oxford Nanopore data
(mapped BAMs, reference-guided).
Across multiple samples, I observe that the majority of reads contributing to
coverage end up in the Nfail column, even when valid_coverage ≥ 3.
Some details:
-
Genome: Plasmodium falciparum 3D7
-
Command used (example):
modkit pileup
--reference PlasmoDB-64_Pfalciparum3D7_Genome.fasta
--modified-bases C
--combine-mods
input.bam output.bed -
In the resulting bedMethyl files:
- valid_coverage is often high (≥3 for many CpGs)
- count_modified and count_canonical are low
- most reads appear to be classified as Nfail
- fraction of methylated CpGs among covered sites is very low
This behavior is consistent across samples and across different coverage cutoffs.
My questions:
- Is a high Nfail count expected behavior in cases of low-confidence or low-level CpG methylation?
- Which filters most commonly cause reads to be classified as Nfail?
(e.g. modification probability threshold, basecall quality, alignment flags, context mismatch) - Is there a recommended way to summarize or interpret datasets where
valid coverage exists but most reads fail confidence filters? - Would adjusting parameters like min-mod-prob be appropriate to explore this further?
The behavior seems biologically plausible for this organism, but I would like
to confirm that my interpretation of Nfail is correct.
Thanks for the great tool, and for any clarification!
- Lenguaje dominante
- Rust
- Estrellas
- 274
- Forks
- 33
- Métricas de merge de PR
- Sin PR fusionados en 30 d
Guía de contribución
No hay ninguna guía de contribución indexada para este repositorio
Primeros pasos
- Lee el issue completo y luego la guía de contribución del proyecto.
- Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
- Haz un fork del repositorio y trabaja en una rama.
- Abre un pull request que haga referencia al número del issue.
Más de nanoporetech/modkit
-
bug
Dificultad 2/5 1-3 horas Aptitud para principiantes 68/100
nanoporetech/modkit#520 · 2 comentarios ·
-
Samtools code for modkit repair Abiertodocumentation
Dificultad 1/5 Menos de una hora Aptitud para principiantes 65/100
nanoporetech/modkit#336 · 1 comentario ·
-
modkit probability threshold Abierto
Dificultad 5/5 Más de una semana Aptitud para principiantes 25/100
nanoporetech/modkit#723 ·
-
Dificultad 3/5 1-2 días Aptitud para principiantes 66/100
nanoporetech/modkit#721 · 1 comentario ·
-
Dificultad 4/5 3-5 días Aptitud para principiantes 55/100
nanoporetech/modkit#719 ·
Todos los issues de nanoporetech/modkit
Issues similares
-
Dificultad 2/5 1-3 horas Aptitud para principiantes 76/100
-
bug good first issue package: quic
Dificultad 2/5 1-3 horas Aptitud para principiantes 78/100
-
Dificultad 1/5 Menos de una hora Aptitud para principiantes 78/100
-
`dora trace view` sends a non-canonical full UUID as-is, so a valid trace ID shows "No spans found" Abiertocli coordinator rust
Dificultad 2/5 1-3 horas Aptitud para principiantes 88/100
-
area: tasks enhancement good first issue help wanted
Dificultad 2/5 1-3 horas Aptitud para principiantes 88/100
Jason-jo17/Polybench#15 · 1 comentario ·