Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

Using AnnotationHub with job schedular causes an error

Abierto
#16 1 comentario 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
4/5
Tiempo estimado
3-5 días
Aptitud para principiantes
35/100
Tipo de issue
Error
Claridad
Bastante claro
Estado de actividad
Estancado
Stack tecnológico
r
Área
databases

Línea de trabajo

Comienza con ah.R y la inicialización de AnnotationHub() y, a continuación, reproduce el fallo usando el Snakefile proporcionado bajo OpenGridEngine o Slurm. Rastrea la configuración de la base de datos de caché en torno a las advertencias notificadas sobre cache_size, synchronous y las descargas; se considera terminado cuando los trabajos paralelos pueden recuperar y guardar recursos sin errores de base de datos de solo lectura.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

When using AnnotationHub in parallel with job schedular (OpenGridEngine and Slurm), whether a job can be calculated was stochastical and some jobs were failed with the error attempt to write a readonly database.

I don't know why but since some jobs can be calculated,
by performing the job queue, again and again, I could finally get the output.

As an alternative approach, by not using the job schedular,
I could perform the calculation without any error,
but it takes an enormous amount of time, so I want to know the reason for the error.

I wrote an Snakefile as follows:

rule all:
	input:
		expand('{id}.RData', id=list(range(24)))

rule ah:
	output:
		'{id}.RData'
	log:
		'logs/{id}.log'
	shell:
		'Rscript ah.R {id} >& {log}'

wrote the R-script (ah.R) as follows:

outfile = commandArgs(trailingOnly=TRUE)[1]
library("AnnotationHub")
ah = AnnotationHub()
id = names(ah)[sample(length(ah), 1)]
out = ah[[id]]
save(out, file=outfile)

and finally performed the snakemake workflow as follows:

# OpenGridEngine
snakemake -j 24 --cluster "qsub -S /bin/bash"

or

# Slurm
snakemake -j 24 --cluster sbatch

The error message was as follows:

Loading required package: BiocFileCache
Loading required package: dbplyr
snapshotDate(): 2019-10-29
downloading 1 resources
retrieving 1 resource
Error: failed to load resource
  name: AH39322
  title: E031-H3K23me2.imputed.pval.signal.bigwig
  reason: 1 resources failed to download
In addition: Warning messages:
1: Couldn't set cache size: attempt to write a readonly database
Use `cache_size` = NULL to turn off this warning.
2: Couldn't set synchronous mode: attempt to write a readonly database
Use `synchronous` = NULL to turn off this warning.
3: download failed
  hub path: ‘https://annotationhub.bioconductor.org/fetch/44762’
  cache resource: ‘AH39322 : 44762’
  reason: attempt to write a readonly database
Execution halted
Lenguaje dominante
R
Estrellas
20
Forks
16
Métricas de merge de PR
Sin PR fusionados en 30 d

Guía de contribución

No hay ninguna guía de contribución indexada para este repositorio

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de Bioconductor/AnnotationHub

Todos los issues de Bioconductor/AnnotationHub

Issues similares

Más issues de R

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.