Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

Add dataset: nb-tale

Abierto
#48 1 comentario 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
3/5
Tiempo estimado
1-2 días
Aptitud para principiantes
45/100
Tipo de issue
Nueva funcionalidad
Claridad
Bastante claro
Estado de actividad
Estancado
Área
content

Línea de trabajo

Comienza localizando las entradas de conjuntos de datos existentes en el repositorio y sus campos de metadatos obligatorios; después, compara el formato con la página del recurso NB Tale en https://www.nb.no/sprakbanken/ressurskatalog/oai-nb-no-sbr-31/. Se considerará terminado cuando NB Tale se haya añadido con su URL, modalidad de audio, licencia CC0, método de acceso, descripción y datos de contacto de la persona responsable.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

dataset
A URL for this dataset

https://www.nb.no/sprakbanken/ressurskatalog/oai-nb-no-sbr-31/

Dataset description

NB Tale is a basic acoustic-phonetic speech database for Norwegian. The database contains recordings of 380 speakers from 24 different dialect areas. The database is produced for the National Library of Norway by Lingit AS.

The data are divided into three modules:

  1. Manuscript-read speech from 240 native speakers of Norwegian, contains audio recordings, phonotypical annotation, informant data and documentation.

  2. Extension of module 1, 140 new speakers (20 native speakers, 120 with Norwegian as foreign language), contains audio recordings, phonotypical annotation, informant data and documentation.

  3. Recordings of spontaneous speech from speakers in module 1 and 2, on average around 2 minutes each, contains audio recordings, orthographic annotations (sentence-level) and documentation.

Dataset modality

Audio

Dataset licence

Creative Commons Zero v1.0 Universal

Other licence

No response

How can you access this data

As a download from a repository/website

Confirm the dataset has an open licence
  • To the best of my knowledge, this dataset is accessible via an open licence
Contact details for data custodian

[email protected]

Lenguaje dominante
Sin datos de lenguaje
Estrellas
91
Forks
8
Métricas de merge de PR
Sin PR fusionados en 30 d

Preparar el entorno

Este proyecto no incluye contenedor de desarrollo, Dockerfile ni guía de contribución, así que la configuración corre por tu cuenta: empieza por su README y consulta nuestra guía para la primera contribución para los pasos generales.

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de bigscience-workshop/lam

Todos los issues de bigscience-workshop/lam

Issues similares

Más issues de Content

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.