Hacktoberfest 2026: los issues que los mantenedores marcaron para octubre, abiertos y aptos para principiantes. Explorar issues de Hacktoberfest

音频caption支持输出带时间戳的吗

Abierto
#16 1 comentario 0 reacciones 0 asignados Ver en GitHub

Nadie ha tomado este issue todavía.

Evaluación

Dificultad
5/5
Tiempo estimado
Más de una semana
Aptitud para principiantes
42/100
Tipo de issue
Nueva funcionalidad
Claridad
Bastante claro
Estado de actividad
Tranquilo
Stack tecnológico
python

Línea de trabajo

El issue no menciona archivos, pruebas ni puntos de entrada. Empieza localizando el punto de entrada de inferencia de audio-captioning y su salida de captions actual; después, determina cómo deben encajar la segmentación automática de audio y los resultados con marcas de tiempo en la estructura start/end/caption solicitada; se considera terminado cuando se produzca esa salida estructurada.

Escrito por el modelo de indexación a partir del texto del issue.

Descripción

比如
[

{"start":0.0,"end":3.1,"caption":"dog barking"},

{"start":2.8,"end":7.0,"caption":"woman speaking"},

{"start":6.9,"end":12.0,"caption":"car engine starts"}

]
这样的,自动切割音频并分段caption

Lenguaje dominante
Python
Estrellas
667
Forks
45
Métricas de merge de PR
Sin PR fusionados en 30 d

Preparar el entorno

Aún no hemos revisado los archivos de configuración de este proyecto. Empieza por su README y consulta nuestra guía para la primera contribución para los pasos generales.

Primeros pasos

  1. Lee el issue completo y luego la guía de contribución del proyecto.
  2. Comenta en el issue que vas a ocuparte — evita que dos personas hagan lo mismo.
  3. Haz un fork del repositorio y trabaja en una rama.
  4. Abre un pull request que haga referencia al número del issue.

Más de OpenMOSS/MOSS-Audio

Todos los issues de OpenMOSS/MOSS-Audio

Issues similares

Más issues de Python

Recibe los nuevos issues en tu correo

Un resumen breve de issues de GitHub para principiantes.