Hacktoberfest 2026: những issue maintainer đã đánh dấu cho tháng Mười, đang mở và phù hợp người mới. Xem issue Hacktoberfest

音频caption支持输出带时间戳的吗

Đang mở
#16 1 bình luận 0 reaction 0 người được giao Xem trên GitHub

Chưa có ai nhận issue này.

Đánh giá

Độ khó
5/5
Thời gian dự kiến
Hơn một tuần
Mức phù hợp với người mới
42/100
Loại issue
Tính năng
Độ rõ ràng
Khá rõ ràng
Mức độ hoạt động
Ít trao đổi
Công nghệ
python
Lĩnh vực
machine-learning

Hướng nghiên cứu

Issue không nêu tên tệp, bài kiểm thử hay entry point nào. Hãy bắt đầu bằng việc xác định entry point suy luận của audio-captioning và đầu ra caption hiện tại, sau đó xác định cách phân đoạn audio tự động và các kết quả có timestamp cần được đưa vào cấu trúc start/end/caption được yêu cầu; hoàn thành nghĩa là tạo ra đầu ra có cấu trúc đó.

Do mô hình lập chỉ mục viết ra từ nội dung của issue.

Mô tả

比如
[

{"start":0.0,"end":3.1,"caption":"dog barking"},

{"start":2.8,"end":7.0,"caption":"woman speaking"},

{"start":6.9,"end":12.0,"caption":"car engine starts"}

]
这样的,自动切割音频并分段caption

Ngôn ngữ chính
Python
Star
667
Fork
45
Chỉ số merge pull request
Không có pull request nào được merge trong 30 ngày

Chuẩn bị môi trường

Chúng tôi chưa kiểm tra các tệp thiết lập môi trường của dự án này. Hãy bắt đầu từ README và xem hướng dẫn đóng góp lần đầu của chúng tôi để biết các bước chung.

Bắt đầu từ đâu

  1. Đọc hết issue, rồi đọc hướng dẫn đóng góp của dự án.
  2. Bình luận trên issue rằng bạn sẽ nhận — tránh hai người làm cùng một việc.
  3. Fork repository và làm thay đổi trên một nhánh.
  4. Mở pull request có tham chiếu số hiệu của issue.

Issue khác của OpenMOSS/MOSS-Audio

Tất cả issue của OpenMOSS/MOSS-Audio

Issue tương tự

Thêm issue về Python

Nhận issue mới trong hộp thư của bạn

Bản tóm tắt ngắn những issue GitHub phù hợp với người mới.