我又来了, 还是中文断句继续优化的样本

オープン
#3,644 コメント 22 件 リアクション 0 件 担当者 0 名 GitHub で見る

まだ誰も着手していません。

評価

難易度
4/5
見積もり時間
3〜5日
初心者へのやさしさ
45/100
issue の種類
バグ
明瞭さ
説明が足りない
活発さ
活発
技術スタック
python

調査の方向性

まず、提供された curl コマンドでリンク先のサンプル音声をダウンロードし、FunASR 1.4.14 を使って字幕の途切れを再現します。文字起こしの入力がどのようにバッチまたはセグメントに分割されるかを追跡し、その後、指定された用語の周辺で報告されている中国語の文の区切りを比較します。Done には、根拠のない短い間隔での区切りが回避されることを示す、再現可能なテストまたはサンプルを含める必要があります。

索引モデルが issue の本文から書いたものです。

説明

bug needs triage

样本音频:
http://devv.cc:8999/mp3/从仲树看知识囤积癖_%23仲树_%23原生家庭_%23东亚文化.mp3
下载命令:
curl -O http://devv.cc:8999/mp3/从仲树看知识囤积癖_%23仲树_%23原生家庭_%23东亚文化.mp3

funasr 1.4.14

红色为字幕句间隙少于100ms的,按说这么小的间隙,没有充分的理由或特殊权重,是没有理由硬断的,它不识别 ”汉娜*阿伦特“ 和 “欧叶尼*葛郎台” 也就罢了。是否这些地方刚好位于分批或分段”喂料“ 的边界上?或者说:在这种特殊的字幕生成(transcription)工作模式下,喂入边界的方式是否就不应该存在?技术上应该有办法避开简陋的固定时长硬截段的方式吧?

图中的字幕起-止时间后的“60”是当前末与下句起始时间之间的gap时长。

Image Image Image Image
主要言語
Python
スター
20.4k
フォーク
2k
平均マージ
4時間 55分
マージ済み PR(30日)
169

コントリビューションガイド

コントリビューションガイドを開く

はじめの一歩

  1. issue を最後まで読み、次にプロジェクトのコントリビューションガイドを読みます。
  2. 着手することを issue にコメントします — 二人が同じ作業をするのを防げます。
  3. リポジトリをフォークし、ブランチを切って変更します。
  4. issue 番号を参照したプルリクエストを送ります。

modelscope/FunASR のほかの issue

modelscope/FunASR の issue をすべて見る

似ている issue

Python の issue をもっと見る

新しい issue をメールで受け取る

初心者向けの GitHub issue を短くまとめたダイジェスト。