論文の概要: Assessing the Reusability of Public Speech Resources for Low-Resource Languages: A Central Kurdish Case Study
- arxiv url: http://arxiv.org/abs/2609.11246v1
- Date: Thu, 10 Sep 2026 08:43:42 GMT
- ステータス: 翻訳完了
- システム内更新日: 2026-09-11 23:53:35.26022
- Title: Assessing the Reusability of Public Speech Resources for Low-Resource Languages: A Central Kurdish Case Study
- Title(参考訳): 低リソース言語における公開音声資源の再利用性の評価 : クルド中部の事例研究
- Abstract要約: クルド語は何百万人もの人々に話されているが、それを読む技術はほとんどない。
最近の研究では、3つのクルド人の声、35時間の録音されたスピーチ、そしてその作品を記述した論文が無料で公開されている。
このレビューでは、これらの公開ファイルが論文とどの程度よく一致しているかを確認します。
- 参考スコア(独自算出の注目度): 0.0
- License: http://arxiv.org/licenses/nonexclusive-distrib/1.0/
- Abstract: Kurdish is spoken by millions of people, but little technology can read it aloud. A recent study released three Kurdish voices, 35 hours of recorded speech, and a paper describing the work, all free to download. This review checks how well those public files match the paper. The research is careful about its limits, but the files contain several problems: a settings file lists equipment that was never used, test recordings are left unlabeled among training data, and a coding fault mishandles long numbers. The download page also claims a stronger result than the paper reports and recommends one voice for general use. That recommendation matters because Kurdish has major regional and written variation, while these voices were built from three people reading prepared texts. The process therefore removes much everyday and regional speech. English and German benefit from long traditions of dictionaries and linguistic description that help identify wrong pronunciations; Kurdish has far less such support, so software choices can go unchecked. The voices sound fluent, but they represent the reading styles of their speakers rather than Kurdish as a whole. Most of these issues can be fixed using information the team already has, without changing the reported results. Better records would mainly make the work easier for others, especially community linguists, to check and reuse. The license is the main exception: whether audiobook owners allow corrected versions to be shared will affect whether future Kurdish voices can build on this work or must start again.
- Abstract(参考訳): クルド語は何百万人もの人々に話されているが、それを読む技術はほとんどない。
最近の研究では、3つのクルド人の声、35時間の録音されたスピーチ、そしてその作品を記述した論文が無料で公開されている。
このレビューでは、これらの公開ファイルが論文とどの程度よく一致しているかを確認します。
この研究は限界に注意を払っているが、ファイルにはいくつかの問題がある。設定ファイルには使用されていない機器がリストされ、テスト記録はトレーニングデータにラベル付けされていない。
ダウンロードページでは、レポートよりも強力な結果が報告されており、一般的な使用のために1つの音声を推奨している。
この推奨事項は、クルド語が主要な地域や文字のバリエーションを持つのに対して、これらの声は準備されたテキストを読んでいる3人から作られていたためである。
このプロセスにより、日常的および地域的なスピーチが取り除かれる。
英語とドイツ語は、間違った発音を特定するのに役立つ辞書や言語記述の長い伝統から恩恵を受けている。
声は流麗に聞こえるが、概してクルド語ではなく、彼らの話者の読み方を表している。
これらの問題のほとんどは、報告された結果を変更することなく、チームがすでに持っている情報を使って修正することができる。
より良い記録は、主に他の言語学者、特にコミュニティ言語学者にとって、チェックと再利用を容易にするだろう。
オーディオブック所有者が修正版の共有を許可するかどうかは、将来のクルド語音声がこの作業で構築できるかどうか、あるいは再び開始する必要があるかどうかに影響を及ぼす。
関連論文リスト
- Which one Performs Better? Wav2Vec or Whisper? Applying both in Badini Kurdish Speech to Text (BKSTT) [1.174020933567308]
本研究では,バディーニの発話に基づく言語モデルを作成し,その性能を評価する。
We used Wav2Vec2-Large-XLSR-53 and Whisper-small to developed the language model。
実験により、Wav2Vec2-Large-XLSR-53モデルに基づく転写プロセスは、Whisper-smallモデルよりもはるかに正確で読みやすい出力を提供することが示された。
論文 参考訳(メタデータ) (2025-08-13T17:19:22Z) - Speaker Diarization for Low-Resource Languages Through Wav2vec Fine-Tuning [4.396936958546459]
我々は、専用のクルド語コーパス上で、Wav2Vec 2.0の自己教師型学習モデルを訓練する。
我々は他の言語から学んだ多言語表現に適応し、クルド語の音声的・音響的特徴を捉える。
結果は、他の未研究言語で効果的なダイアリゼーションシステムを構築するための基盤を確立する。
論文 参考訳(メタデータ) (2025-04-23T10:45:59Z) - MulliVC: Multi-lingual Voice Conversion With Cycle Consistency [75.59590240034261]
MulliVCは、音色のみを変換し、多言語ペアリングデータなしでオリジナルコンテンツとソースコードの韻律を保持する新しい音声変換システムである。
目的と主観の両方の結果から,MulliVCはモノリンガルとクロスリンガルの両方の文脈において,他の手法をはるかに上回っていることが示唆された。
論文 参考訳(メタデータ) (2024-08-08T18:12:51Z) - XLAVS-R: Cross-Lingual Audio-Visual Speech Representation Learning for Noise-Robust Speech Perception [62.660135152900615]
音声認識と翻訳システムではノイズの多い入力が不十分である。
XLAVS-Rは、雑音による音声認識と翻訳のための言語間音声・視覚音声表現モデルである。
論文 参考訳(メタデータ) (2024-03-21T13:52:17Z) - Language and Speech Technology for Central Kurdish Varieties [27.751434601712]
3000万人以上の話者が話すインド・ヨーロッパ語であるクルド語は、方言の連続語であると考えられている。
クルド語のための言語と音声技術に対処する以前の研究は、マクロ言語としてモノリシックな方法でそれを扱う。
本稿では,中央クルド語多種多様な言語・音声技術のための資源開発への一歩を踏み出した。
論文 参考訳(メタデータ) (2024-03-04T12:27:32Z) - Multilingual self-supervised speech representations improve the speech
recognition of low-resource African languages with codeswitching [65.74653592668743]
微細な自己教師型多言語表現は絶対単語誤り率を最大20%削減する。
訓練データに制限のある状況では、自己教師付き表現を微調整することが、より良いパフォーマンスと実行可能なソリューションである。
論文 参考訳(メタデータ) (2023-11-25T17:05:21Z) - Lip Reading for Low-resource Languages by Learning and Combining General
Speech Knowledge and Language-specific Knowledge [57.38948190611797]
本稿では,特に低リソース言語を対象とした新しい唇読解フレームワークを提案する。
低リソース言語は、そのモデルを訓練するのに十分なビデオテキストペアデータを持っていないため、低リソース言語のための唇読解モデルを開発するのは難しいと考えられている。
論文 参考訳(メタデータ) (2023-08-18T05:19:03Z) - The First Parallel Corpora for Kurdish Sign Language [0.76146285961466]
クルド人手話(KuSL)は、クルド人手話の自然言語である。
本稿では,ソラニ方言におけるクルド語のアバターに基づく自動翻訳をクルド語手話に導入する。
両言語評価法 (BLEU) を用いて, 結果の理解性を検証し, 評価を行った。
論文 参考訳(メタデータ) (2023-05-11T12:10:20Z) - Cross-lingual Transfer for Speech Processing using Acoustic Language
Similarity [81.51206991542242]
言語間の移動は、このデジタル分割を橋渡しする魅力的な方法を提供する。
現在の言語間アルゴリズムは、テキストベースのタスクや音声関連タスクを低リソース言語で実現している。
本稿では,数百の言語をまたがる音響的言語間移動対を効率的に同定する言語類似性手法を提案する。
論文 参考訳(メタデータ) (2021-11-02T01:55:17Z) - Jira: a Kurdish Speech Recognition System Designing and Building Speech
Corpus and Pronunciation Lexicon [4.226093500082746]
中央クルド語のための最初の大規模な語彙音声認識システム(LVSR)、Jiraを紹介します。
クルド語(クルド語)は、複数の国で3000万人以上が話しているインド・ヨーロッパ語である。
音声コーパスについて、我々は、コレクション内のダイフォンの比率が中央クルド語の実際のデータに似ている文集を設計しました。
11の異なる文書トピックを含むテストセットは、2つの対応する音声条件で設計および記録される。
論文 参考訳(メタデータ) (2021-02-15T09:27:54Z) - OCR Post Correction for Endangered Language Texts [113.8242302688894]
我々は、3つの危惧言語でスキャンされた書籍の書き起こしのベンチマークデータセットを作成する。
本稿では,汎用OCRツールがデータ・スカース・セッティングに対して堅牢でないかを体系的に分析する。
我々は,このデータ・スカース・セッティングにおけるトレーニングを容易にするために,OCRポスト補正法を開発した。
論文 参考訳(メタデータ) (2020-11-10T21:21:08Z)
関連論文リストは本サイト内にある論文のタイトル・アブストラクトから自動的に作成しています。
指定された論文の情報です。
本サイトの運営者は本サイト(すべての情報・翻訳含む)の品質を保証せず、本サイト(すべての情報・翻訳含む)を使用して発生したあらゆる結果について一切の責任を負いません。