CUNY-CL/wikipron

Massively multilingual pronunciation mining

何を解決するか

WikiPronは、Wiktionaryから発音データを自動収集するように設計されています。広範な言語における単語と発音のペア(G2Pデータ)を手動で収集するという問題を解決し、音声合成や音声認識システムの構築に不可欠なデータを提供します。

動作方法

このツールはコマンドラインインターフェース(CLI)とPython APIの両方で動作します。International Phonetic Alphabet(IPA)の表記をWiktionaryからスクレイピングし、ISO 639-3コードで言語を指定したり、特定の方言を対象にしたり、広義または狭義の表記を選択したりできます。また、機械学習モデルの精度向上のため、発音記号のディアクリティクスや修飾記号が親記号と正しくグループ化されるように、IPA記号の分割処理も行います。

対象ユーザー

音声技術、言語学、自然言語処理(NLP)の研究者や開発者向けです。発音辞書の作成に役立ちます。

特徴

  • 多言語対応:348言語のデータ収集をサポート。
  • カスタマイズ可能なスクレイピング:方言や表記レベル(広義 vs. 狭義)でフィルタリング可能。
  • IPAの分割処理segmentsライブラリを使用して、モデル作成に適したIPAディアクリティクスの処理を正確に行います。
  • 即時利用可能なデータ:500万以上の単語-発音ペアからなるデータベースを提供。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト