CUNY-CL/wikipron
Massively multilingual pronunciation mining
何を解決するか
WikiPronは、Wiktionaryから発音データを自動収集するように設計されています。広範な言語における単語と発音のペア(G2Pデータ)を手動で収集するという問題を解決し、音声合成や音声認識システムの構築に不可欠なデータを提供します。
動作方法
このツールはコマンドラインインターフェース(CLI)とPython APIの両方で動作します。International Phonetic Alphabet(IPA)の表記をWiktionaryからスクレイピングし、ISO 639-3コードで言語を指定したり、特定の方言を対象にしたり、広義または狭義の表記を選択したりできます。また、機械学習モデルの精度向上のため、発音記号のディアクリティクスや修飾記号が親記号と正しくグループ化されるように、IPA記号の分割処理も行います。
対象ユーザー
音声技術、言語学、自然言語処理(NLP)の研究者や開発者向けです。発音辞書の作成に役立ちます。
特徴
- 多言語対応:348言語のデータ収集をサポート。
- カスタマイズ可能なスクレイピング:方言や表記レベル(広義 vs. 狭義)でフィルタリング可能。
- IPAの分割処理:
segmentsライブラリを使用して、モデル作成に適したIPAディアクリティクスの処理を正確に行います。 - 即時利用可能なデータ:500万以上の単語-発音ペアからなるデータベースを提供。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト