AddictedCS/soundfingerprinting

Open source audio fingerprinting in .NET. An efficient algorithm for acoustic fingerprinting written purely in C#.

何を解決するか

このプロジェクトは、メディアファイルの独自の「指紋」(フィンガープリント)を作成することで、音声および動画コンテンツを識別する方法を提供します。未知の音声または動画サンプルを、既知の指紋データベースと比較することで認識可能であり、重複の検出、楽曲の識別、ラジオストリームにおける広告の検出などに役立ちます。

動作方法

フレームワークはメディアファイルから音響的および動画的指紋(ハッシュ)を抽出し、設定可能なデータストア(メモリ内ストアやEmyの永続ストアなど)に保存します。クエリが実行されると、音声または動画のサンプルを分析し、データストア内の類似したサブ指紋を検索して最適な一致を特定します。

また、広帯域ノイズや静音領域でハッシュが一致しない領域を補完するためのスペクトルプロファイル経路ブリッジング機構を備えており、異なる録音間でのより強固な認識を実現します。

対象ユーザー

デジタル信号処理、データマイニング、音声/動画認識に特化した開発者、研究者、企業。

特徴

  • マルチモーダル認識: 音声と動画の両方の指紋認識をサポートし、同時に両方の認識が可能。
  • 耐障害性: ピッチやテンポの変化(レコード風)に対応し、スペクトルプロファイルブリッジングにより広帯域ノイズや静音を克服。
  • 柔軟なストレージ: 小規模プロジェクト向けにメモリ内ストアを提供し、Emyを用いた永続的で大規模なストレージもサポート。
  • C#/.NET Framework: NuGetパッケージとして構築され、.NETアプリケーションへの簡単な統合が可能。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト