AddictedCS/soundfingerprinting
Open source audio fingerprinting in .NET. An efficient algorithm for acoustic fingerprinting written purely in C#.
解决的问题
该项目通过为媒体文件创建独特的「指纹」,提供了一种识别音频和视频内容的方法。用户可以通过将未知的音频或视频样本与已知指纹数据库进行比较,实现内容识别,适用于检测重复内容、识别歌曲或检测广播流中的广告。
工作原理
该框架从媒体文件中提取音频和视频指纹(哈希),并将其存储在可配置的数据存储中(如内存存储或 Emy 持久化存储)。当执行查询时,框架会分析音频或视频的样本,并在数据存储中搜索相似的子指纹,以找到最佳匹配。
它还包含一种频谱轮廓路径桥接机制,用于处理因宽带噪声或静音导致哈希不匹配的区域,从而确保在不同录音之间实现更稳健的识别。
适用人群
专注于数字信号处理、数据挖掘和音视频识别的开发者、研究人员及企业。
主要亮点
- 多模态识别:支持音频和视频指纹识别,可同时实现两者的识别。
- 鲁棒性:可处理音高和节奏变化(类似黑胶唱片风格),并利用频谱轮廓桥接克服宽带噪声和静音问题。
- 灵活存储:提供内存存储选项,适用于小型项目,同时支持 Emy 实现持久化、大规模存储。
- C#/.NET Framework:作为 NuGet 包构建,可轻松集成到 .NET 应用程序中。
相关
- 项目
- 项目
- 项目
- 项目
- 项目