gazijarin/itsgiving

Express yourself in meetings (with memes, of course).

解决的问题

该应用允许用户根据实时面部表情和手势触发视频流中的视觉化迷因叠加。它解决了静态视频会议的问题,通过添加交互式、手势驱动的反应,使这些反应可通过虚拟摄像头(如在 Zoom 或 Microsoft Teams 中)广播给他人。

工作原理

该应用程序使用 MediaPipe 跟踪 478 个面部关键点、52 个混合形状以及手部/身体位置。通过计算相对于人脸的几何结构,确保系统无论用户距离摄像头远近都能正常工作。

由于不同人的自然面部表情不同,该项目包含一个校准模式。该模式会记录用户中性面部状态 7 秒,以建立每个表情通道的均值和标准差。然后计算“z 分数”(sigma),衡量当前表情与用户特定中性基线的偏离程度,从而在不同脸型之间实现可靠的检测。

适用人群

  • 希望获得互动视觉反应的内容创作者和主播。
  • 希望为视频会议增添幽默感和参与感的远程工作者或学生。
  • 对计算机视觉和手势识别感兴趣的开发者。

主要亮点

  • 虚拟摄像头支持:与 OBS 或 v4l2loopback 集成,可在会议应用中作为标准摄像头使用。
  • 个性化校准:使用统计归一化(z 分数)适应个人的自然面部状态。
  • 可自定义资源:用户只需替换 assets 文件夹中的图片或 GIF 即可轻松更换迷因。
  • 可扩展的姿势系统:为开发者提供框架,通过在 decide() 函数中定义基于几何规则的新手势。
  • 尺度不变追踪:通过人脸宽度归一化距离,确保在任何距离下都能一致检测手势。

相关

  • 项目
  • 项目
  • 项目
  • 项目