v-modal/vmodal_sdk_smartglass

SDK for Visual Memory Search with Smart Glasses

解决的问题

它简化了从基于Android的智能眼镜向云摄取服务直播第一人称视频的复杂过程。它消除了开发者的“媒体管道”负担,处理硬件编码、安全传输和网络恢复等困难任务,使他们能够专注于用户体验。

工作原理

该SDK采用混合架构,结合了用于Android原生管理的Kotlin客户端和用于高性能媒体处理的Rust核心。

  1. Kotlin客户端:管理公共API、相机协调以及捕获会话的生命周期。
  2. Rust核心:处理有界媒体队列、H.264标准化、MPEG-TS复用和加密SRT传输。
  3. 数据流:视频通过Meta DAT捕获,使用Android的H.264硬件编码器编码,由Rust核心处理,并通过加密SRT流式传输到开发者后端提供的实时摄取目标。

适用对象

为智能眼镜构建第一人称视频应用的开发者,例如远程专家支持、免提现场工作、实时培训以及AR/VR伴侣体验。

亮点

  • 低延迟:使用GOP感知背压和有界队列,防止弱网络上的内存增长和延迟峰值。
  • 弹性连接:具有可配置的SRT重连,带有抖动和超时,以维持稳定流。
  • 硬件优化:利用Android硬件H.264编码提高效率。
  • 开发者友好:提供使用FlowStateFlow的简洁Kotlin API,并包含Android模拟器,无需物理硬件即可测试。

相关

  • 项目
  • 项目
  • 项目
  • 项目