sonicloudco/recorder
声云录音卡 Recorder 是一套面向开发者和行业客户的智能录音硬件接入方案。 项目以录音卡片硬件为核心,开放 BLE 协议 SDK 及 Android、iOS、鸿蒙、Flutter 接入示例,同时提供 Windows/macOS 桌面端 Demo,支持设备连接、录音控制、实时音频、文件传输、OTA 升级和语音转写等能力,帮助开发者快速将录音硬件接入自己的 App、桌面软件或行业系统。 如需获取硬件规格、样机、完整协议、SDK 资料或定制服务,请联系安徽声云
解决的问题
本项目提供了一套 SDK,用于将录音、语音识别 (ASR) 和语音合成 (TTS) 功能集成到硬件设备中,例如 AI 录音卡和智能鼠标。
工作原理
这些 SDK 结合了边缘端录音和基于云的自动语音识别 (ASR),可自动生成会议纪要并归档资料以供检索。它支持多种操作系统,包括 Windows 10+、Linux(基于 Debian 的系统,如 Uos 和 Yinhe Kylin)以及 macOS (arm64)。
适用人群
为企业礼品、教育和面试场景开发硬件集成 AI 音频工具的开发者。
核心亮点
- 集成了录音、ASR 和 TTS 功能。
- 支持 AI 录音卡和智能鼠标。
- 跨平台兼容 Windows、Linux 和 macOS。
相关
- 项目
microsoft/generative-ai-with-javascript由 Microsoft 维护、采用 MIT 许可证的教程系列,专为 JavaScript 开发者设计,教授如何构建生成式 AI 应用。涵盖 LLM 基础、提示工程、结构化输出、RAG、工具调用和 Model Context Protocol,配有代码示例、测验、视频和配套聊天应用。可立即在 GitHub Codespace 中启动,或本地运行代码。
- 项目
yym68686/uni-apiuni‑api 是一个仅通过配置运行的服务器,提供单一 OpenAI 兼容 API,同时将请求路由到多个 LLM 提供商(OpenAI、Anthropic、Gemini、Vertex、Azure、AWS 等)。支持加权和轮询负载均衡、自动重试、每模型超时、速率限制、工具调用透传、内容审核以及细粒度请求覆盖——所有配置均通过 `api.yaml` 文件或 `CONFIG_URL` 定义。可作为 Docker 容器部署(提供一键 Fugue 按钮)
- 项目
plugin87/ux-ui-agent-skillsUX/UI Agent Skills 是一个 Claude 代理知识库,提供设计令牌、组件规范、无障碍审计和 17 个斜杠命令风格的“技能”,使 AI 能像高级 UI/UX 架构师一样行动。它可为任何框架(React、Vue、SwiftUI、Flutter 等)生成基于令牌的代码,通过 37 个 CI 门禁强制执行 WCAG 2.2 合规性,并包含 138 个设计系统库以提供美学方向。通过 `npx ux-ui-agent-skills init` 安装;代理读取 `CLAUDE.md` 简报并运行技能或自然语言提示,生成设计资产、代码和审计结果。
- 项目
nvk/llm-wikillm‑wiki 是一个跨运行时的工具,让 Claude、Codex、OpenCode、Pi 和其他 LLM 代理能够构建并查询结构化且兼容 Obsidian 的维基。它提供数据摄取、并行研究、会话记忆、私有适配器以及可导出的知识检查点,并为每个受支持的代理提供安装脚本。