LibreSpark/LibreTTS

一个免费的在线文本转语音工具,支持超过 300 种语音,并允许与自定义 OpenAI 兼容的 TTS API 集成。

MoizIbnYousaf/ai-agent-skills

AI Agent Skills 是一个基于 npm 的 CLI/TUI 工具,提供约 115 个 AI 代理“技能”(提示-代码组合)的精选库,按书架(前端、后端、移动、工作流、代理工程、营销)组织。它允许你浏览、搜索、安装和管理本地“本地副本”技能以及仅存储元数据的上游技能。你还可以使用 `init-library` 启动个人库,添加或归档新技能,打包副本,同步更新,并生成文档。支持任何 Agent-Skills 兼容代理(Claude、Cursor、Gemini 等),并支持多种安装目标。非常适合希望拥有整洁、可搜索的可重用代理能力工具箱的开发者或团队。

xzf-thu/Mega-ASR

Mega-ASR 是一个为在复杂真实环境中实现稳健语音识别而设计的基础ASR模型,通过扩大噪声、回声和失真的声学模拟来实现。

Ashutosh0x/rust-finance

RustFinance 终端(Rust‑Forge)是一个开源、纯 Rust 编写的交易平台,整合了实时市场数据摄入(直接交易所二进制流、经纪商 API、加密货币 WebSocket)、全屏终端 UI、Claude 驱动的 AI 评论、微结构指标、风险模型和执行算法(TWAP、VWAP、Almgren‑Chriss 等)。它提供原生 Nasdaq/NYSE 连接、模块化 crate 架构和研究级文档,面向量化研究人员、低延迟开发者和 AI 爱好者。

DataArcTech/DataArc-SynData-Toolkit

DataArc SynData Toolkit 是一个开源 Python 框架,可通过单个 YAML 配置生成 LLM 用的合成训练数据(文本或图文),并支持 SFT/GRPO 微调与 DeepEval 评估,可通过 CLI 或 FastAPI + React GUI 访问。

derisk-ai/OpenDerisk

OpenDeRisk 是一个开源、多代理 AI 平台,可自动化软件事件的根因分析。它摄取大规模 OpenRCA 数据集,让专业代理(SRE、Code、Report、Visual、Data)协作,并通过 Web UI 提供可视化数据链。可通过单行 curl 脚本或使用 uv 包管理器从源码安装,支持快速启动、火焰图辅助以及对话式数据分析。

apache/texera

Apache Texera 是一个开源的可视化平台,允许用户通过拖拽式 GUI 构建和运行数据分析流水线,内置 AI 代理可将自然语言命令翻译为工作流步骤。支持 Python 和 Java 算子,具备实时协作、交互式调试能力,并可从笔记本电脑扩展至大型云集群。

senstella/parakeet-mlx

一个基于 MLX 的 Nvidia Parakeet ASR 模型实现,适用于 Apple Silicon,提供支持流式传输和时间戳的高效本地音频转录功能。

MobiusQuant/OpenMobius-skill

OpenMobius‑skill 是 AI 编码代理(Claude Code、Codex、OpenClaw、Hermes、Cursor、WorkBuddy)的插件,添加了精选的交易知识库(来自 ICT、SMC、缠论等约 2,000 张卡片)、实时市场数据、60 多种技术指标和图表生成。它通过严格/增强/比较模式路由用户查询,支持多种分析学派,并自包含安装,带有自己的 Python 虚拟环境、模型权重和 Playwright Chromium。

gnh1201/welsonjs

WelsonJS 是一个仅限 Windows 的框架,允许您使用内置的 Windows Script Host 引擎(cscript/wscript)以 JavaScript(及 TypeScript、CoffeeScript 等)编写控制台或 GUI 桌面应用。无需额外运行时,支持旧版 Windows,捆绑了 jQuery、Monaco、React、ESENT 数据库、原生 Windows 服务 API 等多种库,并提供可选的 LLM 集成(ChatGPT、Gemini)。应用可打包为 zip 文件、Inno Setup 安装程序或简单复制运行的包,PowerShell 启动脚本可自动拉取运行时。

NVIDIA/cudf-spark

NVIDIA cuDF plugin for Apache Spark 是一个 GPU 加速库,它将 Spark 的 CPU DataFrame 操作替换为 cuDF,从而在提供比原生 Spark 更快的连接、聚合和其他 SQL 风格查询的同时,保持结果与原生 Spark 一致。它通过 Spark 插件进行集成,为其他 GPU 机器学习库提供零拷贝数据路径,并包含验证和性能分析工具,以帮助用户评估和调优性能。

defendend/Claude-ast-index-search

ast-index 是一个 CLI,为多语言代码库构建 SQLite AST 索引,支持快速结构化查询(符号、类、依赖等)。它通过返回精确的代码片段减少 LLM 的令牌使用量,通过插件与 Claude、Codex、Cursor 和 Gemini 集成,支持单体仓库、增量更新和丰富的 JSON 模式。

x-pai/AlphaBot

AlphaBot 是一个开源、可通过 Docker 部署的网页应用程序,结合了 LLM 驱动的聊天助手与实时市场数据(全球市场通过 Alpha Vantage,中国 A 股通过 Tushare/AKShare)。它提供 AI 生成的技术面与基本面分析、图表可视化、风险评估,以及简单的量化策略建议,适合散户投资者使用。

BeaconBay/ck

ck 是一个基于 Rust 的 CLI/TUI 工具,可构建源代码的本地嵌入,并支持按语义(语义搜索)和传统正则表达式进行搜索。支持增量索引、多种嵌入模型、通过 MCP 服务器实现 AI 代理集成,以及用于自动化的 JSON/JSONL 输出。

provos/ironcurtain

IronCurtain 是一个研究级别的运行时,通过将自然语言编写的“宪法”编译为确定性的允许/拒绝规则,验证规则,并通过策略引擎在每次工具调用时强制执行,从而保护自主 LLM 代理。它支持 V8 沙箱或 Docker 隔离代理,提供交互式终端多路复用器和可选的 Web UI 用于处理升级请求,并包含角色/工作流功能,适用于多代理流水线。

openvinotoolkit/nncf

NNCF(神经网络压缩框架)是一个开源的 Python 库,为 PyTorch、TorchFX、ONNX 和 OpenVINO 模型添加训练后和训练时压缩(量化、权重压缩、剪枝等),实现更小、更快的推理,且精度损失极小。

aTrainTranscription/aTrain

aTrain 是一个在您电脑上离线运行 Whisper(通过 faster-whisper)的转录应用,支持说话人分离、99 语言,导出格式兼容 MAXQDA、ATLAS.ti 和 NVivo。它以 Linux/Windows 桌面应用形式分发,也提供 pip 可安装的 CLI 版本,支持可选的 CUDA GPU 加速以提升处理速度。

zilliztech/VectorDBBench

VectorDBBench 是一个 Python CLI 工具,可在众多开源和云向量数据库上对插入、向量搜索、过滤搜索和全文 BM25 检索进行基准测试。它内置标准 ANN 数据集(SIFT、GIST、Cohere、OpenAI 嵌入)和较新的多模态 Hugging Face 数据集,报告延迟/召回率/QPS 和云成本,并提供可视化 UI 以比较结果。

woheller69/whoBIRD

一款使用机器学习实时且完全离线识别超过 6,000 种鸟类的 Android 应用。

zh-plus/openlrc

一个使用 faster-whisper 进行音频转录,并利用 LLM 将文本翻译并润色为同步 .lrc 字幕的 Python 库。

gmickel/flow-next

Flow‑Next是编码代理(Claude Code、OpenAI Codex、Cursor等)的插件,将变更请求转换为持久规格说明,然后自动驱动规划、实现、对抗性审查、实时QA和PR创建,并在仓库中记录所有证据。

Hao0321/claude-skill-social-post

一个 Claude/Codex 技能,允许 LLM 通过受控的 Chrome 会话在 Facebook、Instagram 和 Threads 上起草、审查并(可选)发布社交媒体评论。它学习品牌的语气,对每项操作进行加密签名记录,并包含全面的安全检查和测试套件。实时发布默认关闭;仓库提供自动化框架,而非私有内容。

MatthewCYM/VoiceBench

VoiceBench 是一个用于评估基于大语言模型(LLM)的语音助手的基准套件。它提供了一个包含音频驱动问答和指令遵循任务的 Hugging Face 数据集,一个命令行工具包用于运行模型、收集语音响应并自动评分(部分使用 GPT-4o-mini)。结果发布在公开排行榜上,仓库还包含一份近期语音助手相关论文的精选列表。

Xerophayze/TTS-Story

支持多种本地和云端语音引擎的基于网页的多语音 TTS 应用,适用于制作有声故事和有声书。

pluja/whishper

一个开源的、100% 本地的音频转录和字幕制作套件,配备 Web UI,并使用 FasterWhisper 进行快速、私密的处理。

wenet-e2e/wenet

一个面向生产环境的端到端语音识别工具包,提供流式和非流式语音转文本的全栈解决方案。

PaddlePaddle/PaddleSpeech

一个基于 PaddlePaddle 平台的开源语音与音频工具包,提供用于语音识别、合成与翻译的最先进模型。

lukaszliniewicz/Pandrator

通过协调本地和基于云端的语音及语言模型,创建有声书、字幕和配音的统一工作空间。

shinpr/claude-code-workflows

Claude Code Development Workflows 是一组 Claude Code 插件,将 Claude AI 助手转变为结构化的开发流程。插件提供“配方”(如 `/recipe‑implement`、`/recipe‑design`、`/recipe‑review`),强制执行结果共识、设计文档、工作计划生成、任务级实现与自动验证,以及独立安全审查。三个插件家族分别覆盖后端、React 前端和全栈项目,可通过 Claude 市场安装。当需要可重复的安全门和设计到代码生成的正式交接时非常有用;对于快速原型可跳过。

junjiem/dify-plugin-repackaging

一个可通过 GitHub Actions、Docker 或直接 shell 脚本使用的工具,用于下载 Dify AI 平台插件并重新打包以适配不同操作系统/架构目标。

AdamPlatin123/dsh-plugin-radar

DSH Plugin Radar 是一个开源系统,可自动发现、验证(通过 Kubernetes Pod)并归档 DeepSeek Harness 插件。它生成实时 Markdown 列表、精选“推荐”列表、捆绑包集合和公共 JSON API,帮助开发者和用户无需试错即可找到可靠的 DSH 插件。

linkerlin/PUAX

PUAX 是一个生产就绪的运行时,为 LLM 代理添加了一个思维模式层。它提供竞技场/门控/梦境原语、精简提示压缩、零依赖 Python SDK、混合触发检测、59 个内置(和自定义)角色、结果驱动验证、用于检测针对人类操纵的碳盾,以及可复现的多模型基准套件。该系统通过 MCP 服务器(`npx puax-mcp-server`)访问,该服务器将原生钩子注入流行的 IDE,并且可以通过一行 AMP 中间件直接嵌入 LangChain/AutoGen。MIT 许可并标记为生产就绪。

Chozzc/Lujie-Careerkit

LuJie CareerKit 是一款 AI 增强型 Web 应用,用于管理履历、JD 匹配、面试准备、模拟面试以及申请进度追踪。它将所有数据本地存储在 SQLite 中,使用可配置的 OpenAI 相容模型,,并包含一个实验性的应用内职涯代理程序,可通过自然语言指令生成并编辑求职相关文件。

getkimchi/kimchi

kimchi 是基于 pi‑mono SDK 构建的终端式 AI 编码助手。它协调一个或多个 LLM 执行角色(规划者、构建者、审查者、探索者、研究者)任务,支持多模型路由、通过 Ferment 实现的持久项目管理、基于标签的使用追踪、可选的 LSP 集成以及远程会话的远程传输。

sangrokjung/claude-forge

Claude Forge 是一个插件包,可将基础的 Claude Code 终端编码助手升级为生产级开发环境。它增加了 16 个专业 AI 代理、35 个斜杠命令、33 个已保存的“技能”、22 个安全钩子、14 个行为规则和 4 个外部工具连接。可通过一行脚本(完整安装)或通过 Claude Code 的插件市场(仅命令)安装。该包自动实现规划、测试优先开发、安全审查、文档同步,以及要求独立代理批准每个变更的对抗性验证循环。采用 MIT 许可证,持续维护(v4.3.0,2026 年 9 月)

a-agmon/rs-graph-llm

graph-flow 是一个 Rust 库,可让您为 AI 代理构建有状态的、基于图的工作流。任务可读写类型化的上下文,引擎可暂停等待人工输入,持久化会话(内存或 PostgreSQL),并稍后恢复。包含条件边、并行扇出,以及可选的 Rig 集成用于 LLM 调用。示例服务(保险理赔、推荐)展示了真实世界用法。MIT 许可,已发布于 crates.io。

alantech/marsha

Marsha 是一种由 LLM 驱动的、类似 Markdown 的语言,允许你通过类型、自然语言说明和输入输出示例来描述一个数据处理函数。Marsha 编译器将此规范发送给 LLM,生成 Python 代码,根据示例进行验证,并生成可直接运行的 CLI 或 REST 服务。

alesaccoia/VoiceStreamAI

使用 WebSockets、语音活动检测 (VAD) 和 Faster Whisper 实现近实时音频流传输与转写的 Python 和 JavaScript 解决方案。

DavidDiazGuerra/gpuRIR

使用图像源法的GPU加速Python库,用于模拟房间脉冲响应(RIR),相比CPU实现最高可提升100倍速度。

ScottZt/jin-ce-zhi-suan

一个基于 Python 的定量交易平台,采用受唐代官僚制度启发的“三省六部”架构,提供回测、多策略管理、风险优先执行及 AI 驱动的自然语言股票筛选功能。通过 FastAPI + HTML 仪表盘运行,支持多种数据源,个人/学术使用免费(商业使用需授权)。

AddictedCS/soundfingerprinting

一个用于音频和视频指纹识别的 C# 框架,通过声学和视频哈希实现媒体内容的快速识别。

OHF-Voice/wyoming

一种用于标准化语音助手组件之间通信的点对点 TCP 协议,涵盖音频输入/输出、唤醒词检测、语音转文本和文本转语音服务。

ElectricCodeGuy/SupabaseAuthWithSSR

一个生产就绪的 Next.js 16 启动项目,结合 Supabase SSR 认证与 Claude 驱动聊天,集成八种内置 AI 工具(RAG、网络搜索、图表、PDF 生成、记忆、工件工作区、使用情况仪表板、管理员控制台)。单文件 Supabase 模式、按 token 成本追踪和缓存机制,使其可直接用于 SaaS 或内部 AI 助手。

meta-pytorch/captum

Captum 是一个 PyTorch 库,提供了一套模型可解释性算法(Integrated Gradients、DeepLift、Gradient Shap、SmoothGrad、TCAV、TracIn、神经元/层导电性等),旨在帮助开发者和研究人员理解哪些输入、神经元或训练样本驱动了模型的预测结果。它可以通过 pip/conda 安装,并与任何 PyTorch 模型兼容。

common-voice/common-voice

一个用于收集语音捐赠的 Web 应用程序,旨在创建用于训练语音识别相关工具的公共领域数据集。

AndersonBY/vector-vein

VectorVein 是一个跨平台、无代码的桌面应用,用于构建 AI 驱动的自动化工作流。它允许用户通过可视化方式连接 LLM 调用、嵌入、语音转文本等节点,支持任何 OpenAI 兼容端点(OpenAI、Ollama、LM‑Studio 等),提供本地 FastAPI REST API 用于程序化执行,并以 pywebview 构建的单个可执行文件形式发布。

iot-salzburg/gpu-jupyter

GPU‑Jupyter 提供基于 Docker 的 GPU 支持 JupyterLab 环境,预装 Python、PyTorch、TensorFlow、Julia 和 R。支持版本镜像、易于自定义和 Docker‑Compose,可在任何配备 NVIDIA GPU 的机器上实现可复现的深度学习实验。

microsoft/TypeAgent

TypeAgent 是微软开源的一个示例项目,展示了如何使用大语言模型、结构化提示和一种新颖的“结构化 RAG”记忆系统,构建一个单一的个人 AI 助手。它包含一个 Electron 外壳、一个将自然语言请求路由到类型化代理的调度器、一个将对话事实存储为逻辑实体的记忆层,以及一个减少 LLM 调用的缓存。该仓库提供了许多示例代理(日历、邮件、浏览器等)和一个用于添加自定义代理的 SDK。这是一个早期阶段的示例代码,仅在 Azure OpenAI 上以英文测试过,未经进一步验证前不适用于生产环境。