eracle/OpenOutreach

OpenOutreach 是一个自托管 CLI,使用 LLM 和许可的潜在客户数据服务,根据简单的产品描述来发现、筛选和发送邮件给 B2B 潜在客户。它将两个子工具——OpenOutFind(搜索与筛选)和 OpenOutSend(邮件丰富与发送)——捆绑到一个单命令工作流中,仅需 LLM 密钥、BetterContact API 密钥和 SMTP 凭据,并输出带有每个潜在客户人类可读原因的、可直接导入的 CSV 文件。

Aethena-Lab/Z3r0

Z3r0 是一个原生AI红队工作台,结合了React UI、FastAPI控制平面、支持LightRAG检索的多代理运行时,以及Docker沙箱执行环境。它将每一步操作记录为不可篡改的证据,并提供可回放的时间线,使授权渗透测试具备可审计性和协作性。

mvanhorn/cli-printing-press

CLI 打印机是一个基于 Go 的生成器,使用 Claude Code(或 Codex)将任何 API 或网站转换为高效的 Go CLI 和匹配的 MCP 服务器。它能自动研究文档、抓取流量、构建本地 SQLite 数据层、添加复合分析命令、验证输出,并可发布结果至公共库。通过单个脚本安装后,只需在 AI 助手会话中调用 `/printing-press <api>`,即可获得可立即使用的 CLI(如 ESPN、flight-goat、linear-pp-cli),支持离线运行、输出紧凑 JSON,并针对 AI 代理进行了优化。

agent-of-empires/agent-of-empires

Agent of Empires (AoE) 是一个在 Linux/macOS 上运行 AI 编码代理的会话管理器,这些代理在持久的 tmux 会话中运行。它提供 TUI、Web 仪表板、CLI 和 HTTP API,以及 Git 工作树、Docker/Podman 沙箱、差异查看和状态检测功能,让您能够安全、远程地监控和控制多个代理。

2akouwu/reverify

Reverify 是一个 Python 工具包,让 LLM 能够针对二进制文件(或源代码)提出事实主张,并根据实际文件进行确定性验证。它提供纯 Python 解析器/反汇编器,以及可选的本地后端(Capstone、Unicorn、LIEF、Z3、angr)。验证过的事实会存储在分类账中,使 AI 代理能够在不丢失可信状态的情况下进行上下文转换。该工具已发布于 PyPI,包含 CLI 和用于代理集成的 MCP 服务器,并经基准测试证实可捕捉真实 Windows 二进制文件中 100% 的幻觉主张。

alchaincyf/huashu-skills

一个精心整理的 53 个 Claude 兼容 *Agent 技能*(设计、数据、视频、写作、基于角色的推理等)目录,包含安装说明、更新检查器和机器可读的目录。使 AI 代理能够在无需自定义编码的情况下执行具体的生产力任务。

HazyResearch/ThunderKittens

ThunderKittens 是一个仅头文件的CUDA库,提供一个极小、基于分块的DSL,用于编写高性能深度学习内核(如GEMM、FlashAttention)。它抽象了张量核调用、异步内存移动和共享内存分组,同时保持代码紧凑且类型安全。专为Hopper/Blackwell(及Vera Rubin)GPU设计,使研究人员和工程师能从C++直接调用或封装为PyTorch使用,生成接近峰值性能的内核。

tmoroney/auto-subs

一个本地优先的 AI 字幕工具,可将音频和视频离线转换为带时间戳的字幕,并直接集成 DaVinci Resolve、Adobe Premiere Pro 和 After Effects。

Blue-B/WhisperSubTranslate

使用 whisper.cpp 进行语音识别,结合 Hy-MT2 或云 API 实现翻译,将视频音频本地转换为多语言字幕的应用程序。

AISBench/benchmark

AISBench Benchmark 是一个开源评估框架,用于 LLM、多模态模型和 AI 代理。它支持对本地运行或服务化模型进行精度(使用多个公开数据集)和性能(延迟、吞吐量、缓存)测试,并新增了 Harbor 代理基准测试、前缀缓存压力测试和响应异常检测等近期功能。

cortexkit/magic-context

Magic Context是CortexKit的插件,为编码代理提供自我管理的长期记忆。它从聊天记录中提取有用事实,在后台整合,并跨会话自动召回。这消除了AI编码工具中常见的压缩中断。

Taxuspt/garmin_mcp

一个 Python MCP 服务器,登录 Garmin Connect 并为 LLM(如 Claude)暴露 110 多个健康、活动和训练工具(读取和有限写入)。可通过 Claude Desktop 的 `.dxt` 扩展安装,或本地运行;使用 `garmin-mcp-auth` 一次性认证后,LLM 即可查询步数、睡眠、训练、下载 FIT 文件、创建和安排训练等。

bybit-exchange/svg-diagram

svg‑diagram 是一个零依赖的 Node 技能,为 AI 编码代理生成的 SVG 图表定义严格的视觉风格,并提供命令行 lint 工具(`svg‑lint`)以验证完成的 SVG 是否符合该风格。

snakers4/silero-vad

一种预训练的轻量级语音活动检测器 (VAD),能够以高精度和低延迟识别 6,000 多种语言的音频流中的语音。

awslabs/cli-agent-orchestrator

CLI Agent Orchestrator (CAO) 是一个 Python 工具,它运行本地服务器,在隔离的 tmux 会话中启动 AI 编码 CLI(如 Claude Code、Copilot 等),并提供统一的 CLI/Web UI 来监督多个代理的并行或顺序工作流程。它支持技能、持久化记忆、插件,甚至 Kubernetes 部署,让开发者能够编排一个 AI 编码助手团队。

yusufkaraaslan/Skill_Seekers

Skill Seekers 是一个 Python CLI(和可选的 MCP 服务器),可抓取 18 种类型的文档/代码(网站、GitHub、PDF、视频、聊天导出等),让 LLM 将材料增强为全面的 `SKILL.md`,然后打包为 22 个 AI/RAG 目标(Claude、Gemini、OpenAI、LangChain、LlamaIndex、Pinecone 等)的格式。它还直接将打包的技能安装到 19 个 AI 编码助手(Cursor、Windsurf、Cline 等)中。

MinishLab/semble

Semble 是一个仅 CPU 的 Python 库/CLI/MCP 服务器,可在约 0.5 秒内索引代码库,并在约 1 毫秒内响应自然语言代码查询,实现 Transformer 级别的相关性,同时相比 grep+read 基线节省约 99% 的 Token。它结合静态代码嵌入(Model2Vec)与 BM25,融合结果并应用代码感知重排序。可与 Claude Code、Codex、Cursor、OpenCode 等集成,无需 API 密钥或 GPU。

Muesli-HQ/muesli

Muesli 是一款原生 macOS 应用,提供设备端语音转文字和会议转录功能。它利用 Apple Silicon 优化的模型(Parakeet、Whisper、Nemotron 等)实现低延迟转录,支持可选的 OpenAI/OpenRouter 托管 ASR。功能包括按住说话输入、语音驱动编辑(Quill)、基于 VAD 的分段、说话人分离、AI 生成会议笔记、iCloud 文本同步、Siri/Shortcuts 集成,以及面向代理自动化的 JSON 优先 CLI。

SakiRinn/LiveCaptions-Translator

一款适用于 Windows 11 的实时音频翻译工具,通过将 Windows Live Captions 与 LLM 及传统翻译 API 相结合,通过透明叠加层提供翻译字幕。

QuentinFuxa/WhisperLiveKit

利用先进同步语音研究和多种模型后端的超低延迟、自托管语音转文本管道,支持实时转录与翻译。

w8123/EnterpriseAgentFramework

ReachAI 是一个开源平台,为现有的 Java 企业系统(OA、ERP、CRM 等)添加 AI 助手。它扫描应用,将带注解的业务方法注册为可重用的能力,让 LLM 生成集成代码(AI 编码),并通过受控、版本化的工作流运行用户请求,并提供完整的审计日志。技术栈包括 Spring Boot、AgentScope、LangGraph4j、Vue 前端、MySQL/Redis/Milvus,采用 MIT 许可证。

muscriptor/muscriptor

使用 Transformer 解码器架构,将音频录音转换为 MIDI 和专业乐谱的多乐器音乐转录模型。

Tencent/WeSmartFlow

WeSmartFlow 是一个开源、以 Agent 为核心的自适应学习平台(Python 3.10+、Vue 3),利用 LLM Agent 来理解学习目标、生成个性化学习路径、创建互动式可视化内容、测验与 HTML 知识卡片,并将学习进度存储于个人知识图谱中。它支持全课程生成、插件式“学习世界”,以及通过 WeClaw 通道进行选配的微信整合。仓库包含可重复使用的 agent_core 函式库、FastAPI 后端、Vue 前端,以及用于构建与部署新教育体验的工具。

OpenMOSS/MOSS-TTS-Nano

一个拥有 0.1B 参数的多语言、超小型语音生成模型,专为实时 CPU 推理和高保真语音克隆设计。

abus-aikorea/voice-pro

一款集语音识别、翻译和声音克隆于一体的 AI 多媒体工具,用于自动化配音和多语言内容创作

DrewThomasson/ebook2audiobook

一款 CPU/GPU 转换器,可使用先进的 AI 文本转语音引擎将非 DRM 电子书转换为有声书,支持语音克隆和 1158 种语言。

whiteguo233/OpenBiliClaw

OpenBiliClaw 是一个本地运行、开源的AI代理,从你在Bilibili、YouTube、Reddit等多个内容平台上的活动构建你的心理画像。基于该画像,它主动搜索这些平台,预测你可能喜欢的内容,解释其选择,并将所有数据保留在你的设备上。项目包含浏览器扩展、Go/Python后端(支持可选离线嵌入模型)、桌面与移动端Web UI、Flutter原生客户端,以及可选的DeepSeek Harness集成。安装分为四步:添加扩展、安装后端(安装程序或AI辅助脚本)、登录源平台、打开本地Web UI。项目强调隐私、跨平台推荐和持续自我学习。

zhizhuodemao/js-reverse-mcp

js‑reverse‑mcp 是一个 Node.js MCP 服务器,允许 LLM 代理在 Chrome 中调试和逆向工程 JavaScript。它将 DevTools 数据(脚本、断点、网络、WebSocket、存储)封装为 24 个简洁工具,专为 AI 驱动推理设计,并包含可选的隐蔽层(Patchright 分支和 CloakBrowser),用于应对反机器人网站。

crynta/terax-ai

Terax 是一个开源、轻量级的桌面 IDE,集成了 GPU 加速终端、CodeMirror 编辑器、Git UI 和网页预览,还内置一个可与云 LLM 或本地模型协同工作的 AI 侧边栏。它提供 AI 驱动的代码建议、编辑差异和代理工作流,是一个适用于 macOS、Linux 和 Windows 的约 7 MB 的 Tauri 应用。

snyk/agent-scan

Snyk Agent Scan 是一个 CLI 工具,可自动发现机器上的 AI 代理组件(MCP 服务器、技能和各种代理),并检查其是否存在提示注入、密钥泄露和恶意代码等安全风险。它通过自动发现配置文件,可选地启动 MCP 服务器(经用户同意),将净化后的数据发送至 Snyk 的分析服务,并报告评分后的风险指标。通过 `uvx` 或签名二进制文件安装,设置 Snyk API 令牌,运行扫描(建议在沙箱中)即可。

Blueturboguy07/cue

cue 是一款开源的 Electron 桌面应用,它会在屏幕上悬浮一个透明面板,捕获您的屏幕、麦克风以及(在 Windows 上)会议音频,并将这些流发送到您选择的语言模型,以便在会议和编码时提供实时协助。它适用于 macOS 15.4+ 和 Windows 10 2004+,支持 OpenAI、Anthropic、Gemini、Azure、Ollama 或任何与 OpenAI 兼容的端点,并可使用本地的 Whisper-cpp 进行设备端转录。该应用尝试通过操作系统级别的排除标记在屏幕共享工具中保持隐藏,但这属于尽力而为。安装方式为预先构建的二进制文件或通过 npm 从源码安装;首次运行时会引导您完成操作系统权限、API 密钥设置以及选用的 Zoom 设置。不收集任何遥测数据;密钥和选用的简历文本均存储在本地。

ArvinLovegood/go-stock

go‑stock 是一款 Windows/macOS 桌面应用,将实时股票数据与 LLM 驱动的分析相结合,提供图表工具、AI 代理、回测、提醒和技能共享系统。支持多种 LLM 提供商(OpenAI、本地模型、中国云模型),并采用 GPL‑v3 许可证。

kyutai-labs/moshi

Moshi 是一个专为实时、低延迟语音对话设计的全双工语音-文本基础模型,采用一种名为 Mimi 的专用流式音频编解码器。

Spark-To-Paper-Skills/paperjury

PaperJury 是一个 Claude Code(或 Codex)插件,使用 LLM 代理对 LaTeX/Markdown 论文执行结构化、提交前审查。它运行“审查 → 判定 → 编辑 → 重检”循环,将每个评论分类为“安全可修复”、“作者必修”或“无效”。提供三种模式(直接编辑、审查、自动):可请求特定修改、运行模拟同行评审,或在安全防护下无人值守运行。工具包含用于 LaTeX 编译、合规性检查和决策记录的确定性脚本。在12篇论文上的基准测试显示,问题检测F1得分为0.656,不安全编辑减少4倍。可通过 Claude Code 市场或简单 git clone 安装;附带包含前后PDF的完整“自用”示例。

xlite-dev/LeetCUDA

LeetCUDA 是一个 GPL-v3 存储库,提供一本 400 页的学习手册以及超过 200 个封装为 PyTorch 的 CUDA kernel(包含高性能 HGEMM 与 Flash-Attention 实现),专为 NVIDIA Tensor-Core GPU 上的 AI 工作负载所设计。

21st-dev/magic-mcp

一个微型的 npm proxy,可将旧有的 Magic-MCP 调用转发至新的 21st MCP 服务器,在保留旧有配置的同时,提供对更新后的 AI 组件生成工具的访问。

persiyanov/herdr-reviewr

herdr‑reviewr 是 *herdr* AI 助手的终端 UI 插件,可实时显示代理的代码变更差异,支持在特定行添加评论并发送回代理——所有操作均在分屏或独立应用中完成。支持多种差异范围、模糊文件搜索、PR 只读视图、主题定制和完整的快捷键自定义。

jerrywu001/cc-sessions-viewer

Sessions Viewer 是一个跨平台桌面应用(Tauri + Vue 3),可让您打开、搜索、回放和继续本地 AI 编码助手(如 Claude Code、Codex、Grok Build、Kimi Code、Pi、Antigravity CLI 和 opencode)生成的转录文件。它提供工具调用的忠实回放、全局搜索、分屏布局、token 成本分析,以及在嵌入式或外部终端中一键恢复会话,同时确保原始 JSONL 文件始终处于只读状态。

rullerzhou-afk/clawd-on-desk

Clawd on Desk 是一个跨平台桌面宠物,实时可视化 AI 编程代理(Claude、Copilot、Gemini、Cursor 等)的活动,展示思考、打字、工具使用、权限请求和任务完成等动画。通过钩子文件支持数十种代理,提供可点击的权限气泡(支持可选的 Telegram/飞书/Slack 转发)、会话仪表盘、只读移动端 PWA 和可自定义主题。

xifan2333/fcitx5-vinput

一款为 Fcitx5 设计的语音输入插件,支持本地或云端语音转文本,并通过 LLM 实现文本后处理与修改。

jeecgboot/jimureport

JimuReport 是一个免费、开源、低代码的报表套件,结合了传统表格报表、仪表板/大屏设计器,以及对话式 AI BI(ChatBI)。内置 Claude-Code 技能,用户可以通过自然语言提示或截图生成或编辑可视化。它通过 Spring Boot 启动器集成,支持 30+ 数据源(包括中国政府批准的数据库),可以本地运行、通过 Docker 或作为云端演示。

NVIDIA-NeMo/Speech

一个基于 PyTorch 的工具包,用于开发和部署专业语音 AI 模型,包括 ASR、TTS 和语音 LLM。

HEXUXIU/M365-Copilot2API

M365 Copilot2API 是一个基于 Go 的自建网关,可将 Microsoft 365 Copilot 的私有 WebSocket 协议转换为标准的 OpenAI 和 Anthropic 兼容 REST 端点。它提供了熟悉的 `/v1/chat/completions`(及相关)API,支持流式传输、函数调用、多模态输入,并包含用于账户/OAuth 管理、API 密钥处理、代理池、使用量统计和自动会话清理的 Web UI。该工具让现有的 OpenAI/Anthropic 客户端(Claude Code、Cursor 等)无需重写代码即可调用 M365 Copilot,但它是非官方的,仅供个人研究使用。

Starmel/OpenSuperWhisper

一款基于 Whisper 和 Parakeet 引擎的 macOS 实时音频转录应用,支持灵活的键盘和鼠标触发器,实现快速语音转文字转换。

QoderAI/better-harness

Better Harness 是一个开源工具,用于分析 AI 编码代理(如 Claude Code、Codex、Qoder、Cursor、GitHub Copilot 等)的完整工作流程。它收集项目与会话证据,评估“代理工作循环”(任务理解、受控执行、变更验证、可靠交付、学习捕获)的五个维度,并生成包含优先级排序、证据支持的发现与修复建议的可视化 HTML 报告。缺失的证据会被明确标示,帮助团队在享受 AI 生成代码优势的同时,提升可重复性、验证与学习能力。

yctimlin/mcp_excalidraw

一个将本地 Excalidraw 画布转变为可编程工作台的服务器,AI 代理可通过 CLI、MCP 和 REST 进行控制。

open-legal-products/mike

Mike 是一个开源、自托管的法律AI平台,允许用户使用LLM(OpenAI、Anthropic、Gemini或本地Ollama)与法律文档进行聊天、审查和研究。它集成了Next.js前端、Express后端、Supabase认证/PostgreSQL和R2兼容存储,并提供Slack和Microsoft Word的连接器。

pyannote/pyannote-audio

一个开源的 Python 工具包,使用预训练的 PyTorch 模型来识别音频记录中谁在何时说话。