debpalash/VoiceStudio

用于语音克隆、配音和转录的本地优先音频工作站,提供对 27+ 个 AI 音频引擎的统一界面。

Tencent/teamai-cli

TeamAI CLI 是一个通过 npm 分发的命令行工具,允许软件团队将 AI 助手资源(技能、规则、文档、钩子、MCP 配置和共享知识库)集中存储在单一 Git 仓库中,并自动同步到本地 Claude、Codex、Cursor 等代理。支持角色/标签过滤、源订阅、会话学习捕获、代码库知识图谱以及使用情况/知识库健康状态仪表板。

coreyhaines31/marketingskills

一个 MIT 许可的基于 Markdown 的 *代理技能* 集合,用于教导 AI 编码代理(Claude Code、OpenAI Codex、Cursor 等)执行营销任务——SEO、文案撰写、CRO、广告、分析等。通过 `npx skills` 或 Claude Code 插件安装后,向您的代理请求帮助(例如“写一个落地页标题”),合适的技能将运行并提供分步指导。

herdrdev/herdr

herdr 是一个基于 Rust 的终端运行时,可让 AI 编码代理(Claude、Codex、Cursor 等)在持久面板中运行。它支持会话分离、断线后恢复布局、多台远程机器、tmux 风格 UI 和插件系统,且无需重型 GUI。

Graphify-Labs/graphify

Graphify 是一个 Python CLI,使用 Tree-sitter 构建本地、无需 LLM 的代码库(及可选文档/媒体)知识图谱。该图谱可可视化、可查询,并可与 Claude、Copilot、Cursor、Gemini 等众多 AI 编码助手集成,实现无需 grep 即可回答问题、追踪连接或解释符号。

miuuyy/codex-chatgpt-web

一个跨平台 Electron 启动器,可在嵌入式浏览器中登录 ChatGPT Web,并将选定的 ChatGPT 模型作为原生 Codex 模型暴露,通过 OpenAI 的 tunnel‑client 可选地实现完整的工具集成。

OpenWhispr/openwhispr

OpenWhispr 是一款跨平台桌面应用,可将语音转换为文本,提供带有说话人日志的实时会议转录,并允许你直接从键盘与 AI 助手(GPT-5, Claude, Gemini 等)进行对话。它支持通过 Whisper-based 模型离线工作,或通过云端服务工作,笔记可以本地存储(支持可选的云端同步),并提供 API 用于程序化使用。

trailhq/Graft

Graft 是一个开源的 TypeScript/Node.js 工具,利用 tree-sitter 进行结构化解析,并可选地使用 LLM 摘要,构建本地、基于 Markdown 的代码库知识图谱(摘要、关键代码片段、类型化链接)。图谱缓存在 `graft/` 文件夹中,仅在文件变更时刷新,并自动集成到 Claude Code、Cursor、Codex 和 Gemini 等编码代理中。基准测试显示,最多减少 46% 的工具调用、42% 的 token 消耗、60% 的延迟,并在 SWE-bench 上实现 12 点准确率提升。集成通过单个 `graft init` 命令完成,生成代理专用的指令文件;CLI 还提供搜索、可视化和遥测控制功能。项目采用 MIT 许可证,旨在实现更快、更低成本的 AI 辅助开发。

ahujasid/blender-mcp

MCP for Blender 是一个开源桥接工具,允许 LLM(如 Claude、Codex、Cursor 等)通过基于套接字的服务器(MCP 服务器)和 Blender 插件控制 Blender。安装 `uv`,用简短的 JSON 片段配置 LLM 客户端,安装插件后,即可让 AI 创建、编辑或检查 3D 场景,运行 Python 代码,并从 Poly Haven、Sketchfab、Poly Pizza 或 AI 生成模型服务中获取资产。安全模式可沙箱化 Python 执行,服务器可在本地、Docker 或 `pipx` 中运行。项目已打包在 PyPI 上,并由 Discord 社区支持。

msitarzewski/agency-agents

一个基于 Markdown 的 AI 代理人格仓库(例如:前端开发人员、AI 工程师、UI 设计师),提供脚本将它们转换并安装到多种 AI 编码助手(Claude Code、Cursor、Gemini CLI 等)中。提供即用型专家提示、工作流程和交付成果模板,可在各类工具间快速使用。

JuliusBrussee/caveman

Caveman 是一个面向 AI 编码助手的令牌节省包装器。它提供了一个小型“技能”,可将助手的解释文本改写为简洁风格,以及一个可选的本地代理,可在大型输入(日志、JSON、差异等)到达 LLM 提供商之前对其进行压缩。基准测试显示,输出令牌最多可减少 65%,输入令牌约减少 33%,从而降低 Claude Code、Codex、Gemini 等代理的成本和延迟。安装方式包括技能的一行命令和代理的全局 npm 安装,可在 30 多个代理中无需修改配置文件即可工作。

virgiliojr94/book-to-skill

一个 Python 工具,可将 PDF、EPUB、DOCX、Markdown 等格式的文档转换为 Agent-Skill 包(SKILL.md + 每章 Markdown 文件)。该技能可被 Copilot CLI、Amp、Claude Code 加载,使 LLM 能按需从原始书籍中回答问题,相比将整本书作为上下文输入,可节省 24–51 倍的令牌。

Panniantong/Agent-Reach

Agent Reach 是一个开源 Python CLI,为任何基于 LLM 的 AI 代理提供开箱即用、自动更新的网页阅读、YouTube 字幕获取、Reddit 查询、GitHub 数据拉取及多种其他平台访问能力。它自动选择、安装并健康检查每个服务的最佳开源工具,注册 `SKILL.md` 供代理使用,并提供 `doctor` 命令诊断通道状态。项目免费,采用 MIT 许可证,注重安全(本地存储凭证,无显式 `--system` 不做系统变更)。

addyosmani/agent-skills

Agent Skills 是一个包含 25 个基于 Markdown 的工程工作流(规格、计划、构建、测试、审查、发布等)的库,可通过简单 CLI 安装到多种 AI 编码代理中。它提供斜杠命令、自动构建模式、专业角色和参考检查清单,使 AI 生成的代码在整个开发生命周期中遵循资深工程师的最佳实践。

volcengine/OpenViking

OpenViking 是一个开源上下文数据库,将 LLM 代理的记忆、资源和技能呈现为虚拟文件系统(`viking://`)。每个条目都预处理为三个层级(抽象、概览、完整细节),使代理仅加载所需内容,显著降低令牌使用量和延迟,同时保持检索路径可观测。它提供 Python 服务器、CLI(`ov`)、Web Studio 演示,并支持多种流行代理(Claude Code、Codex、LangChain 等)的即用集成。通过 `pip install openviking` 安装,运行 `openviking-server init` 配置提供者,然后启动服务并使用 `ov` 命令添加资源、浏览和搜索。基准测试显示令牌节省 30–90%,记忆密集型任务准确率提升至约 80%。核心为 AGPL-v3;Volcano Engine 也提供托管 SaaS 版本。

MadsLorentzen/ai-job-search

AI Job Search 是一个开源、由 Claude Code 驱动的 CLI 框架,可自动化完整的求职流程:抓取丹麦(及部分国际)求职网站,根据结构化匹配评分标准对职位进行排序,起草 LaTeX 简历和求职信,运行评审 LLM,验证 PDF,检查 ATS 可读性,追踪结果,并可同步至 Notion 或 Gmail。前提条件包括 Claude Code、Python 3.10+、Bun 和完整的 LaTeX 发行版。该仓库提供详细的命令定义、门户抓取代理及面试准备、技能差距分析和报告生成的实用工具。

NVIDIA/SkillSpector

SkillSpector 是 NVIDIA 开发的开源工具,用于扫描 AI 代理人的技能(插件、提示、代码)中的安全问题。支持 71 种已知漏洞模式的静态分析,可选的 LLM 语义检查,实时 CVE 查询,基线抑制,以及多种输出格式(终端、JSON、Markdown、SARIF)。可作为 CLI、Docker 容器或 MCP 服务器运行,适用于开发者、CI 流水线和生产代理。

Shubhamsaboo/awesome-llm-apps

Awesome LLM Apps 是一个采用 Apache-2.0 许可证的集合,包含 100 多个即开即用的 AI 代理、代理技能和 RAG 管道。该仓库将模板分为启动代理、高级多步骤代理、常驻服务、语音代理、生成式 UI 代理、游戏代理、MCP 支持工具以及详细的 RAG 教程。每个条目均附带真实代码、经过安全检查的 CI,并支持 Claude、Gemini、GPT-4/4o、DeepSeek、Llama、Qwen 等多种模型。用户可通过 `npx skills add …` 在几秒内添加技能,或通过 `pip install && streamlit run` 在约 30 秒内运行完整代理。该项目由 Unwind AI 维护,可免费用于商业用途。

Gitlawb/openclaude

OpenClaude 是一个开源、以终端为先的 CLI,让开发者能与多种 LLM 提供商(云 API、Ollama、Gemini 等)交互,用于代码辅助任务。它提供统一的提供方设置、工具驱动的多步工作流、后台会话、代码库地图、VS Code 扩展,甚至还有像素艺术伙伴。通过 npm 安装,使用 `/provider` 配置提供方,再通过 REPL 或后台命令生成、重构或调试代码。

ChromeDevTools/chrome-devtools-mcp

一个 Node.js 服务器,通过 Model‑Context‑Protocol 让 AI 编码助手能够控制实时 Chrome 浏览器,将 DevTools 功能(性能追踪、网络/调试控制台、截图、Puppeteer 自动化)作为基于 JSON 的工具暴露。

jamiepine/voicebox

一个本地优先的开源 AI 语音工作室,支持语音克隆、语音生成和系统级语音输入,内置用于 AI 代理集成的 MCP 服务器。

xzf-thu/VoiceMem

专为实时语音代理设计的流式双脑记忆系统,实现低延迟、情感感知的长期记忆,且令牌消耗极低。

semantica-agi/semantica

Semantica是一个开源Python平台,从企业数据构建受治理的上下文/知识图谱,添加确定性推理,并将每个AI决策记录为可追踪的图节点。它提供SHACL/OWL本体管理、W3C PROV-O来源、多语言RDF/LPG存储、分析以及与LangChain、CrewAI等的集成,面向需要可解释、可审计AI的受监管领域。

openTrinity/mycontext

MyContext 是一款桌面应用,可将用户的工作数据(聊天、文档、会议等)持续摄取到私有的本地存储知识图谱中。该图谱可通过 LLM、本地代理或授权的 AI 应用进行查询,为它们提供更具信息量的响应所需的个人上下文层。功能包括数字自我助手、带有来源引用的自然语言搜索,以及严格的人机回环(human-in-the-loop)控制。该项目正在积极开发中,并根据 Elastic License 2.0 发布。

Imbad0202/academic-research-skills-codex

ARS‑Codex 是一个 Codex 原生插件,捆绑了完整的学术研究工作流(问题精炼、文献综述规划、论文起草、同行评审模拟,以及从研究到论文的端到端流程)。通过 Codex 市场或直接作为技能安装后,调用 `$academic‑research‑suite`(或 `ars‑*` 别名)即可由路由器选择合适的流程。仓库提供设置文档、架构说明和一个默认禁用的完整运行时适配器。它是一个 AI 驱动的研究助手,而非通用教程列表。

xai-org/x-algorithm

该仓库是 X 的「For‑You」推荐流的生产级代码。它整合了关注账号内(in-network)和非关注账号内(out-of-network)的推文,使用 Transformer 模型(Phoenix)进行评分,应用可配置权重,基于丰富标签系统执行可见性过滤,并最终融合广告与推荐内容。仓库包含请求时流水线(home-mixer)、检索模型(phoenix、simclusters)、标签基础设施(agatha、clip、botmaker、scarecrow)以及透明度工具。近期更新增加了权重文档、巴西选举过滤器和合成训练代码。采用 Apache 2.0 许可证。

microsoft/VibeVoice

VibeVoice 是一组开源语音 AI 模型,提供高说话人一致性和高效性的长时语音识别(ASR)和文本转语音(TTS)功能。

supermemoryai/supermemory

Supermemory 是一个托管加自托管的记忆与上下文引擎,专为基于 LLM 的助手设计。它从聊天、邮件、PDF、图像、代码等中提取事实,构建用户档案(静态事实 + 动态近期上下文),并通过单一 API(`add`、`profile`、`search`)提供混合 RAG + 记忆搜索。插件可让流行工具(Claude Code、Cursor、Codex)获得持久记忆,而一个单二进制的 `supermemory local` 服务器可让您使用本地嵌入离线运行整个系统。该项目在 LongMemEval、LoCoMo 和 ConvoMem 基准测试中表现领先(Recall@15 达 95%,上下文减少超 99%)。

openai/whisper

Whisper 是 OpenAI 开发的基于 Transformer 的开源语音转文本系统,可处理多种语言的转录、语言识别和翻译。它作为一个可通过 pip 安装的包发布,提供六种模型大小(tiny → large,以及快速的 “turbo” 版本)。通过 CLI (`whisper …`) 和简单的 Python API (`whisper.load_model(...).transcribe(...)`),只需少量命令即可将音频文件转换为文本。该项目运行在 Python 3.8-3.11 和 PyTorch 上,并且需要 ffmpeg(可选需要 Rust 用于分词器)。所有代码和模型权重均采用 MIT 许可。

SenteLabsAI/OpenExecutive

Open Executive 是一个自托管 AI 系统,充当虚拟高管团队。它使用 Anthropic Claude(或可选本地模型)运行八个专业代理(战略、财务、人力资源、法律、运营、营销、产品、董事会)从本地 ChromaDB 向量存储中检索内置 MBA 知识和用户上传的公司文档。协调器合成单一、一致的高管声音,而 SQLite 中存储的情景记忆使系统能够记住过往决策。技术栈包括 FastAPI(Python 3.11)、Next.js 15 UI、SQLite、ChromaDB 和 Fly.io 部署脚本。支持 Web、Slack、Discord、Telegram、Google Chat、邮件和 CLI 接口,并提供调度器以实现主动跟进。该项目是真正的 AI 软件产品,而非简单的教程或列表。

lennney/stop-that-shit

Stop That Shit 是一个为 AI 编码代理(Codex、Claude Code、OpenCode、Hermes CLI、Pi)添加防护层的插件。它定义了一个包含四个问题的“Stop Ladder”,用于判断代理提议的操作(文件写入、依赖安装、哈希生成等)是否真正必要。防护层拦截这些操作,除非用户明确授权,否则会阻止它们,并返回清晰的 STOP 消息。一个独立的技能 STSS 会从代理的文本输出中删除不必要的防御性语言。该项目提供五个代理的适配器、测试套件,以及每个主机的安装脚本。

chuspeeism/dashi-ppt-skill

Dashi PPT Skill 是一个基于 Node 的插件,可让 AI 代理生成、编辑并导出完全样式化的幻灯片。它提供 12 个主题、1,020 个模板、丰富的图表/模型布局、浏览器内控件以及一键导出 PPTX/PDF 的功能,所有操作均在本地运行,采用 AGPL-3.0 许可证。

zhu1090093659/dsh-web

dsh‑web 是一个插件聚合包,为 DeepSeek Harness 的 Web UI 扩展出完整的 AI 开发工作台功能:带定时任务的任务看板、移动端远程控制、SSH 终端、图像理解工具、按模型配置的能力 UI、Git 图谱、皮肤、宠物、救援模式等。通过 `dsh plugin --profile web add @linxin666/dsh-web-all@latest` 安装并重启 DSH 即可使用。

vercel-labs/agent-browser

一个原生的 Rust CLI,允许 AI agent(或脚本)通过简单的命令控制 Chrome,并使用基于可访问性树的元素引用(`@eN`)。它支持打开页面、拍摄快照、提取文本、截图、网络模拟、标签页管理、批量执行以及实验性的 WebMCP 工具系统。

shareAI-lab/learn-claude-code

一个 17 课时的教程,教你如何为基于 LLM 的编码代理(Claude)构建外围“框架”代码。它逐步讲解如何添加工具、权限、上下文管理、记忆、任务调度、多代理协调以及目标驱动的终止机制,全部围绕一个简单的代理循环展开,让模型自行决定何时调用工具。

sopaco/deepwiki-rs

Litho(deepwiki‑rs)是一个基于 Rust 的工具,使用 LLM 从代码库自动生成功能完整的 C4 风格架构文档。它扫描源文件,提取结构和注释,运行 AI 代理推断架构,生成 Mermaid 图表,并输出与代码同步的 Wiki。支持多种语言,可集成外部文档,还包含配套工具(Litho Book 查看器、Mermaid Fixer)。专为 CI/CD 集成设计,旨在消除手动维护文档的负担。

Gentleman-Programming/gentle-ai

Gentle‑AI 是一个基于 Go 的配置工具,可为现有 AI 编码助手(如 Claude Code、Cursor 等)增强持久记忆、技能库、规划(Spec‑Driven Development)、安全防护墙以及可选的证据驱动审查(Receipt‑Driven Development)。通过简单脚本安装,运行交互式 TUI 选择助手与组件,生成原生配置文件,并提供健康检查命令。该工具不自带模型,仅用于增强您已使用的助手。

1jehuang/jcode

jcode 是一个以超低内存使用和 50ms 以下启动速度为核心的终端式 AI 代理工具箱。它将每个对话回合嵌入向量图中以实现自动记忆召回,支持侧边栏文件/图表查看,并提供‘蜂群’模式,允许多个代理在同一个代码库中协作。该工具兼容众多云服务商(Claude、OpenAI、Gemini、Copilot 等)及任意 OpenAI 兼容端点,可在 macOS、Linux 或 Windows 上通过一行脚本安装。

MeteorNOX/DeepSeek-Balance-Whale-Widget

DeepSeek Harness web UI 的一个可拖拽、动画化的鲸鱼挂件,用于显示您的 DeepSeek API 余额、今日支出(通过零配置记账模式或可选的实时 token 模式)、以及单次对话成本,支持自动更新并提供尺寸、音效和语言自定义功能。

sonicloudco/recorder

一款开源 SDK,用于将录音、语音识别和语音合成集成到 AI 硬件中,如录音卡和智能鼠标。

XiaoMaColtAI/math-modeling-skill

一个开源AI代理技能,将数学建模竞赛工作流程结构化为分析、编码、论文三个阶段,支持Python/MATLAB,生成出版级图表,保障可复现性,并输出带内置质量检查子代理的Word/LaTeX论文。包含DeepSeek Harness插件和完整测试套件。

cjpais/Handy

Handy 是一个开源、跨平台的桌面应用,使用 Whisper 或 Parakeet 模型实现离线语音转文字。按下全局快捷键,说话后,转录文本将自动粘贴到任意窗口中。基于 Tauri(Rust + React)构建,支持 Windows、macOS 和 Linux,提供 GPU 加速,并为高级用户提供 CLI 标志和 Raycast 集成。

rafal-qa/slopo

Slopo 是一个基于 Python 的 CLI,它使用代码嵌入模型(Jina AI, Voyage AI, 或本地 Ollama)来查找仓库中语义相似的代码片段。它会对源文件进行索引,计算向量嵌入,对相似片段进行聚类,并输出 Markdown 或紧凑型报告,供人类审查或 AI 编程助手使用。安装方式为 `uv tool install slopo`;配置通过 `slopo init` 完成。该工具针对隐藏的、非精确的代码重复,以辅助重构并减少 AI token 使用量。

jnMetaCode/agency-agents-zh

一个覆盖 20 个业务领域的中文 AI 专家代理集合,共 276 个,包含 63 个中国特有角色,通过简单安装脚本与 18 个 AI 编程工具集成。可与配套的“Agency Orchestrator”(CLI 或原生桌面应用)配合,无需编写代码即可构建多代理工作流。MIT 许可证,已发布于 npm。

sickn33/agentic-awesome-skills

AAS Core(智能体酷技能)是一个预览阶段的开源工具包,允许 LLM 代理(Codex、Claude 等)搜索本地 2,115+ 个可复用指令“技能”目录,选择项目所需的精确 ID,并生成一个验证过的、不可变的清单(`aas-stack.json`)。核心为只读:仅验证 ID,不进行排名或执行。CLI 可预览计划、审计风险,并干运行一个直接安装器,将选定的技能目录复制到 `~/.agents/skills`。专用插件将相关技能打包用于 Web 应用构建或安全等特定领域。系统设计为可审计和离线控制,安全警告指出其不认证语义适用性,且应用/恢复功能为实验性。

zubair-trabzada/geo-seo-claude

一个 Claude Code 技能,审计网站在 AI 搜索(GEO)中的可见性,评分引用性、品牌信号、内容质量、技术 SEO 和结构化数据,并生成 Markdown 或 PDF 客户端报告。

allenpeng0705/EnvoyMesh

EnvoyMesh 是一个自托管、点对点的社交网络,让您无需任何中心服务器即可聊天、通话、共享文件并运行个人 AI 助手。您的身份是您完全控制的加密 Ed25519 密钥,内置 AI(OpenClaw)或任何基于 HTTP 的外部 AI 可在严格策略检查下代表您行动。该平台包含 Markdown 知识库(支持 Obsidian 同步)、移动轻量客户端(EnvoyGo)以及面向团队的代理编排功能。

Untrivial-ai/agent-orchestrator

Agent Orchestrator 是一个跨平台桌面应用,可让您以隔离的 Git 支持的工作者形式运行多个基于 LLM 的代码代理,通过项目级协调器进行协调,并在实时看板上监控所有内容。