iPolloWork: 一个通过智能体创建可编辑代码、文档和多媒体内容的本地优先视觉 AI 工作台
一个本地优先的视觉 AI 工作台,使智能体能够在单个工作空间内创建并维护可编辑的代码、文档、演示文稿和视频。
voice-pro: 用于 YouTube 处理、声音克隆和多语言翻译的一站式 AI 配音工作室
一款由 AI 驱动的 Web 应用程序,用于语音识别、翻译和多语言配音,将 ASR、TTS 和声音克隆集成到单一的工作流程中。
opencodex: 一个通用的提供商代理,让你可以在 Codex、Claude Code 和 Grok Build 中运行任何 LLM
一个本地代理,通过翻译其 API 响应,使得 OpenAI Codex、Claude Code、Claude Desktop 和 Grok Build 可以使用任何 LLM 提供商。
mesh-llm: 一个通过跨机器池化 GPU 和内存资源来运行大模型的分布式推理系统
一个分布式 LLM 推理系统,通过跨多台机器池化 GPU 和内存,利用 OpenAI 兼容的 API 来运行大模型。
omnigent: 一个用于跨设备编排和管理多个 AI agent 的开源 meta-harness
一个为 AI agent 提供通用编排层的开源 meta-harness,允许用户切换 runtime、实施策略并在跨设备的情况下进行实时协作。
EverOS: 一个为智能体设计的、以 Markdown 作为权威事实来源的本地优先记忆运行时
一种为 AI 智能体设计的本地优先记忆运行时,使用 Markdown 作为事实来源,从而在应用和设备之间提供可移植、持久的长期记忆。
semantic-router: 一个用于在异构 LLM 基础设施上构建 Mixture-of-Models 系统的可编程路由层
一种用于 Mixture-of-Models 系统的可编程路由层,通过在异构计算和基础设施上优化 LLM 请求路由,从而提高质量、成本和延迟表现。
openmed: 一个用于 PII 脱敏和医学实体提取的本地优先临床文本流水线
一种本地优先的医疗保健 AI 运行时,用于临床实体提取和 PII 脱敏,可在 Python、Swift、Android 和浏览器上在设备端运行。
wigolo: wigolo: 面向 AI 代理的本地优先网络情报
wigolo 是一个面向 AI 代理的本地优先网络情报工具包,提供搜索、抓取、爬取、提取、缓存、查找相似、研究和代理工具,核心功能无需 API 密钥。它可以作为 MCP 服务器、REST 端点或 SDK 运行,所有数据保存在 `~/.wigolo/` 中并保持私密,同时提供可选的基于 LLM 的合成功能用于高级任务。 ## 关键特性 - 十种集成的网络工具(搜索、抓取、爬取、提取、缓存、查找相似、研究、代理、差异、监控) - 作为 MCP 服务器(用于编码代理)、REST 端点或可嵌入的 SDK(TypeScript/Python)运行 - 本地优先设计:数据停留在 `~/.wigolo/` 下;除非显式选择启用 LLM 合成,否则不进行第三方调用 - 核心工具零 API 密钥;使用公共搜索引擎和设备端 ML 模型 - 每个结果返回带有字节偏移源跨度和可解释评分的逐字摘录 - 初始设置后每次查询零成本(结果本地缓存以实现即时重新查询) - 与主要 AI 代理框架集成:LangChain、CrewAI、LlamaIndex、Vercel AI SDK - 支持直接连接到流行代理:Claude Code、Cursor、Codex、Gemini CLI、OpenCode、VS Code、Windsurf、Zed、Antigravity ## 工作原理 wigolo 作为单个 Node.js 进程运行,公开三个接口:MCP(通过 stdio 的 JSON-RPC 用于代理通信)、REST API 和 SDK。搜索工具使用 18 个直接适配器并进行排名融合和设备端 ML 重新排序。抓取工具采用分层路由器,根据可观察信号(SPA 标记、反机器人挑战)从普通 HTTP 升级到无头浏览器。结果存储在结合关键词和向量索引的本地缓存中。可选的 LLM 合成(用于研究/代理工具)可通过环境变量配置(例如 `WIGOLO_LLM_PROVIDER=gemini`)。所有重型组件(浏览器引擎、嵌入模型)均在 `~/.wigolo/` 下懒加载并本地存储。 ## 局限性 - 一些依赖 IP 声誉的挑战保护站点在数据中心 IP 上可能失败,而在家庭连接上可能成功(参见自托管指南以了解代理选择加入) - 没有 LLM API 密钥时,`research` 和 `agent` 工具返回原始证据简报而非合成答案 - 初始设置需要约 1.5 GB 的可用磁盘空间并下载浏览器引擎和设备端模型 - 需要 Node.js >= 20 ## 生态系统 - CLI:`npx wigolo <tool>` 用于终端使用`于终端使用` - 交互式 shell:`wigolo shell` 用于 NDJSON 管道 - REST API:`wigolo serve` 公开 JSON 端点 - Docker:官方镜像在 GitHub Container Registry 和 Docker Hub 上提供 - 框架集成:官方包适用于 LangChain、CrewAI、LlamaIndex 和 Vercel AI SDK - 代理技能:11 项技能目录通过 `wigolo skills` 管理 ## 许可证 AGPL-3.0 ## 状态 公开测试版 ## 链接 - 文档:[docs/README.md](docs/README.md) - 示例:[examples/README.md](examples/README.md) - 安装:[docs/installation.md](docs/installation.md) - 配置:[docs/configuration.md](docs/configuration.md) - 工具参考:[docs/tools.md](docs/tools.md) - SDK:[docs/sdks.md](docs/sdks.md) - 自托管:[docs/self-hosting.md](docs/self-hosting.md) - 技能:[docs/skills.md](docs/skills.md) - 贡献:[CONTRIBUTING.md](CONTRIBUTING.md)
markstream-vue: Markstream — 流式 Markdown 渲染器用于 AI 聊天
Vue 3 / Nuxt / VitePress 包,能够在 Markdown 流式传输(例如来自 LLM 令牌流)时逐步渲染,以最小化闪烁并在 AI 聊天界面中提供流畅体验。
note-gen: 一个使用 AI 将零散的信息碎片整理成结构化笔记的本地优先 Markdown 应用
一款使用 AI 将零散的信息碎片(如语音录音和截图)整理成结构化笔记的本地优先 Markdown 应用。
ms-swift: ms‑swift: 用于微调 LLM 和多模态模型的可扩展轻量级基础设施
ms‑swift 是一个轻量级的全栈框架,用于微调、推理、服务和评估数百个 LLM 和多模态模型,提供 LoRA 风格的高效训练、先进的并行技术、量化、RLHF 以及基于 Gradio 的 UI。
banana-slides: 一个通过自然语言提示词和文档创建可编辑幻灯片及配音视频的 AI 原生演示文稿生成器
一款 AI 原生演示文稿应用,通过自然语言编辑和 nano banana pro 模型,从想法、文档或图像生成可编辑且专业的幻灯片。
airllm: 一种内存高效的推理引擎,通过逐层加载的方式在消费级 GPU 上运行大规模 LLM
AirLLM 是一个库,通过每次仅将一个模型层加载到显存中,从而实现在低端 GPU 上运行大规模 LLM(高达 671B 参数)的能力。
DeepSeek-Reasonix: DeepSeek‑Reasonix: 一个基于配置驱动、插件化的终端 AI 编程助手。
DeepSeek-Reasonix 是一个终端 AI 编程助手,通过基于配置和插件驱动的框架使用 DeepSeek 模型,并以单个静态 Go 二进制文件形式交付,针对 DeepSeek 的前缀缓存进行了优化,以保持较低的 token 成本。
WrenAI:一个开源的生成式 BI 引擎,让 AI Agent 可以从任何数据库部署受控的仪表板
一个开源的生成式 BI 引擎,为 AI Agent 提供上下文层,使其能够从任何数据库生成受控的 SQL、创建图表并部署可共享的仪表板。
screenpipe: 一个通过捕获屏幕和音频来驱动可搜索历史记录和 AI agent 的本地优先 AI 记忆系统
一种本地优先的 AI 记忆工具,通过捕获屏幕和音频活动来创建可搜索的历史记录,并为 AI agent 提供上下文。
openai-agents-python: 一个支持语音和沙盒执行的多智能体工作流构建框架,且不依赖于特定供应商
一个轻量级、不依赖于特定供应商的框架,用于构建多智能体工作流,支持跨各种 LLM 的文本、语音和沙盒执行。
LightRAG: 一个轻量级的基于图的 RAG 框架,通过桥接向量和图检索实现高效的大规模索引
一种轻量级的、基于图的 RAG 框架,结合了知识图谱和向量嵌入,以提供深度的上下文理解和高效的增量更新。
vox-director: 从单个主题创建编辑风格纸质拼贴解说视频的自动化流水线
一种代理技能,可自动制作 Vox 风格的纸质拼贴解说视频,处理从脚本、关键帧到动态效果和音频的一切工作。
browser-use: 一个让 LLM 能够控制浏览器执行自动化网页任务的 AI Agent 框架
一个让 AI Agent 能够通过自然语言指令控制浏览器执行填写表单、提取数据和 QA 测试等任务的库和框架。
sglang: 一个具有 RadixAttention 和广泛硬件支持的高性能 LLM 及多模态模型推理框架
SGLang 是一个针对 LLM 和多模态模型的高性能推理框架,通过先进的缓存和调度机制,在各种硬件上优化了推理吞吐量和延迟。
CodeWhale: 一个支持 BYOK 和细粒度权限控制的模型无关终端编程代理
一款开源的、模型无关的终端编程代理,可以使用任何 LLM 提供商来读取代码、编辑文件并运行命令。
mempalace: 一个具有逐字存储和可插拔向量后端的本地优先 AI 记忆系统
一个本地优先的 AI 记忆系统,它将对话历史存储为逐字文本,并使用语义搜索进行高精度检索,而不使用摘要。
mnemosyne: Mnemosyne: 本地优先的 AI 记忆层
Mnemosyne 是一个面向 AI Agent 的本地优先、基于 SQLite 的记忆层,它提供工作记忆、情景记忆和时序知识图谱 (TripleStore),且无需外部服务或云端依赖。
ECC: ECC: Agent Harness Operating System for AI Coding Assistants
ECC 提供了一个智能体框架操作系统,它为 AI 编程智能体配备了一套协调的工程系统——包括智能体, 技能, 命令, 钩子, 记忆, 和安全扫描——用于规划, 测试, 实现, 评审, 验证, 记忆, 和改进代码。
inkos: 一个具有多维连续性审计和开放世界互动小说能力的专业故事创作智能体系统
一个用于长篇故事创作和互动小说的 AI Agent 系统,通过多智能体审计流水线和结构化长期记忆来确保叙事的一致性。
apfel: apfel: Apple 的本地端 LLM 作为 macOS 的 CLI 和 CLI 兼容服务器
apfel 将 Apple 的本地端 LLM 带入终端,并作为本地 OpenAI 兼容服务器,为 Apple Silicon Macs 提供私密、免费的 AI 能力。
OpenOutreach: OpenOutreach: 用于 B2B 潜在客户开发的自托管 AI 销售代理
一个自托管、开源的 AI 销售代理,通过从授权数据中寻找公司概况、利用 AI 筛选最佳潜在客户,并从用户自己的邮箱发送个性化电子邮件来自动化 B2B 潜在客户开发。
herdr: 一个用于管理和协调多个 AI 智能体的终端 Agent 多路复用器
一个基于终端的 Agent 多路复用器,允许用户通过持久化会话和 Socket API 监控、管理和协调多个 AI 智能体。
open-connector: OpenConnector – 一个统一的、可自托管的连接器目录,为 LLM 智能体提供安全、可复用的数千种 SaaS 工具访问权限
OpenConnector 是一个开源网关,通过预构建 Action 的目录,让 AI 智能体能够调用 1,000+ SaaS 服务。它安全地存储 API 密钥/OAuth 令牌,提供可检查的请求/响应模式,并可以在本地、Cloudflare Workers、Fly.io 或通过 OOMOL 的托管 SaaS 运行。可以通过 TypeScript SDK、CLI、MCP 或直接 OpenAPI 调用进行集成,并提供 Web 控制台用于管理和调试。
apify-mcp-server: 一个将 AI 智能体连接到数千个现成的网络爬虫和自动化工具的 MCP 服务器
一个 MCP 服务器,使 AI 智能体能够使用数千个 Apify Actors 进行网络爬虫、数据提取和自动化,具有动态工具发现和智能体支付功能。
open-code-review: 一个结合了确定性工程与智能体工作流的 AI 驱动型代码审查 CLI 工具,用于实现高精度缺陷检测
一个结合了确定性工程与智能体工作流的 AI 驱动型代码审查 CLI 工具,旨在提供高精度、行级的代码缺陷检测。
SmartSub: SmartSub – 一键式桌面视频字幕、翻译与 AI 配音
SmartSub (妙幕) 是一款开源的跨平台桌面应用,支持下载视频、使用本地或云端 ASR 模型进行音频转录、通过数十种服务进行字幕翻译、校对字幕、生成配音(包括 zero-shot 语音克隆),并最终将字幕烧录或封装回视频中——这一切都可以优先离线运行,并支持可选的 GPU 加速。
openlake: 针对 GPU 工作负载的分布式存储引擎,优化 KV cache 卸载与模型训练
一个使用 Rust 构建的、针对 GPU 工作负载的高性能分布式存储引擎,通过提供快速的 KV cache 卸载和兼容 S3 的对象存储,来优化 LLM 推理和训练。
Vibe-Skills: VibeSkills: 一个用于 AI agent 的 Skill 编排框架,可路由本地 Skills,以 L/XL 级别规划工作,记录进度,并通过 17 项检查验证结果。
VibeSkills 编排本地安装的 Skills,用于规划、执行和验证复杂任务,提供基于级别的任务分解、Skill 选择、执行跟踪以及 17 点验证检查。
llama.cpp: 一个在多种多样化硬件 ## What it solves `llama.cpp
一个用于 LLM 和 VLM 推理的纯 C/C++ 实现,能够在多种多样化硬件上以极简化的-and-minimal-setup的方式实现高性能-and-minimal-setup的本地执行。
DiffSynth-Studio: 一个用于生成式图像、视频和音频模型前沿探索与训练的开源扩散模型引擎
一个开源扩散模型引擎,为图像、视频和音频的前沿生成式模型的集成、训练和部署提供了一个统一的框架。
OpenBiliClaw:一个通过构建本地心理画像来打破信息茧房的跨平台个性化内容发现智能体
一个本地化、注重隐私的 AI Agent,通过构建用户的深层心理画像,在 Bilibili、YouTube 和 X 等多个平台主动发现个性化内容。
PyRIT: 一个用于主动识别生成式 AI 系统风险的开源框架
PyRIT 是一个开源框架,使安全专业人员和工程师能够主动识别生成式 AI 系统中的风险。
natively-cluely-ai-assistant: 一个具有不可检测隐身模式和本地 RAG 内存的私密、低延迟面试副驾驶
一款实时 AI 面试副驾驶和会议助手,在面试和会议期间提供低延迟、私密且不可检测的实时协助。
sie: 一个为智能体提供服务的自托管推理引擎,通过单个集群提供 100+ 开源模型
一个通过单一 API 提供多种开源模型的自托管推理引擎,取代了为不同智能体任务维护多个独立模型服务器的需求。
ao: 一个用于量化、稀疏化和显存高效训练的 PyTorch 原生优化库
一个用于模型优化的 PyTorch 原生库,提供量化、稀疏化和显存高效训练工具,以加速推理并减少 VRAM 使用量。
pyod:面向多模态数据的全方位异常检测工具包,具备代理式工作流
一个面向多种数据模态的全方位 Python 异常检测库,具备用于 AI 驱动异常调查的代理式工作流。
skypilot:统一的控制平面,用于在多个云和集群中管理和扩展 AI 计算
一个使用统一接口在任意云提供商、Kubernetes 或 Slurm 集群上运行、管理和扩展 AI 工作负载的系统。
machine-learning-for-trading: 一个端到端的研究到生产管道,用于构建和部署机器学习驱动的交易策略
一个全面的框架和代码库,用于开发机器学习驱动的交易策略,覆盖从数据获取和研究到实时生产部署的完整管道。
N.E.K.O:具备持久记忆和桌面自动化的主动多模态 AI 伴侣
一个开源 AI 伴侣平台,能够创建具备实时语音/视觉理解、持久五维记忆和桌面自动化能力的主动数字生活。
loop-engineering:一个用于设计自动化控制系统以协调 AI 编码代理的框架
一个用于设计自动化控制系统以协调 AI 编码代理的框架,用结构化、可重复的循环取代手动提示。
faceswap:一种用于识别和交换图片与视频中面孔的深度学习工具
一种通过提取‑训练‑转换流水线来识别和交换图片与视频中面孔的深度学习工具。
Maestro:一个跨平台编排器,用于管理并行执行和自动剧本的 AI 编码代理舰队
跨平台桌面应用,用于并行编排多个 AI 编码代理,具备自动剧本、Git worktree 隔离和键盘优先界面。