google-ai-edge/mediapipe

一个开源框架,用于在移动、网页、桌面和物联网设备上构建与部署可定制的设备端机器学习流水线。

openlake-project/openlake

OpenLake 是一个开源的 Rust 存储引擎,为 LLM 推理与训练提供亚毫秒级、百万 IOPS 的访问性能。它通过 GPUDirect/RDMA 与 S3 兼容 API 卸载 KV-cache、服务向量数据库查询并提供快速检查点/对象存储,让 GPU 保持高效运行并降低整体计算成本。

llm-d/llm-d

llm‑d 是一个开源、CNCF 沙盒项目,为现有 LLM 模型服务器(vLLM、SGLang)添加生产级路由、KV 缓存分层和专家并行能力。以 Kubernetes 的 Helm Chart 形式交付,使组织能够以更低延迟和更高吞吐量,在多种加速器类型上大规模部署大语言模型。

screenpipe/screenpipe

一个本地优先的屏幕和音频记录工具,创建可搜索的 AI 记忆,以提供 AI 代理关于您计算机活动的上下文。

milvus-io/milvus

Milvus 是一个高性能、分布式向量数据库,专为需要高效搜索和组织海量非结构化数据的 AI 应用而构建。

nolabs-ai/nono

一个零延迟、零配置的沙盒,用于安全地运行 AI 代理,并提供细粒度的指令级策略与隔离的工具执行环境。

anthropics/defending-code-reference-harness

使用 Claude 在源代码中查找、验证和修复安全漏洞的自主漏洞发现与修复参考实现。

hang-jin/editaplot

通过人机协同的数据确认确保科学准确性的 AI 引导工作流,用于在 Origin 中创建可编辑的科学图表。

thedaviddias/Front-End-Checklist

An open‑source front‑end quality system that turns best practices into a practical review workflow for humans and AI agents via a website and MCP server.

ngxson/wllama

一个为 llama.cpp 提供的 WebAssembly 绑定,利用 WebGPU 和 Wasm 在浏览器中直接运行 LLM、多模态模型和工具调用。

apache/doris

一个开源的实时分析与搜索数据库,提供对结构化、文本和向量数据的快速 SQL 分析和混合搜索能力。

okf-memory/okf-agent-memory

基于 Open Knowledge Format (OKF) 的 Git 原生持久内存层,提供快速本地搜索和版本控制的知识存储。

web-infra-dev/midscene

一种基于视觉驱动的 GUI 代理,可通过自然语言指令在 Web、移动和桌面平台上自动化和验证用户界面。

modelscope/ms-swift

支持 1,000 多个文本和多模态大模型的微调、评估和部署的可扩展基础设施

guillermolg00/morphicons

一个通用的基于描边的图标变形库,使用弹簧物理效果和数学对齐来在任何两个图标之间创建平滑的过渡。

NVIDIA/Megatron-LM

一个为在数千个 GPU 上大规模训练 Transformer 模型(20 亿至 4620 亿参数)而优化的 GPU 库,提供先进的并行策略和优化的构建模块,支持分布式训练。

BoardUI/boardui

一个为代理界面设计的 React 设计系统,提供 AI 特有 UI 组件作为源文件,并配备 AI 辅助安装的 MCP 服务器。

cloudflare/agents

Cloudflare Agents 是一个 TypeScript SDK,可将 Cloudflare Durable Objects 转换为持久、实时的 AI/代理工作负载。它提供类型安全的 RPC(`@callable`)、WebSocket 同步、调度、AI 聊天、工具调用、语音、邮件、支付(x402)、工作流以及完整的 React 钩子库。代理在空闲时休眠,可按百万级规模部署,且无空闲成本。

AvdLee/SwiftUI-Agent-Skill

一个便携式代理插件,提供专家级 SwiftUI 最佳实践、现代 API 参考文档(最高至 SDK 27)以及性能追踪分析工具链。

slopus/happy

支持端到端加密的 Claude Code 和 Codex 移动和网页客户端,使开发者能够远程监控和控制 AI 编码代理。

DingTalk-Real-AI/dingtalk-workspace-cli

一个为钉钉工作区设计的命令行界面,使人类和AI代理能够通过结构化命令安全访问和管理企业数据。

turboderp-org/exllamav3

一个用于在消费级 GPU 上运行本地 LLM 的推理库,具备 EXL3 量化、并行推理和大 MoE 模型的 CPU 卸载功能。

TabularisDB/tabularis

一个支持多种数据库的开源桌面 SQL 工作区,内置 AI 文本转 SQL 功能、SQL 笔记本,以及用于 AI 代理集成的 MCP 服务器。

davepoon/buildwithclaude

为 Claude Code 提供插件市场和发现平台,通过精选的代理、命令和钩子来扩展 AI 开发工作流。

SemiAnalysisAI/InferenceX

一个开源的持续推理研究平台,可追踪各种高端硬件上 LLM 推理框架的实时性能提升。

openocta/openocta

适用于 Windows 和 macOS 的桌面 AIOps 代理,通过自然语言和工具链集成,自动化 IT 运维任务,如告警分析和系统检查。

siteboon/claudecodeui

A desktop and mobile UI for Claude Code, Cursor CLI, and Codex that provides a graphical interface for managing AI agent sessions.

browseros-ai/BrowserOS

一款基于 Chromium 的次级浏览器,专为 AI 代理设计,使其能够使用您真实认证的登录信息,在本地并行自动化网络任务。

ulab-uiuc/LLMRouter

一个开源库,用于智能 LLM 路由,通过动态选择每个查询最合适的模型,以优化推理成本和性能。

0xPlaygrounds/rig

Rig 是一个 Rust 库,为构建 LLM 驱动的应用程序提供统一、模块化的 API。它包含现成的代理运行时(多轮、流式、工具调用)、对 20 多个模型提供商和 10 多个向量存储后端的抽象、GenAI 可观测性支持,以及可选的测试用录制/回放功能。该 crate 可在原生和 WebAssembly 目标上运行,并被 St Jude、Neon 和 Ryzome 等公司用于生产环境。

google-gemini/gemini-skills

一个为 AI 编码助手提供上下文的技能库,帮助其生成准确、最新的 Gemini API 和 SDK 代码。

junhoyeo/tokscale

用于跟踪多个 AI 编码代理的令牌使用量和成本的高性能 CLI 工具和可视化仪表板。

alexgreensh/token-optimizer

用于 AI 编码助手的令牌管理工具,通过压缩上下文浪费并防止会话压缩期间的数据丢失,降低 API 成本。

anomalyco/models.dev

一个可通过公开 API 访问的 AI 模型规格、价格和功能的开源数据库。

microsoft/intelligent-terminal

一个实验性 Windows Terminal 分支,支持原生 AI 代理集成,允许用户在 shell 上下文中直接与 ACP 兼容代理交互。

aklofas/kicad-happy

一个为 KiCad 提供 AI 功能的设计审查工具,可分析原理图和 PCB 布局,发现错误,通过 SPICE 仿真电路,并预测 EMC 风险。

SimoneAvogadro/android-reverse-engineering-skill

一个用于从混淆的 Android 二进制文件中提取 HTTP API 并恢复原始 Kotlin 类名的 Claude Code 技能。

BloopAI/vibe-kanban

一个结合看板规划与专属工作区的 AI 编码代理管理层,提供代理执行、审查和应用预览功能。

Kc1t/alethe-agents

一个本地优先的桌面工作区,用于并行运行多个 AI 编码代理和 shell,提供会话持久性和 MCP 服务器的统一管理。

rylena/sshdesk

一种远程桌面解决方案,可在不需额外端口或专用客户端的情况下,将完整的交互式图形界面直接交付至 SSH 会话中。

sierra-research/tau2-bench

一个用于评估文本和语音模态下客服代理人的模拟框架,测试其遵循政策和使用工具在真实领域的能力。

NVIDIA/TensorRT-LLM

一个针对 LLM 和视觉生成模型的优化库,利用专用内核和高效运行时,在 NVIDIA GPU 上最大化推理吞吐量并最小化延迟。

jnMetaCode/superpowers-zh

一个增强版的 superpowers 框架,专为中文环境优化,提供 20 种系统化的工作方法论,帮助 26 种不同的 AI 编码工具更专业地进行代码规划、调试和审查。

techjarves/ClaudeCode-Portable

一个可移植的 AI 编程工作区,捆绑了官方 Claude Code 运行时和 Agent SDK,支持从 U 盘运行,并兼容多个 AI 提供方。

firstintent/ccteam

ccteam 是一个编排层,将独立的 AI 编码 CLI 转变为协调的团队,允许代理从统一控制台跨不同供应商和机器运行。

NVIDIA-NeMo/Guardrails

NeMo Guardrails 是 NVIDIA 推出的开源 Python 工具包,让开发人员能为基于 LLM 的聊天应用程序添加可编程的安全和控制规则(护栏)。它支持输入、对话、检索、执行和输出护栏,使用名为 Colang 的简单 DSL 来定义流程,可搭配多种 LLM 提供商,提供具有 OpenAI 兼容 API 的 CLI/服务器,并包含评估工具。该库旨在构建值得信赖、安全的对话式 AI。

MORTEN-BUUR/nordef-matrix-open-control

一种与模型无关的AI代理安全控制平面,通过在语言模型外部强制执行确定性策略和加密人类批准来保障安全。

kagent-dev/kagent

一个 Kubernetes 原生框架,用于以声明式自定义资源方式构建、部署和管理 AI 代理。