NVIDIA-NeMo/Guardrails
NeMo Guardrails 是 NVIDIA 推出的开源 Python 工具包,让开发人员能为基于 LLM 的聊天应用程序添加可编程的安全和控制规则(护栏)。它支持输入、对话、检索、执行和输出护栏,使用名为 Colang 的简单 DSL 来定义流程,可搭配多种 LLM 提供商,提供具有 OpenAI 兼容 API 的 CLI/服务器,并包含评估工具。该库旨在构建值得信赖、安全的对话式 AI。
deepcoldy/botmux
一个允许你通过 Lark/飞书远程控制 AI 编程 CLI 的桥梁,将终端输出以交互式卡片形式流式传输,并提供 Web 终端以实现移动和桌面访问。
MORTEN-BUUR/nordef-matrix-open-control
一种与模型无关的AI代理安全控制平面,通过在语言模型外部强制执行确定性策略和加密人类批准来保障安全。
kagent-dev/kagent
一个 Kubernetes 原生框架,用于以声明式自定义资源方式构建、部署和管理 AI 代理。
langwatch/langwatch
一个用于 AI 生产环境的开源平台,允许公司追踪、测试、路由和治理所有的 LLM 调用和编程智能体。
microsoft/apm
一个开源的 AI 代理依赖管理器,允许开发者通过可移植的清单文件声明和共享代理配置、技能和插件。
ProxyShard/ShardBrowser
一个开源的反检测浏览器启动器,使用修补过的 Chromium 引擎,为网页爬虫和多账号管理提供隔离且伪装的浏览器身份。
deeplethe/forkd
用于 AI Agent 扇出(fan-out)的 microVM 沙箱运行时,利用 snapshot copy-on-write 技术在毫秒内生成数百个隔离的预热运行时。
git-ai-project/git-ai
一个开源的 git 扩展,为 AI 生成的代码提供行级归属,将每一行代码链接到生成它的代理、模型和提示。
chen-006/meow-llm-detector
通过将响应分布与已知模型基准进行比较,检测哪个 LLM 正在为 API 提供服务的工具。
jlrouzies-fr/DLSS5-Feeder
通过将 ReShade 数据桥接到 DLSS 调用,使没有原生 DLSS 支持的游戏也能实现 DLSS 5 神经渲染的工具。
SaladDay/cc-switch-cli
一个用于管理多个 AI 编码助手(如 Claude Code、Codex 和 Gemini)的 API 提供者、账号和系统提示词的 CLI 与 TUI 切换板。
zhukunpenglinyutong/desktop-cc-gui
一个将 Claude Code 和 DeepSeek Harness 等命令行 AI 编码运行时整合到单一图形界面中的多引擎 AI 编码桌面客户端。
streamlit/streamlit
一个 Python 框架,能将脚本转换为交互式网页应用,使数据科学家在无需前端经验的情况下,构建并分享仪表板和 AI 聊天应用。
lancedb/lancedb
基于 Lance columnar 格式构建的多模态 AI 数据湖仓和向量数据库,可针对 PB 级向量和多模态数据实现快速、可扩展的搜索。
vllm-project/production-stack
Kubernetes 上用于生产级 vLLM 部署的参考实现,提供可扩展的推理堆栈,支持请求路由和可观测性。
AtomicBot-ai/Atomic-Chat
一个本地 AI 应用和推理引擎,允许用户在自己的设备上私密运行开源权重的大规模语言模型(LLM),同时为其他代理提供 OpenAI 兼容 API。
dagucloud/dagu
无需外部数据库,将现有脚本和容器通过声明式 YAML 转换为生产级 DAG 的本地优先、自托管工作流引擎。
furkankly/zoetrope
一个为 Claude Code 和 Codex 会话提供可视化工具,将文本转录文件转换为交互式、实时的流程图,用于监控和审查代理型工作流。
fastai/fastai
一个基于 PyTorch 的深度学习库,提供高层组件以提升生产力,提供低层组件以实现研究灵活性。
MrLesk/Backlog.md
一款 Markdown 原生的任务管理器和看板可视化工具,围绕规范和计划审查构建 AI 代理工作流,以防止代码膨胀和审查疲劳。
TIGER-AI-Lab/ClawBench
一个用于评估 AI 浏览器代理在实时网站上执行日常在线任务的开源基准测试,具有 5 层记录管道和智能体评估功能。
sting8k/pi-vcc
一个针对 Pi AI 代理的算法型对话压缩工具,通过确定性提取而非 LLM 摘要,减少 token 使用并防止历史记录丢失。
tw93/Waza
一个为 AI agent 提供结构化工程技能的库,将通用的 AI 输出替换为严谨的工程习惯,如系统化除错和设计压力测试。
flashinfer-ai/flashinfer
FlashInfer 是一个 Python 库,为 LLM 推理提供超高速、硬件感知的 CUDA 内核——涵盖注意力、GEMM、MoE、采样及相关操作。它能自动选择最佳后端(FlashAttention-2/3、cuDNN、CUTLASS、TensorRT-LLM),支持低精度 FP8/FP4,兼容所有现代 NVIDIA GPU,且已被 vLLM 和 TensorRT-LLM 等主流服务框架采用。
sunblaze-ucb/exploitgym
ExploitGym 是一个大规模的真实世界漏洞基准测试,用于评估 AI 智能体开发功能性安全漏洞利用程序的能力。
alibaba/zvec
Zvec 是阿里巴巴推出的开源、进程内向量数据库。它可存储密集或稀疏嵌入,提供闪电般快速的 ANN 和全文搜索,支持混合查询,并提供 Python、Node.js、Go、Rust 和 Dart 的 SDK。该库可在 Linux、macOS、Windows、Android 和 iOS 上本地运行,具备持久的 WAL 存储和并发读取能力。适用于基于 LLM 的检索、边缘设备,或任何需要快速嵌入式相似性搜索的应用。
czlonkowski/n8n-skills
一套 14 个专家技能和一个为 Claude AI 设计的强制执行层,使其能够通过 n8n-mcp 服务器构建、验证和部署生产就绪的 n8n 工作流。
wavetermdev/waveterm
一个开源的 AI 集成终端,结合了命令行界面、上下文感知 AI 协助、持久的 SSH 会话和内置图形化编辑器。
plannotator/herdr-annotate
一个 Herdr 插件,允许用户对终端文本进行注释并审查 AI 代理的回复,将反馈直接发送回代理。
firerpa/lamda
一个将 UI 自动化、远程桌面、数据包捕获和 AI 智能体集成到单一统一服务的全能型 Android 自动化与控制平台。
DevnorsAI/devnors-data-python
一个为 AI 代理优化的 Python SDK,提供单一 API 网关,用于访问法律案件、企业记录和学术研究等多样化数据领域。
yuxino/kiri
适用于 macOS 和 Windows 的本地优先屏幕捕获工具,整合截图、注释、OCR 和区域录制。
OpenPipe/ART
一个使用 GRPO 训练多步 AI 智能体,使其从经验中学习并提高在现实世界任务中可靠性的开源 RL 框架。
huggingface/Repo2RLEnv
一个将软件仓库、拉取请求和任务种子转换为 Harbor 格式的可执行、可验证 RL 环境的工具,用于训练和评估 AI 智能体。
stefan-jansen/machine-learning-for-trading
一个全面的框架和代码库,用于开发机器学习驱动的交易策略,涵盖从数据获取和信号研究到实时生产部署的整个流程。
meilisearch/meilisearch
一款提供全文、语义和混合搜索功能的超高速搜索引擎,支持输入即搜索性能和 AI 就绪集成。
ParthJadhav/app-store-screenshots
一项适用于 AI 编程代理的技能,能够搭建 Next.js 编辑器,用于创建并导出可用于实际产品的 Apple App Store 与 Google Play Store 营销截图。
duriantaco/skylos
一个开源的静态分析 CLI,可在多种语言中检测死代码、安全缺陷和 AI 生成代码的幻觉,确保合并前的代码质量。
dmtrKovalenko/fff
一个高性能的文件和内容搜索工具包,为人类和 AI 代理提供防拼写错误、频率排名搜索。
kenn-io/agentsview
一个本地优先的会话浏览器和成本追踪工具,为 AI 编码代理提供跨多个工具的统一搜索、分析和支出监控。
anthropics/sandbox-runtime
一个轻量级的操作系统层级沙盒工具,通过强制执行文件系统与网络限制来保护进程,从而实现更安全的 AI 代理与 MCP 服务器执行环境。
deepset-ai/haystack
一个开源的 AI 编排框架,用于在 Python 中构建可投入生产的 RAG 系统、自主代理和 LLM 应用。
zhnnky329/MathModeling-skills
一款针对数学建模竞赛的严格工作流助手,通过门控管道和审计层确保数据一致性和可复现性,同时将建模决策权保留在人类手中。
NVIDIA/SkillEvaluator
一个用于评估 AI 代理技能的多级框架,确保其安全、无冗余,并通过验证、去重和实时沙箱测试有效提升代理性能。
Dryxio/reagent
一个使用 Ghidra 和 LLM 通过自主流水线从编译二进制文件中重建并验证 C/C++ 函数的 AI 驱动的逆向工程代理。
cube-js/cube
一个开源语义层,用代码定义指标和业务逻辑,并通过 API 将其暴露给 BI 工具和 AI 代理。
modelcontextprotocol/modelcontextprotocol
Model Context Protocol (MCP) 是一项开放标准,为 AI 模型连接数据源和工具提供通用方式,减少定制集成的需求。