haosulab/SAPIEN

一个为机器人视觉和交互提供部件级理解的物理丰富模拟环境,包含大规模关节物体数据集。

Nomadcxx/opencode-cursor

连接 OpenCode 与 Cursor 订阅模型的桥梁,将 OpenCode 与 cursor-agent 之间的提示和工具调用进行翻译。

caiovicentino/polymarket-mcp-server

一个MCP服务器,使Claude等AI代理能够内置安全限制地自主分析和交易Polymarket预测市场。

knights-analytics/hugot

一个用于运行和微调 ONNX transformer 管道的 Go 库,可在 Golang 中原生实现与 Hugging Face 兼容的推理和训练。

cosai-oasis/project-codeguard

一个将安全默认实践嵌入 AI 代码代理的生成和审查流程中,以防止代码生成和审查期间引入漏洞的安全技能框架和规则集。

ahmetoner/whisper-asr-webservice

一个通用的语音识别工具包,将 Whisper 模型封装为 REST API,以便于部署和集成。

cclank/lanshu-awesome-ai-video-kit

一个包含 543 个经过测试的提示词、支持 15 种模型以及官方端点自动化监控的全面性 AI 视频提示词工程工具包。

OpenMOSS/MOVA

MOVA 是一个开源模型,可从文本提示(可选参考图像)生成同步的视频+音频。它采用双塔视频音频架构,提供 360p/720p 检查点、推理脚本、LoRA 微调流水线、评估代码,以及与 SGLang、ComfyUI 和托管 API 的集成。

OpenBMB/MiniCPM-Desk-Pet

由 MiniCPM 驱动的本地优先桌面伴侣,提供聊天界面和对编码代理活动的视觉反应。

xhluca/bm25s

一个超高速、基于 Numpy 的 Python 实现 BM25,用于高性能词汇搜索和文档检索。

gptme/gptme

一个在终端中运行的、与提供者无关的个人 AI 代理,为 LLM 提供 shell、Python 和网络访问,以协助编码和自主知识工作。

aa0101181514/tw-legal-rag

tw-legal-rag 是一个开源 Python CLI,连接到托管的语义搜索服务,该服务包含 2200 万+ 份台湾判例、法规和行政裁决。它支持自然语言搜索、获取精确案件编号、将结果(包括摘要、判例历史和引用白名单)打包为 JSON 文件,并对 LLM 生成的答案执行确定性引用核查。该工具本身不调用 LLM,无需 API 密钥,作为法律 AI 应用的检索增强生成(RAG)前端使用。

esphome/home-assistant-voice-pe

Home Assistant Voice: Preview Edition 的 ESPHome 源代码,提供语音控制智能家居硬件所需的固件。

lolishinshi/imsearch

一款使用特征点匹配,通过小裁剪截图在大规模数据集中查找完整图像的工具。

Everless321/dYm

一款结合无水印视频下载与 AI 驱动内容分析的桌面应用程序,可自动为抖音视频打标签并生成摘要。

designcomputer/mysql_mcp_server

一个 Model Context Protocol (MCP) 服务器,使 AI 应用程序能够通过结构化接口安全地探索和查询 MySQL 数据库。

datalayer/jupyter-mcp-server

Jupyter MCP Server 是一个开源桥接工具,让 AI 代理通过 Model Context Protocol 实时与 Jupyter 笔记本通信。它将笔记本文件、单元格和内核执行暴露为结构化工具,支持多种云沙箱后端,并使用 OAuth 2.1 实现安全的基于令牌的访问。

caliber-ai-org/ai-setup

一个自动创建和维护 AI 代理上下文文件的工具,可防止幻觉并确保 AI 编码助手与代码库变更保持同步。

NVlabs/GRAIL

一个从3D资产和视频先验合成4D人-物交互轨迹的数字化数据生成流程,用于训练人形机器人完成运动-操作任务。

mozilla-ai/cq

一种用于共享智能体学习的开放标准,允许 AI 智能体存储和检索结构化知识,以避免重复错误。

arcships/light-ocr

适用于 Node.js 和 C++ 的快速离线 OCR 库,支持本地图像和 PDF 的文本识别,并具备内置硬件加速功能。

AI-Hypercomputer/maxtext

一个用 JAX 和 Python 编写的高性能、可扩展的 LLM 库,用于在 Google Cloud TPUs 和 GPU 上进行大规模模型的预训练和训练后优化。

google/XNNPACK

XNNPACK 是一个高度优化的低层性能原语库,用于加速 ARM、x86、WebAssembly 和 RISC‑V 平台上的神经网络推理。

modelcontextprotocol/php-sdk

Model Context Protocol (MCP) 的官方 PHP SDK,使开发者能够构建 MCP 服务器和客户端,将 PHP 工具和资源暴露给 AI 模型。

callstackincubator/agent-skills

一系列专门的 React Native 知识包,可安装至 AI 编码助手,协助其优化、测试与迁移应用。

workos/auth.md

AI代理代表用户向服务进行身份认证的代理注册协议的参考实现,通过身份断言和主张仪式实现。

ucb-bar/chipyard

一个用于基于 Chisel 的 RISC-V 系统级芯片敏捷开发的开源框架,整合了处理器核心、加速器和 VLSI 工具。

LeslieLeung/glean

一款利用智能聚合与向量数据库帮助用户管理高负载阅读的自托管 RSS 阅读器和个人知识管理工具

luwill/research-skills

一套专为 Claude Code 设计的技能集合,旨在自动化学术研究工作流程,包括全面的文献检索、经过验证的提案撰写以及高保真幻灯片生成。

ards-project/ard-spec

一种联邦式、以域为锚点的规范,用于编目和发现跨网络的代理资源(如 MCP 服务器、技能和 API)。

huggingface/transformers.js

一个使用 ONNX Runtime 在浏览器中直接运行预训练机器学习模型的 JavaScript 库,无需服务器。

DeepLabCut/DeepLabCut

DeepLabCut 是一个无需标记的姿态估计工具箱,允许研究人员使用深度学习在视频中追踪动物和物体,而无需使用物理标记。

zsibot/matrix

结合 Unreal Engine 5 与 MuJoCo 的高保真机器人仿真平台,提供逼真的渲染、高频率物理和 ROS 2 兼容的数据流

elevenlabs/skills

一套即插即用的“agent skills”(智能体技能),用于公开 ElevenLabs 的语音、变声、配音和音乐生成 API。通过 `npx skills add elevenlabs/skills` 安装,配置 API key,之后任何兼容的 AI 编程助手都可以调用这些技能(例如文本转语音、语音转文本、实时语音聊天、变声、配音)。该仓库提供 Python、JS/TS 和 CLI SDK,并附带用于触发和功能验证的测试套件。采用 MIT 许可证。

hjanuschka/pi-multi-pass

pi 编码代理的多订阅扩展,支持多个 AI 提供商账户之间的自动速率限制轮换和故障转移。

kennyzir/7deer_skills

一个可组合且可审计的工作流程,用于 AI 代理通过七阶段基于证据的流水线来研究、规划和增长 Roblox 游戏网站。

martin-ger/esp32_nat_router

将 ESP32 转变为 WiFi NAT 路由器的固件,支持 WireGuard VPN、WPA2-Enterprise 和面向 AI 的 MCP 桥接网络控制。

enactic/openarm_hardware

一个开源硬件平台,提供机器人臂所需的 CAD 文件、BOM 和组装指南。

lucasygu/redbook

一款基于浏览器 Cookie 认证的小红书命令行工具,支持关键词研究、病毒内容分析和自动化互动管理。

aikohanasaki/SillyTavern-MemoryBooks

一个SillyTavern扩展,将聊天记录转换为结构化的传说书条目,以保留长期记忆和叙事连续性。

ricky0123/vad

一个 JavaScript 库,用于语音活动检测,允许开发者在包含用户语音的音频片段上运行回调。

Chestnut-Robotics/aero-hand-open

一款开源、3D打印的腱驱动机器人手,专为低成本的精细操作学习与强化学习研究而设计。

PrismML-Eng/Bonsai-Image-Demo

一个跨平台演示,适用于 4 B 参数的 Bonsai 扩散模型,提供基于 Web 的工作室和 CLI,可在 macOS(MLX)或 NVIDIA GPU(gemlite + HQQ)上进行图像生成。

kyutai-labs/hibiki

Hibiki 是一个用于流式语音到语音翻译的模型,可在用户说话时实时生成自然的目标语音和文本。

jtydhr88/ComfyUI-qwenmultiangle

一个 ComfyUI 自定义节点,提供交互式 3D 视口,用于控制相机角度并生成与 Qwen-Image-Edit-2511-Multiple-Angles-LoRA 兼容的提示。

neo4j-contrib/mcp-neo4j

一组 Model Context Protocol (MCP) 服务器,使 LLM 能够查询 Neo4j 数据库、管理 Aura 云实例,并维持持久的知识图谱记忆。

monarch-initiative/ontogpt

一个使用 LLM 从文本中提取结构化、本体基础信息的 Python 包,通过将标识符与现实世界本体进行验证,防止幻觉。

oomol-lab/epub-translator

一款AI驱动的工具,可将EPUB书籍转换为双语版本,同时保留原始格式和结构,并提供并排翻译。