aws/mcp-proxy-for-aws

一个使 AI 应用和代理能够连接到 AWS 托管的 MCP 服务器的桥梁,可自动处理 AWS IAM(SigV4)认证。

IBM/LNN

LNN 是一个 Python 库,用于神经符号人工智能,将逻辑公式表示为加权神经网络,即使在知识不一致或不完整的情况下,也能实现可解释、可微分的推理与学习。

llt22/talkio

一个本地优先、支持多模型的 AI 聊天客户端,支持自定义角色和 MCP 工具,实现不同 AI 模型之间的群组对话。

Lamatic/AgentKit

AgentKit 是一个开源 SDK,提供 70 个现成的“套件”(完整应用、流水线或模板),用于构建、测试和部署 AI 代理。套件由一个简单的配置文件定义,可在可视化流程工作室中编辑,并以无服务器运行的 Next.js 应用形式交付。该集合涵盖支持分诊、代码审查、RAG 聊天、招聘助手、法律/医疗机器人等众多业务导向的代理,是一个开箱即用的平台,可快速构建可靠、企业级的 AI 代理。

Ammaar-Alam/minebench

MineBench 是一个基于网页的基准测试工具,通过让 LLM 对如“一座中世纪城堡”等提示输出体素坐标,来评估其三维空间推理能力。它可视化生成结果,支持人类进行头对头对比,并使用 Bradley-Terry 系统对模型进行排名。平台包含用于成对投票的 Arena、用于自定义构建的 Sandbox、社区提示的 Gallery,以及 GLB、STL、.vox、.schem 等格式的导出功能。支持主流 LLM 提供商,可通过 Node.js、pnpm 和 Docker 在本地运行。

redis/agent-memory-server

一个为 AI 代理提供的受管记忆层,通过两层式会话与长期记忆模型,在跨会话中提供事实与偏好的持久存储。

ammaarreshi/RedAlert2-Mac-iOS-iPad

专为 iOS 和 iPadOS 打造的 Command & Conquer: Red Alert 2 及 Yuri's Revenge 原生体验移植版,具有自定义 RTS 触摸控制和重构的遭遇战 AI。

freestylefly/wesight-obsidian

一个将本地 AI 代理(Claude Code、Codex、OpenCode)与多平台内容发布工作台集成的 Obsidian 插件,支持社交媒体和专业文档发布。

Entrpi/ds4-on-spark

面向NVIDIA DGX Spark的高性能服务栈,支持DeepSeek-V4-Flash,具备连续批处理、推测解码和大上下文窗口内存管理功能。

cvs-health/uqlm

一个用于检测 LLM 幻觉的 Python 库,它使用各种不确定性量化技术为模型输出分配置信度分数。

agentscope-ai/Trinity-RFT

一个通用的 LLM 强化微调框架,通过解耦探索、训练和数据缓冲,支持多种 RL 算法和智能体工作流。

vvvvvjdy/D-OPSD

D-OPSD 是一种在线策略自我蒸馏框架,允许步进式蒸馏扩散模型在保持快速推理能力的同时,持续地针对新风格和概念进行微调。

modelstudioai/cli

Aliyun Model Studio CLI (bailian‑cli) 是 Alibaba Cloud AI 平台的终端工具,提供用于多模态生成(文本、图像、视频、语音)、资产理解、托管代理编排、数据集验证、微调、部署和账户管理的命令。可通过 npm 或单行脚本安装,使用 API 密钥或 OAuth 认证后,执行 `bl …` 命令,或让 AI 代理将自然语言提示翻译为 CLI 调用。

physiclaw/PhysiClaw

PhysiClaw 是一个 AI 代理,通过机器人臂和摄像头物理操作智能手机,无需 API 或软件安装,即可在任何应用中自动化任务。

mit-acl/mighty

MIGHTY 是一个 ROS 2 库,利用 Hermite spline 为无人机 (UAV)、多无人机集群和地面机器人规划快速、平滑的轨迹。它可以在仿真(Gazebo, RViz)或真实硬件上运行,提供 Docker、原生 Ubuntu 和 Jetson 安装选项,并在 IEEE RA-L 论文中有所描述。

aerostack2/aerostack2

一个专注于模块化和集群能力的 ROS 2 框架,用于构建自主式多空中机器人系统。

visose/Robots

用于 Rhino 8 和 Grasshopper 的插件,允许用户为各种工业机器人创建、模拟并生成特定制造商的代码。

vmayoral/robot_hacking_manual

机器人网络安全综合入门系列及手册,通过案例研究和教程来突出漏洞并推广“安全第一”的机器人开发理念。

OpenLegged/URDF-Studio

URDF Studio 是一个基于浏览器的机器人创作工作站,支持编辑 URDF/MJCF/USD 模型,组装多个机器人,导出多种格式,并使用 AI 助手进行生成与检查。基于 React、Three.js、TypeScript 和 Zustand 构建,还提供可复用的 `@urdf-studio/react-robot-canvas` 组件。采用 Apache-2.0 许可证。

gazebosim/ros_gz

一套用于桥接 ROS 与 Gazebo 模拟器的集成包,可实现机器人模拟中的双向通信与传感器数据传输。

real-stanford/umi-on-legs

一个将人类演示与模拟训练的全身控制器结合的框架,旨在为配备手臂的四足机器人实现移动操作技能。

nasa/ogma

用于将安全的运行时监视器集成到 NASA Core Flight System 和 ROS 等系统中的工具,可自动生成实时 C99 胶水代码。

Teddy-Liao/walk-these-ways-go2

Unitree Go2 四足机器人的 Sim-to-Real 运动控制入门套件,将 walk-these-ways 框架适配到 unitree_sdk2 架构。

NVIDIA-ISAAC-ROS/isaac_ros_nvblox

nvblox 的 ROS 2 集成,实现基于视觉的障碍物避让所需的实时 3D 场景重建和 2D 成本地图生成。

abizovnuralem/go2_omniverse

一个在 Nvidia Isaac Sim 中为 Unitree Go2 和 G1 机器人构建的高保真数字孪生项目,实现物理机器人与其虚拟副本之间的实时同步。

SJTU-ViSYS/M2DGR

M2DGR 是一个用于地面机器人、具备丰富传感器数据与挑战性的真实世界场景的大规模、多模态 SLAM 数据集,用于基准测试导航算法。

RoboVerseOrg/RoboVerse

一个用于可扩展机器人学习的统一平台与基准,将多个仿真框架和数据集整合到单一界面中。

NetManAIOps/ChatTS

ChatTS 是一种专为多变量时间序列设计的多模态 LLM,能够原生理解并推理时间序列数据,使用户可以对数值数据进行对话式问答。

FrigadeHQ/yap

一款轻量级、在设备上运行的 macOS 语音输入工具,利用 Apple 原生语音 API 将转录文本私密地粘贴到任何活跃应用中。

jamsch/expo-speech-recognition

一个为 React Native 和 Expo 提供跨平台语音转文本功能统一 API 的库,支持 iOS、Android 和 Web。

octimot/StoryToolkitAI

一款 AI 驱动的电影剪辑助手,可对视频素材进行转录、索引和搜索,允许剪辑师使用 LLM 自动创建用于导出到剪辑软件的故事片段。

cmusphinx/pocketsphinx

PocketSphinx 是一个开源、离线的语音转文本引擎(C 库,带 Python 绑定),可在低资源设备上高效运行。它提供命令行工具和 API,用于识别或对齐音频,并将结果输出为 JSON 格式。

sanjay3290/ai-skills

为 AI 编程助手提供的便携式、标准化技能集合,使其能够与数据库、生产力工具和云基础设施进行交互。

basetenlabs/truss

用于将 AI/ML 模型打包并部署到生产环境的 CLI 工具,自动化容器化、GPU 配置和依赖管理。

xxxily/hello-ai

一个由 AI 驱动的导航中心,利用自主代理从 GitHub 发现、评估并组织高质量的开源 AI 项目,形成一个自动更新的目录。

YanWenKun/ComfyUI-Docker

为 NVIDIA、AMD、Intel 和 CPU 环境提供预配置的 Docker 镜像,简化基于节点的 AIGC GUI 工具 ComfyUI 的部署。

lynote-ai/ai-image-detector

AI Image Detector 是一个开源的 Python 工具,用于估计图像是由 AI 生成的可能性。它自带多个即用的后端(UnivFD、Sentry、Nonescape、混合集成),只需运行单条指令 (`aidetect detect …`) 对文件或文件夹进行检测,即可输出概率和标签。可选的 extras 提供 Gradio Web UI 或 FastAPI 服务器。仓库中还包含基准测试脚本、阈值校准以及选择后端的明确指南。它是一个轻量、一次安装、随处可运行的 AI 图像检测实用工具,并有文档说明其局限性(无全局保证、无区域级定位)。

OpenEnvision/WorldFoundry

一个开源基础设施,为视频生成、3D/4D 表示和具身 AI 提供统一的推理、资产阶段化和基准评估堆栈。

devswha/patina

一种在四种语言中运行的决定论、基于模式的人类化工具,将AI式文本重写为自然语言,同时严格保留事实意义。

shinpr/claude-code-workflows

Claude Code Development Workflows 是一组 Claude Code 插件,将 Claude AI 助手转变为结构化的开发流程。插件提供“配方”(如 `/recipe‑implement`、`/recipe‑design`、`/recipe‑review`),强制执行结果共识、设计文档、工作计划生成、任务级实现与自动验证,以及独立安全审查。三个插件家族分别覆盖后端、React 前端和全栈项目,可通过 Claude 市场安装。当需要可重复的安全门和设计到代码生成的正式交接时非常有用;对于快速原型可跳过。

NVlabs/physical_ai_av

用于访问和处理 NVIDIA Physical AI Autonomous Vehicles Dataset 以构建端到端驾驶系统的 Python 开发工具包。

NVlabs/alpamayo

Alpamayo 1 是一种用于自动驾驶的视觉-语言-动作模型,通过结合推理轨迹与轨迹预测,以应对复杂且罕见的驾驶场景。

ultralytics/yolo-flutter-app

一个官方的 Ultralytics 插件,用于在 iOS 和 Android 上实现对象检测、分割和姿态估计的实时 YOLO 模型推理。

AltimateAI/altimate-code

一个开源的数据工程框架,为LLM提供确定性工具,实现跨主要云平台的SQL分析、列级血缘追踪和仓库连接。

Ikalus1988/MisakaNet

一个基于 Git 的失败记忆系统,允许 AI 代理搜索并重用经过验证的恢复教学记录,避免重复已知的调试错误。

AmberSahdev/Open-Interface

一款使用 LLM 通过视觉反馈模拟键盘和鼠标输入,自主驱动 PC 的 AI 驱动计算机自动化工具。

artivis/manif

一个用于机器人状态估计的 Lie 理论库,提供 C++ 和 Python 工具来处理各种 Lie 群的旋转、平移和速度。

IBM/mcp

一组 Model Context Protocol (MCP) 服务器和工具,使 AI 代理能够安全地与 IBM 产品和企业资源进行交互。