hustvl/Senna

Senna 是一个将大视觉语言模型与端到端模型结合的自动驾驶系统,旨在提升规划的安全性、鲁棒性和泛化能力。

JeffreyCA/spleeter-web

一个网络应用程序,使用 Spleeter 和 Demucs 等 AI 模型,从歌曲中分离或移除人声、贝斯和鼓声。

aws/bedrock-agentcore-starter-toolkit

一个基于 Python 的启动工具包,用于在 Amazon Bedrock AgentCore 上使用任何开源框架部署和运营可扩展、安全的 AI 代理。

PV-Bhat/vibe-check-mcp-server

一个使用 Chain-Pattern Interrupts 防止过度工程化和推理锁定的 AI 代理元导师 MCP 服务器

SaladTechnologies/comfyui-api

一个无状态的 API 包装器,可将复杂的生成式 AI 工作流(如 Stable Diffusion 或 Flux)作为可扩展、生产就绪的微服务进行部署。

PleasePrompto/ductor

一个无需使用 API 代理即可通过 Telegram、Matrix 和 Slack 控制官方 AI 代码 CLI(Claude Code、Gemini、Grok 等)的桥接工具。

i207M/PINNacle

一个针对物理信息神经网络(PINN)的全面基准,实现了多种变体和一个具有挑战性的数据集,用于评估其在求解偏微分方程方面的性能。

alibaba/TorchEasyRec

一个基于 PyTorch 的推荐系统框架,提供预先实现的最先进模型与可扩展基础设施,适用于生产环境的深度学习推荐。

groq/groq-desktop-beta

一个跨平台桌面应用程序,支持 Groq 模型的图像聊天界面和本地 MCP 服务器集成,用于函数调用。

kraiskil/onnx2c

一个将 ONNX 模型转换为独立 C 代码的编译器,可在微控制器上高效执行神经网络推理。

InditexTech/mcp-teams-server

一个将Microsoft Teams与LLM集成的MCP服务器,允许AI代理读取消息、创建线程和提及成员。

docker/labs-ai-tools-for-devs

一个用于创建代理型 AI 工作流的框架,其中 Docker 容器作为工具,Markdown 文件定义逻辑,使 LLM 能在沙箱环境中执行复杂任务。

LambdaTest/agent-skills

一个 Node.js 库,为 AI 编码助手(Claude Code、Copilot 等)提供插件式“技能”,用于生成 Selenium、Playwright、Cypress 等测试自动化代码,并在 TestMu AI 云平台上运行。

luxonis/depthai-core

用于与 Luxonis DepthAI 硬件接口以构建空间 AI 和计算机视觉应用的 C++ 和 Python 库。

alibaba/RecIS

一个用于超大规模推荐系统的统一深度学习框架,在 PyTorch 生态系统中优化稀疏和密集计算。

Lap-Platform/LAP

一个将冗长的 API 规范转换为压缩、代理原生格式的编译器和注册表,以减少 LLM 幻觉和 token 成本。

vinavfx/ComfyUI-for-Nuke

一个将 ComfyUI 节点集成到 Nuke 的 API,使 VFX 艺术家能够直接在其专业合成软件中使用生成式 AI 工作流。

plmbr/notebook-intelligence

Notebook Intelligence (NBI) 是一个开源 JupyterLab 扩展,增加了 AI 聊天、内联代码生成、自动补全和自主笔记本编辑智能体。它可与 Copilot、OpenAI 兼容 API、本地 Ollama 模型或 Anthropic Claude(通过 Claude Code)配合使用。功能包括 Claude 专用工具、基于 MCP 的工具调用、多语言感知以及 AI 编辑文件的实时重载。

sopaco/cortex-mem

基于 Rust 的 AI 代理长期记忆框架,采用三层分层架构和虚拟文件系统,实现持久化、上下文感知的交互。

lucidrains/pi-zero-pytorch

pi-zero 机器人基础模型的 PyTorch 实现,使用 flow matching 和预训练的 PaliGemma 2B 模型从视觉和语言生成机器人动作。

ICube-Robotics/ethercat_driver_ros2

一个使用 IgH EtherCAT Master 的 ROS 2 硬件接口,可实现 EtherCAT 模块与 ros2_control 框架之间的实时通信。

TimSchneider42/franky

用于 Franka 机器人的高级控制库,无需 ROS 即可通过 Python 和 C++ 实现实时轨迹和扭矩控制。

cocel-postech/genz-icp

GenZ-ICP 是一种对退化环境具有鲁棒性的 LiDAR 里程计系统,通过自适应加权机制确保在几何特征较少的环境中实现稳定定位。

Aivis-Project/AivisSpeech

一款使用 AivisSpeech Engine 与基于 ONNX 的模型来生成情感丰富的合成语音的日语文本转语音软件。

langchain-ai/mcpdoc

一个 MCP 服务器,通过 llms.txt 文件为 AI agent 提供透明且可审计的文档获取方式。

utkuozdemir/nvidia_gpu_exporter

一个使用 nvidia-smi 或 NVML 收集 NVIDIA GPU 指标的 Prometheus 导出器,支持 Linux、Windows 和 macOS。

Data-Centric-AI-Community/fg-data-synthetic

一个使用 GANs 和 Gaussian Mixtures 等生成式模型来生成合成表格和时间序列数据,以确保隐私并扩充数据集的包。

robotdoly/DOLY-DIY

一个完整的开源仓库,用于构建 DOLY 机器人,提供 3D 可打印硬件设计、电子原理图和 C++/Python SDK。

mystralengine/mystralnative

一个轻量级原生运行时,可使用 WebGPU 无浏览器地原生运行 JavaScript/TypeScript 游戏,为游戏开发提供无需 Electron 的替代方案。

SterlingChin/marvin-template

一个扩展 Claude Code 的 AI 首席幕僚,提供会话连续性、目标追踪以及与 Google Workspace 和 Slack 等生产力工具的集成。

ratwithacompiler/OBS-captions-plugin

一款利用 Google Cloud Speech Recognition API 为 Twitch 直播和 VOD 提供实时字幕的 OBS 插件。

olyaiy/resume-lm

ResumeLM 是一个开源 Web 应用,使用 LLM(OpenAI, Claude, Gemini 等)帮助用户编写、优化并导出对 ATS 友好的简历和求职信。它基于 Next.js 15, Supabase/PostgreSQL, 和 Stripe 构建,提供免费层级以及每月 20 美元的 Pro 计划以获取高级模型访问权限。

Pbatch/ClashRoyaleBuildABot

一个用于皇室冲突的自动化机器人,使用先进的状态生成器和目标检测,用于教育和研究目的。

georgeguimaraes/arcana

一个为 Elixir 和 Phoenix 设计的可嵌入式 RAG 库,可直接将向量搜索和知识图谱集成到现有的 Ecto 仓库中,无需单独的向量数据库

ailia-ai/ailia-models

包含419个跨视觉、音频和文本等不同领域的预训练AI模型,全部可通过统一CLI运行,并自动下载权重。

unbrowse-ai/unbrowse

AI 代理的行动层,通过学习并重放首方 API 路由,使网页任务执行速度远超传统浏览器自动化

clawplays/ospec

一个以规范驱动、代理式的工作流框架,可将需求、计划和验证证据直接持久化到项目仓库中。

promptise-com/Foundry

一个全栈式智能体工程框架,为构建、推理和部署具有集成工具和运行时的安全、多租户 AI 智能体提供统一系统。

syncable-dev/memtrace-public

一种为 AI 编码代理设计的结构化记忆系统,将代码库转化为本地、双时相的知识图谱,实现快速、低成本的架构查询。

JuliaDynamics/Agents.jl

一个高性能的 Julia 框架,用于基于代理的建模,能够模拟自主代理对环境及彼此的反应。

thiswillbeyourgithub/wdoc

一个强大的 RAG 系统,可总结和查询多种文档类型,包括 PDF、音频、视频和 Anki 卡片,提供有出处的答案和详细的摘要。

davidjurgens/potato

一个免费、可自托管的标注平台,适用于 NLP、AI 代理和定性研究,使用 YAML 配置进行多模态数据标注与代理评估。

kkokosa/dotLLM

使用 C#/.NET 原生编写的高性能 LLM 推理引擎,为 Transformer 模型提供原生的 CPU/GPU 支持,无需依赖 Python 或 llama.cpp。

leblancfg/autocrop

一个基于 Python 的工具,使用 YuNet 神经网络自动裁剪围绕最大检测到的脸部的图像,适合头像和身份证照片。

CVCUDA/CV-CUDA

CV‑CUDA 是 NVIDIA 的开源 GPU 加速计算机视觉库。它提供快速、可扩展的图像/视频算子(调整大小、滤镜、色彩转换等),这些算子完全在 GPU 上运行,并与 C/C++ 和 Python AI 框架集成。通过 Linux 的预构建 wheels (`cvcuda-cu12` 或 `cvcuda-cu13`) 进行安装,使用 `nvimgcodec` 将图像直接解码至 GPU,并在将数据馈送至深度学习模型之前串联 CV‑CUDA 算子。该库针对现代 NVIDIA GPU (Turing 及更新版本) 设计,并应用于 Microsoft Bing 视觉搜索和 Tencent Cloud 视频处理等生产系统中。

9tigerio/db2rest

一个低代码的 REST API 平台,能够自动为数据库创建安全端点,加速 AI 与数据驱动应用的开发。

giselles-ai/giselle

一个用于通过可视化构建器与 GitHub 整合来构建和运行代理型工作流的开源 AI agent studio。

xynehq/xyne

Xyne 是一个开源的 AI 首选搜索与问答引擎,可索引分散的 SaaS 数据,为工作提供集中化、上下文感知的搜索体验。