hustvl/Senna
Senna 是一个将大视觉语言模型与端到端模型结合的自动驾驶系统,旨在提升规划的安全性、鲁棒性和泛化能力。
JeffreyCA/spleeter-web
一个网络应用程序,使用 Spleeter 和 Demucs 等 AI 模型,从歌曲中分离或移除人声、贝斯和鼓声。
aws/bedrock-agentcore-starter-toolkit
一个基于 Python 的启动工具包,用于在 Amazon Bedrock AgentCore 上使用任何开源框架部署和运营可扩展、安全的 AI 代理。
PV-Bhat/vibe-check-mcp-server
一个使用 Chain-Pattern Interrupts 防止过度工程化和推理锁定的 AI 代理元导师 MCP 服务器
SaladTechnologies/comfyui-api
一个无状态的 API 包装器,可将复杂的生成式 AI 工作流(如 Stable Diffusion 或 Flux)作为可扩展、生产就绪的微服务进行部署。
PleasePrompto/ductor
一个无需使用 API 代理即可通过 Telegram、Matrix 和 Slack 控制官方 AI 代码 CLI(Claude Code、Gemini、Grok 等)的桥接工具。
i207M/PINNacle
一个针对物理信息神经网络(PINN)的全面基准,实现了多种变体和一个具有挑战性的数据集,用于评估其在求解偏微分方程方面的性能。
alibaba/TorchEasyRec
一个基于 PyTorch 的推荐系统框架,提供预先实现的最先进模型与可扩展基础设施,适用于生产环境的深度学习推荐。
groq/groq-desktop-beta
一个跨平台桌面应用程序,支持 Groq 模型的图像聊天界面和本地 MCP 服务器集成,用于函数调用。
kraiskil/onnx2c
一个将 ONNX 模型转换为独立 C 代码的编译器,可在微控制器上高效执行神经网络推理。
InditexTech/mcp-teams-server
一个将Microsoft Teams与LLM集成的MCP服务器,允许AI代理读取消息、创建线程和提及成员。
docker/labs-ai-tools-for-devs
一个用于创建代理型 AI 工作流的框架,其中 Docker 容器作为工具,Markdown 文件定义逻辑,使 LLM 能在沙箱环境中执行复杂任务。
LambdaTest/agent-skills
一个 Node.js 库,为 AI 编码助手(Claude Code、Copilot 等)提供插件式“技能”,用于生成 Selenium、Playwright、Cypress 等测试自动化代码,并在 TestMu AI 云平台上运行。
luxonis/depthai-core
用于与 Luxonis DepthAI 硬件接口以构建空间 AI 和计算机视觉应用的 C++ 和 Python 库。
alibaba/RecIS
一个用于超大规模推荐系统的统一深度学习框架,在 PyTorch 生态系统中优化稀疏和密集计算。
Lap-Platform/LAP
一个将冗长的 API 规范转换为压缩、代理原生格式的编译器和注册表,以减少 LLM 幻觉和 token 成本。
vinavfx/ComfyUI-for-Nuke
一个将 ComfyUI 节点集成到 Nuke 的 API,使 VFX 艺术家能够直接在其专业合成软件中使用生成式 AI 工作流。
plmbr/notebook-intelligence
Notebook Intelligence (NBI) 是一个开源 JupyterLab 扩展,增加了 AI 聊天、内联代码生成、自动补全和自主笔记本编辑智能体。它可与 Copilot、OpenAI 兼容 API、本地 Ollama 模型或 Anthropic Claude(通过 Claude Code)配合使用。功能包括 Claude 专用工具、基于 MCP 的工具调用、多语言感知以及 AI 编辑文件的实时重载。
sopaco/cortex-mem
基于 Rust 的 AI 代理长期记忆框架,采用三层分层架构和虚拟文件系统,实现持久化、上下文感知的交互。
lucidrains/pi-zero-pytorch
pi-zero 机器人基础模型的 PyTorch 实现,使用 flow matching 和预训练的 PaliGemma 2B 模型从视觉和语言生成机器人动作。
ICube-Robotics/ethercat_driver_ros2
一个使用 IgH EtherCAT Master 的 ROS 2 硬件接口,可实现 EtherCAT 模块与 ros2_control 框架之间的实时通信。
TimSchneider42/franky
用于 Franka 机器人的高级控制库,无需 ROS 即可通过 Python 和 C++ 实现实时轨迹和扭矩控制。
cocel-postech/genz-icp
GenZ-ICP 是一种对退化环境具有鲁棒性的 LiDAR 里程计系统,通过自适应加权机制确保在几何特征较少的环境中实现稳定定位。
Aivis-Project/AivisSpeech
一款使用 AivisSpeech Engine 与基于 ONNX 的模型来生成情感丰富的合成语音的日语文本转语音软件。
langchain-ai/mcpdoc
一个 MCP 服务器,通过 llms.txt 文件为 AI agent 提供透明且可审计的文档获取方式。
utkuozdemir/nvidia_gpu_exporter
一个使用 nvidia-smi 或 NVML 收集 NVIDIA GPU 指标的 Prometheus 导出器,支持 Linux、Windows 和 macOS。
Data-Centric-AI-Community/fg-data-synthetic
一个使用 GANs 和 Gaussian Mixtures 等生成式模型来生成合成表格和时间序列数据,以确保隐私并扩充数据集的包。
robotdoly/DOLY-DIY
一个完整的开源仓库,用于构建 DOLY 机器人,提供 3D 可打印硬件设计、电子原理图和 C++/Python SDK。
mystralengine/mystralnative
一个轻量级原生运行时,可使用 WebGPU 无浏览器地原生运行 JavaScript/TypeScript 游戏,为游戏开发提供无需 Electron 的替代方案。
SterlingChin/marvin-template
一个扩展 Claude Code 的 AI 首席幕僚,提供会话连续性、目标追踪以及与 Google Workspace 和 Slack 等生产力工具的集成。
ratwithacompiler/OBS-captions-plugin
一款利用 Google Cloud Speech Recognition API 为 Twitch 直播和 VOD 提供实时字幕的 OBS 插件。
olyaiy/resume-lm
ResumeLM 是一个开源 Web 应用,使用 LLM(OpenAI, Claude, Gemini 等)帮助用户编写、优化并导出对 ATS 友好的简历和求职信。它基于 Next.js 15, Supabase/PostgreSQL, 和 Stripe 构建,提供免费层级以及每月 20 美元的 Pro 计划以获取高级模型访问权限。
Pbatch/ClashRoyaleBuildABot
一个用于皇室冲突的自动化机器人,使用先进的状态生成器和目标检测,用于教育和研究目的。
georgeguimaraes/arcana
一个为 Elixir 和 Phoenix 设计的可嵌入式 RAG 库,可直接将向量搜索和知识图谱集成到现有的 Ecto 仓库中,无需单独的向量数据库
ailia-ai/ailia-models
包含419个跨视觉、音频和文本等不同领域的预训练AI模型,全部可通过统一CLI运行,并自动下载权重。
unbrowse-ai/unbrowse
AI 代理的行动层,通过学习并重放首方 API 路由,使网页任务执行速度远超传统浏览器自动化
clawplays/ospec
一个以规范驱动、代理式的工作流框架,可将需求、计划和验证证据直接持久化到项目仓库中。
promptise-com/Foundry
一个全栈式智能体工程框架,为构建、推理和部署具有集成工具和运行时的安全、多租户 AI 智能体提供统一系统。
syncable-dev/memtrace-public
一种为 AI 编码代理设计的结构化记忆系统,将代码库转化为本地、双时相的知识图谱,实现快速、低成本的架构查询。
JuliaDynamics/Agents.jl
一个高性能的 Julia 框架,用于基于代理的建模,能够模拟自主代理对环境及彼此的反应。
thiswillbeyourgithub/wdoc
一个强大的 RAG 系统,可总结和查询多种文档类型,包括 PDF、音频、视频和 Anki 卡片,提供有出处的答案和详细的摘要。
davidjurgens/potato
一个免费、可自托管的标注平台,适用于 NLP、AI 代理和定性研究,使用 YAML 配置进行多模态数据标注与代理评估。
kkokosa/dotLLM
使用 C#/.NET 原生编写的高性能 LLM 推理引擎,为 Transformer 模型提供原生的 CPU/GPU 支持,无需依赖 Python 或 llama.cpp。
leblancfg/autocrop
一个基于 Python 的工具,使用 YuNet 神经网络自动裁剪围绕最大检测到的脸部的图像,适合头像和身份证照片。
CVCUDA/CV-CUDA
CV‑CUDA 是 NVIDIA 的开源 GPU 加速计算机视觉库。它提供快速、可扩展的图像/视频算子(调整大小、滤镜、色彩转换等),这些算子完全在 GPU 上运行,并与 C/C++ 和 Python AI 框架集成。通过 Linux 的预构建 wheels (`cvcuda-cu12` 或 `cvcuda-cu13`) 进行安装,使用 `nvimgcodec` 将图像直接解码至 GPU,并在将数据馈送至深度学习模型之前串联 CV‑CUDA 算子。该库针对现代 NVIDIA GPU (Turing 及更新版本) 设计,并应用于 Microsoft Bing 视觉搜索和 Tencent Cloud 视频处理等生产系统中。
9tigerio/db2rest
一个低代码的 REST API 平台,能够自动为数据库创建安全端点,加速 AI 与数据驱动应用的开发。
giselles-ai/giselle
一个用于通过可视化构建器与 GitHub 整合来构建和运行代理型工作流的开源 AI agent studio。
xynehq/xyne
Xyne 是一个开源的 AI 首选搜索与问答引擎,可索引分散的 SaaS 数据,为工作提供集中化、上下文感知的搜索体验。