burugo/one-mcp

一个集中式的代理和管理平台,用于 Model Context Protocol (MCP) 服务,允许用户通过单一界面发现、安装和监控服务。

secondsky/sap-skills

一套 40 个专用于 AI 编码助手的插件,为 BTP、ABAP 和 Fiori 上的 SAP 开发提供可追溯证据的指导与工具。

vgvassilev/clad

一个用于 C++ 的 Clang 编译器插件,通过转换源代码来自动生成导数、梯度和 Hessian 矩阵的函数。

ReactiveBayes/RxInfer.jl

RxInfer.jl 是一个 Julia 库,使用因子图消息传递实现快速、反应式贝叶斯推断。它能自动利用共轭关系实现精确更新,支持非共轭模型,并可通过 RxInferServer 部署为 REST API。使用 `] add RxInfer` 安装,用 `@model` 宏定义模型,调用 `infer` 获取后验分布。

kesai-labs/py123d

py123d 是一个 Python 库,通过将 Argoverse 2、nuScenes、Waymo、nuPlan 等多个自动驾驶数据集统一转换为快速、零拷贝的 Apache Arrow 格式,并提供摄像头、激光雷达、地图和标签的单一 API。它包含用于下载和转换数据的 CLI 工具、基于 Hydra 的管道以及交互式 3D 查看器。通过 `pip install py123d`(可选依赖项支持各数据集)安装,并使用提供的命令获取、转换和可视化数据。

ZantFoundation/Z-Ant

一个将 ONNX 模型转换为资源受限微控制器用确定性静态库的推理引擎和编译器框架。

EveryInc/compound-knowledge-plugin

一个为 Claude Code 实现的插件,通过结构化知识工作循环,将项目学习成果持续捕获、存储并复用到持久的知识库中。

RealZST/HarnessKit

一个统一管理 AI 编码代理的工具,集中管理多个代理的配置、扩展和安全审计。

rsmdt/the-startup

一个为 Claude Code 设计的多代理 AI 框架,通过结构化规划和并行专业代理,实现以规范驱动的开发工作流,将想法转化为可交付的代码。

zy-zmc/tianming-novel-ai-writer

一种AI驱动的小说写作系统,通过将故事元素作为结构化数据和状态快照进行管理,而非依赖LLM上下文窗口,确保长期叙事的一致性。

bybren-llc/safe-agentic-workflow

一个经过生产环境测试的 AI Agent 框架,通过实现 SAFe 方法论来协调跨 Claude 和 Gemini 等多种 AI 提供商的多智能体团队。

facebookresearch/mae_st

一种用于时空学习的 PyTorch 实现的掩码自编码器,使模型能够通过重建被掩码的视频帧来学习视频表示。

dorjeduck/llm.mojo

将 Andrej Karpathy 的 llm.c 移植到 Mojo 语言,展示了 Mojo 在低级别 LLM 训练中可达到与 C 语言相当的性能。

stardomains3/oxproxion

一款 Android 聊天应用,通过 OpenRouter 与云托管 LLM 交互,同时通过 Ollama、LM Studio 等本地部署模型实现统一界面操作。

NEKOparapa/ReaDreamAI

一个自动化小说创作的 AI 平台,包括文本生成、一致的角色插图和视频改编。

tenstorrent/tt-forge

一个为 Tenstorrent 硬件设计的开源 AI 编译器栈,支持从 PyTorch、JAX 和 ONNX 执行和训练模型。

wjq-learning/CBraMod

一种通过预训练和微调流程设计用于临床和脑机接口(BCI)应用的 EEG 解码基础模型。

mozilla/translations

为 Firefox 浏览器中本地客户端侧网页翻译提供支持的机器翻译模型训练管道和推理引擎。

Azornes/Comfyui-LayerForge

ComfyUI 的分层画布编辑器节点,支持在浏览器中进行图像合成、多边形修复选择和背景移除。

xiaobiaodu/Mobile-GS

Mobile-GS 是一个专为在移动设备上实现高质量 3D 场景渲染而设计的实时高斯点阵框架。

vespaai-playground/NyRAG

一个用于构建 RAG 应用的工具,通过爬取网站或处理文档并部署到 Vespa,实现混合搜索,并提供集成的聊天 UI。

google-deepmind/kfac-jax

一个基于 JAX 的库,使用 K-FAC 优化器和可扩展的曲率近似来实现神经网络的二阶优化。

Stability-AI/stable-audio-metrics

音乐和音频生成模型的评估指标集合,提供对长时立体声音频计算弗雷chet距离、KL散度和CLAP分数的工具。

mixa3607/ML-gfx906

一组 Ubuntu 软件包和 Docker 镜像,将当前的 ROCm、PyTorch、llama.cpp、ComfyUI 及相关 GPU 调优工具带入旧版 AMD GFX906(Vega 20/MI50)GPU。

haoyi-duan/WorldScore

WorldScore 是一个开源基准,用于评估 3D、4D、视频的世界生成模型。它提供数据集、生成适配器、一系列空间-时间度量和公开排行榜。用户通过一个小型 YAML 配置和一个 Python 类注册模型,生成视频,运行评估脚本,并提交生成的 JSON 分数。

sveltejs/ai-tools

官方 Svelte MCP 服务器,可让 AI 模型通过 Model Context Protocol 使用 Svelte 相关数据与工具。

CodeSoul-co/Hypha

一个 TypeScript 框架,用于构建受控、持久的 AI 代理,通过 Production Harness 和 DomainPacks 将推理与执行分离。

UditAkhourii/neuroarxiv

一个从 arXiv 获取论文并使用‘隔离-收敛’流程,提供单一、有依据的架构推荐而非搜索结果列表的研究到决策工具。

Entrpi/ds4-on-spark

面向NVIDIA DGX Spark的高性能服务栈,支持DeepSeek-V4-Flash,具备连续批处理、推测解码和大上下文窗口内存管理功能。

modelstudioai/cli

Aliyun Model Studio CLI (bailian‑cli) 是 Alibaba Cloud AI 平台的终端工具,提供用于多模态生成(文本、图像、视频、语音)、资产理解、托管代理编排、数据集验证、微调、部署和账户管理的命令。可通过 npm 或单行脚本安装,使用 API 密钥或 OAuth 认证后,执行 `bl …` 命令,或让 AI 代理将自然语言提示翻译为 CLI 调用。

messkan/prompt-cache

一个轻量级、自托管的 GenAI 工作负载语义缓存,通过为相似的提示词提供缓存响应,来降低 LLM 成本和延迟。

MahmoudAshraf97/ctc-forced-aligner

一个使用 Hugging Face CTC 模型实现高效音频与文本强制对齐的 Python 包,支持超过 1,100 种语言。

dbccccccc/ttsfm

一个使用 openai.fm 后端将文本转换为自然语音的 OpenAI 兼容文本转语音 (TTS) API 服务和 Python SDK。

ttktjmt/mjswan

一个用于在浏览器中以静态网站形式完全运行、由 AI 策略控制的实时交互式 MuJoCo 模拟的框架。

visose/Robots

用于 Rhino 8 和 Grasshopper 的插件,允许用户为各种工业机器人创建、模拟并生成特定制造商的代码。

OpenLegged/URDF-Studio

URDF Studio 是一个基于浏览器的机器人创作工作站,支持编辑 URDF/MJCF/USD 模型,组装多个机器人,导出多种格式,并使用 AI 助手进行生成与检查。基于 React、Three.js、TypeScript 和 Zustand 构建,还提供可复用的 `@urdf-studio/react-robot-canvas` 组件。采用 Apache-2.0 许可证。

KavrakiLab/vamp

一个利用 CPU SIMD 指令在微秒级完成碰撞检测和正向运动学计算的硬件加速运动规划库。

livekit/rust-sdks

LiveKit 的 Rust 客户端 SDK,支持跨桌面与移动端的实时视频/音频/数据流串流、房间管理以及硬件加速编码。

real-stanford/umi-on-legs

一个将人类演示与模拟训练的全身控制器结合的框架,旨在为配备手臂的四足机器人实现移动操作技能。

Simple-Robotics/proxsuite

专为高性能机器人学和优化任务设计的、数值上稳健且高效的线性与二次规划问题数值求解器集合。

Stable-Baselines-Team/stable-baselines3-contrib

一个为 Stable-Baselines3 提供的贡献包,包含实验性强化学习算法和研究人员与开发者所需的特殊工具。

rsasaki0109/lidar_slam_ros2

一个将传感器数据包转换为 Autoware 兼容地图包(包含点云和自动生成的 lanelet2 文件)的 ROS 2 LiDAR SLAM 系统。

zai-org/GLM-V

一系列增强多模态推理能力的视觉语言模型(VLM),支持原生函数调用、视觉定位和复杂文档理解。

misyaguziya/VRCT

VRCT 是一款翻译与转录工具,旨在通过实时音频转文字与聊天集成,帮助 VRChat 用户进行跨语言沟通。

wenet-e2e/wenet

一个面向生产环境的端到端语音识别工具包,提供流式和非流式语音转文本的全栈解决方案。

lukaszliniewicz/Pandrator

通过协调本地和基于云端的语音及语言模型,创建有声书、字幕和配音的统一工作空间。

ssitu/ComfyUI_UltimateSDUpscale

一组 ComfyUI 节点,通过分块(tiled)方法对大图进行图生图扩散,以提升细节并降低硬件需求。

KohakuBlueleaf/LyCORIS

一个实现 LoHa 和 LoKr 等多种参数高效微调算法的库,使 Stable Diffusion 模型在极小存储和计算开销下实现高质量定制。