mirage-project/mirage

通过将多 GPU 推理融合为一个高性能巨核,降低 LLM 推理延迟的编译器和运行时系统。

StartupHakk/OpenMonoAgent.ai

一个本地优先、开源的编码代理,使用 .NET 和 llama.cpp 在您的硬件上完全运行,提供私密、零成本的 AI 开发。

ButzYung/SystemAnimatorOnline

一个使用单个网络摄像头实时驱动 3D 角色用于 VTuber 和 XR 应用的 AI 动作捕捉应用程序。

hijohnnylin/neuronpedia

一个用于探索和分析稀疏自编码器(SAE)及其他模型激活特征的开源可解释性平台,提供自动化解释、方向控制和电路可视化工具。

espressif/esp-dl

一个为 Espressif ESP 系列芯片设计的轻量级神经网络推理框架,通过优化的量化与内存管理,实现高效的设备端 AI 部署。

adolfousier/opencrabs

OpenCrabs 是一个 Rust 原生的、仅限终端的 AI 智能体,它直接与多个 LLM 提供商通信,将所有聊天、内存和密钥存储在本地,并提供一个功能丰富的 TUI,支持多模态输入、工具集成、多智能体编排以及实验性的自我改进循环。

Storybloq/storybloq

一个面向AI编码代理的项目记忆和工作流系统,将故事、计划和交接持久化在Git跟踪的文件中,以在会话之间维护上下文。

yangfeng20/ai-job

一个利用 LLM 作为候选人数字分身,自动在 Boss Zhipin 上完成简历提交与人事沟通的 AI 驱动求职助手。

WEIFENG2333/phistory

一个工具,用于追踪并归档来自流行代码代理 CLI 的系统提示,以实现对代理设计变更的逐版本对比。

ankimcp/anki-mcp-server

一个 MCP server,让 AI 助手可以与 Anki 互动,使用自然语言来学习、创建与管理闪卡。

pantor/ruckig

一个实时轨迹生成库,为机器人和机器生成时间最优、加加速度受限的运动,可即时响应传感器输入。

gazebosim/gz-sim

一个开源机器人仿真器,为机器人系统的测试和开发提供高保真物理、渲染和传感器模型。

stack-of-tasks/pinocchio

Pinocchio 是一个用于刚体动力学的高性能 C++ 库(附带 Python 绑定),提供解析导数、接触求解器、闭环处理和 AD 支持。它为许多机器人技术和模拟工具提供动力,并可以通过 Conda 或 pip 安装。

PAICNI/CFBox

一个运行在 Cloudflare Workers 和 Pages 上的代理订阅管理器,提供图形化面板来管理 VLESS、Trojan 和 xhttp 节点,并支持优化的 IP 选择。

nv-tlabs/vipe

一款从原始视频(包括广角和 360 度全景视频)中估计相机姿态、内参和密集深度图的空间 AI 工具。

learnwithu/mingli-master

一款基于Python规则引擎实现精准星图计算、结合LLM进行类人解读与可视化的AI驱动紫微斗数占星工具。

BoPeng/ai-marketplace-monitor

一款 AI 驱动的 Facebook Marketplace 监控工具,可追踪特定商品,并利用 LLM 分析列表内容以发现最佳交易。

SteveMacenski/slam_toolbox

一个基于 ROS 2 的 2D SLAM 库,通过姿态图优化使移动机器人能够在动态环境中构建和优化地图。

lackeyjb/playwright-skill

一种为编程代理设计的浏览器自动化技能,使其能够编写并执行自定义 Playwright 脚本,用于测试和复杂的 Web 流程。

preset-io/agor

一个自托管的、多人协作的 Web 工作区,用于在隔离的 Git 分支上运行代码代理,配备专用开发环境和成本追踪功能。

liveblocks/liveblocks

一个协作基础设施,提供构建模块和 SDK,使人类和 AI 能在应用中实现实时同步、评论和通知。

Nutlope/aicommits

一个使用 AI 分析暂存 git 变更并自动以多种格式生成描述性提交消息的 CLI 工具。

google/flax

Flax 是由 Google DeepMind 维护的、基于 JAX 的灵活且高性能的神经网络库。它提供 Python 为中心的 API(Flax NNX)、常用层、训练工具和教程,可通过 `pip install flax` 安装。

NVIDIA/cuda-tile

CUDA Tile IR 是 NVIDIA 开发的基于 MLIR 的编译器基础设施,引入了专用于分块导向 CUDA 内核的方言。它提供 C++ 和 Python API、二进制字节码格式,以及将 MLIR 转换为字节码或 cubin 的工具,支持针对 NVIDIA Tensor-Core 单元的高性能内核。该项目基于 LLVM/MLIR,与 CUDA Toolkit 13.1 对齐,并包含一致性测试套件。这是一个真正的 AI 相关编译器项目,而非教程或列表。

JordanCoin/codemap

提供准确依赖图、影响范围分析和项目结构认知的结构化分析工具,防止破坏性变更。

dc-ai-projects/DC-Gen

DC‑Gen 是一个后训练框架,能够压缩任何预训练扩散模型的潜在空间,对齐嵌入,并微调一个极小的 LoRA 模块,在保持图像/视频质量的同时,实现高达 54 倍的推理加速。它支持文本到图像、文本到视频、图像到视频和编辑,并提供了 FLUX、Wan2.1、Qwen‑Image‑Edit 和 Z‑Image 等模型的指南。

EfficientMoE/MoE-Infinity

一种成本效益高的推理库,通过将专家权重卸载到主机内存和 SSD,使在内存受限的 GPU 上运行大型混合专家模型成为可能。

ApodexAI/AgentHarness

一个评估工具,用于在深度研究基准测试上使用标准化的 ReAct 设置来测试 AI 代理。

plasma-umass/scalene

Scalene 是一款快速的行级 Python 分析器,可测量 CPU、GPU (NVIDIA) 和内存使用情况,实现 Python 与原生代码的分离,可视化缝合后的堆栈,并能直接从 UI 向 LLM(OpenAI、Azure、Bedrock、Ollama 等)请求优化建议。

timeplus-io/proton

用于实时流处理和分析的高性能 C++ SQL 流水线引擎,是 Apache Flink 和 ksqlDB 的轻量级替代方案。

amebalabs/TRex

一款 macOS 实用工具,使用 OCR 从任意屏幕区域提取不可选文本并直接复制到剪贴板。

deepmodeling/jax-fem

基于 JAX 的可微有限元软件包,通过 GPU 加速模拟实现自动逆向设计和机制数据科学。

ExtractPDF4J/ExtractPDF4J

一个面向生产环境的 Java 库,利用 OCR 和表格结构检测技术,从文本型、扫描型和图像密集型 PDF 中提取表格和结构化数据。

borglab/gtsfm

基于 GTSAM 和 Dask 的端到端、分布式 Structure-from-Motion 流水线,可从 2D 图像重建 3D 场景,并原生支持并行计算。

provos/ironcurtain

IronCurtain 是一个研究级别的运行时,通过将自然语言编写的“宪法”编译为确定性的允许/拒绝规则,验证规则,并通过策略引擎在每次工具调用时强制执行,从而保护自主 LLM 代理。它支持 V8 沙箱或 Docker 隔离代理,提供交互式终端多路复用器和可选的 Web UI 用于处理升级请求,并包含角色/工作流功能,适用于多代理流水线。

f/agentlytics

一个将 17 种不同 AI 编码编辑器的对话历史、Token 成本和使用模式统一到一处的本地分析仪表板。

lucidrains/denoising-diffusion-pytorch

用于生成高质量图像和 1D 序列的 Denoising Diffusion Probabilistic Models (DDPM) 的 PyTorch 实现。

microsoft/fara

Fara1.5 是一组原生计算机使用代理模型,能够通过鼠标和键盘输入视觉感知并操作网页浏览器,以自动化复杂任务。

google-deepmind/mctx

一个 JAX 原生的库,为强化学习提供 AlphaZero 和 MuZero 等蒙特卡洛树搜索算法的高性能实现。

sunlabuiuc/PyHealth

一个为临床预测建模提供模块化流程的综合性深度学习工具包,适用于医疗AI应用。

gomlx/gomlx

一个为 Go 语言设计的全面机器学习与数学框架,提供类似 PyTorch 的体验,支持 XLA、ONNX 和纯 Go 后端。

tiiuae/Falcon-Perception

Falcon‑Perception 是一个开源的 PyTorch/MLX 推理库,专为 Falcon 多模态变换器设计,可基于自然语言查询执行对象检测、实例分割或 OCR。它提供高度优化的分页和批处理引擎、FastAPI 服务器、Streamlit UI、Docker/vLLM 部署用于 OCR,以及 Colab 笔记本。270 M 参数的 Falcon‑OCR 1.5 模型在保持三倍更小体积的同时,实现了与更大 VLM 相当的端到端 OCR 质量。

Wh1isper/mcp-email-server

一个通过 IMAP 和 SMTP 使 AI 助手能够读取、搜索、整理和发送邮件的 MCP 服务器。

kdcokenny/opencode-worktree

一个 OpenCode 插件,可自动创建 Git worktree 并启动专用终端,让 AI 代理在隔离环境中工作。

patrick-kidger/jaxtyping

一个用于在 JAX、PyTorch、NumPy、MLX 和 TensorFlow 之间进行数组形状和数据类型类型注解与运行时类型检查的库。

WecomTeam/wecom-openclaw-plugin

WeCom 渠道插件,适用于 OpenClaw AI 代理平台。支持 Bot(WebSocket 或 JSON Webhook)和 Agent(加密 XML Webhook)连接方式,支持富媒体、主动消息和流式回复,具备细粒度访问控制、多账户配置,并通过内置的 `wecom-cli` 工具暴露数十个 WeCom 业务 API(消息、邮件、文档、电子表格、日历、会议、文件存储、联系人等)。

NVIDIA/DCGM

一套用于在集群环境中管理与监控 NVIDIA 数据中心 GPU 的工具,提供健康监控、诊断和治理策略。

bstnxbt/dflash-mlx

一种针对 Apple Silicon 的预测解码实现,利用块扩散草稿模型在不损失输出质量的前提下加速 LLM 推理。