bold-lab-ai/JaxMARL

一个用于多智能体强化学习的 JAX 原生库,提供 GPU 加速环境和基准算法,用于高效基准测试。

Iamshankhadeep/ccseva

一款原生 Swift 开发的 macOS 菜单栏应用,可实时追踪 Claude Code 的令牌消耗、成本及服务器端使用限制。

wildminder/AI-windows-whl

为在 Windows 上难以安装的 AI/ML 库提供精选的预编译 Python wheels 集合,无需从源码构建。

gavamedia/deltafin

Deltafin 是一个基于 Rust 的原生二进制文件,可在消费级硬件(macOS arm64 或 Linux x86_64/aarch64)上运行完整的 2.8T 参数 Kimi K3 混合专家模型。保留全部 16 个专家,支持完整下载和按需流式安装,可选 Qwen 草稿模型加速,提供 CLI 用于聊天/补全,以及 OpenAI 兼容服务器。项目采用 MIT 许可证,模型权重遵循其原始条款。

mmschlk/shapiq

一个用于近似任意阶 Shapley 相互作用的 Python 包,以解释机器学习模型预测中的特征协同作用。

automateyournetwork/netclaw

一个 CCIE 级别的 AI 网络工程代理,使用数百种技能和 MCP 集成,在多供应商网络中自动化监控、故障排除和配置。

NadirRouter/NadirClaw

一个本地 LLM 路由代理,通过将提示词路由到最便宜的可行模型,并仅在必要时升级到高级模型,将 API 成本降低 40-70%。

FlashML-org/flashlib

一个基于 Triton 和 CuteDSL 构建的 GPU 库,提供 k-means、PCA 和 ANN 搜索等经典机器学习算子的高性能实现。

google-deepmind/simply

一个基于 JAX 的极简且可扩展的研究代码库,旨在为人类和 AI 智能体实现快速的 LLM 迭代和自动化的 AI 研究。

ROCm/aiter

一个针对 AMD ROCm 的高性能 AI 算子库,为 AI 推理与训练工作负载提供优化的 GPU 内核。

apple/foundation-models-utilities

适用于 Apple Foundation Models 框架的实用工具包,提供聊天补全客户端、上下文窗口管理以及 LLM 的动态技能激活功能。

pipecat-ai/voice-ui-kit

一个基于 React 的 UI 工具包,提供组件和模板,可快速构建和部署 Pipecat AI 语音应用的用户界面。

microsoft/RAMPART

专为代理型 AI 应用程序的红队测试和风险评估设计的原生 pytest 安全与安全测试框架。

stevibe/BenchLocal

一个本地优先的桌面应用程序,用于在各种基准测试集(称为 Bench Packs)上运行和比较本地或远程模型的 LLM 性能。

vgvassilev/clad

一个用于 C++ 的 Clang 编译器插件,通过转换源代码来自动生成导数、梯度和 Hessian 矩阵的函数。

scverse/rapids-singlecell

一个与 scverse 生态系统集成、利用 NVIDIA RAPIDS 加速大规模数据集计算的 GPU 加速单细胞分析库。

dorjeduck/llm.mojo

将 Andrej Karpathy 的 llm.c 移植到 Mojo 语言,展示了 Mojo 在低级别 LLM 训练中可达到与 C 语言相当的性能。

WeZZard/jlens-qwen36

适用于Apple Silicon上Qwen3.6-27B的可视化调试器,利用雅可比透镜可视化和编辑模型的内部潜在表示。

AlexsJones/llmserve

一个基于 TUI 的模型管理器和服务启动器,自动检测推理后端和本地模型文件,以简化 LLM 的服务提供。

tuchg/Lucarne

一个轻量级后台守护进程,将本地 AI 代理连接至 Telegram 和 WeChat,使用户可通过移动通知远程监控和控制代理。

NVIDIA-NeMo/Evaluator

一个具备基准测试环境、可插拔拦截器代理用于流量管理,以及用于模型性能分析的多格式报告功能的 LLM 评估框架。

flagos-ai/FlagTree

FlagTree 是一个面向多种 AI 芯片的统一开源编译器,通过统一各种基于 Triton 的后端,实现“一次开发,随处运行”的工作流。

unslothai/unsloth-zoo

Unsloth 的一个实用库,可显著降低显存需求,实现更快、更高效的 LLM、视觉模型和 TTS 模型微调。

standardagents/composer-api

一个本地 macOS 服务器,将 Cursor 的第一方模型(如 Composer 2.5 和 Grok 4.6)作为 OpenAI 兼容 API 端点暴露。

kubeshark/kubeshark

一款用于 Kubernetes 的网络观测工具,利用 eBPF 对流量进行索引,并通过 MCP 集成提供 AI 驱动的故障排除功能。

maxritter/pilot-shell

一个围绕 Claude Code 和 Codex 构建的专业上下文与工程封装系统,为生产级软件提供持久上下文、质量门禁和运行时验证。

Agent-Field/pr-af

一个开源代理式代码审查工具,使用动态管道和证据基础来执行深度架构审计,以找出系统性漏洞。

NVIDIA/cuvs

一个用于向量相似性搜索和聚类的 GPU 加速库,为 AI 和数据挖掘提供高性能的近似最近邻算法实现。

codelibs/fess

一个基于 OpenSearch 构建的企业级搜索服务器,可从网站、文件系统和云数据存储中抓取并索引文档,实现集中化的全文搜索。

syncable-dev/memtrace-public

一种为 AI 编码代理设计的结构化记忆系统,将代码库转化为本地、双时相的知识图谱,实现快速、低成本的架构查询。

JuliaDynamics/Agents.jl

一个高性能的 Julia 框架,用于基于代理的建模,能够模拟自主代理对环境及彼此的反应。

Haervwe/open-webui-tools

一套为 Open WebUI 提供的综合工具集,包含 20 多种工具、函数管道与过滤器,增加了学术研究、多模态生成和自主代理功能。

kiwifs/kiwifs

一个为 AI 代理和人类提供可写、可搜索、可版本化的 Markdown 文件系统,支持原生 MCP 和基于 Git 的审计功能。

agentic-in/inferoa

一个面向推理的代理设计,用于循环工程,优化 token 使用和缓存复用,以保持高效、长期递归的 AI 工作流。

leyten/shard

一种协议和引擎,通过汇集分布式 GPU 的 VRAM 和计算能力,在开放互联网上运行大规模 AI 模型。

9tigerio/db2rest

一个低代码的 REST API 平台,能够自动为数据库创建安全端点,加速 AI 与数据驱动应用的开发。

bghira/SimpleTuner

一个用于微调图像、视频和音频生成模型的综合性训练框架,具备用户友好的 Web UI 和企业级编排能力。

lucienhuangfu/eLLM

面向 CPU 服务器的 LLM 推理框架,通过优化内存使用,在长时序、多轮推理和超长上下文任务中实现超越 GPU 的性能。

jjang-ai/mlxstudio

一款在 Apple Silicon 上使用 MLX 框架本地运行 LLM、VLM 与图像生成模型的原生 macOS 桌面应用。

openvinotoolkit/model_server

OpenVINO Model Server (OVMS) 是一个 C++ 推理服务器,通过 OpenAI 兼容 REST 或 KServe gRPC API 提供 LLM、视觉-语言模型和经典深度学习模型。专为 Intel CPU、GPU 和 NPU 优化,支持连续批处理、流式传输、模型版本控制、热重载和 Prometheus 指标。可通过 Docker、裸金属二进制文件或 Kubernetes 部署,支持多种模型格式(TensorFlow、ONNX、OpenVINO IR、GGUF 等),并与标准客户端库集成。

john-rocky/CoreML-Models

一组全面的预转换 Core ML 模型和示例应用,用于在 iOS 和 macOS 上实现设备端 AI。

weslynn/AlphaTree-graphic-deep-neural-network

一个结构化的可视化路线图与资源集合,通过链接论文、代码和深度学习模型图示,帮助开发者转向 AI 应用工程。

Nixtla/neuralforecast

一个包含超过 30 种最先进神经预测模型的库,专为时间序列预测中的高性能、易用性和高效性而设计。

plurai-ai/intellagent

一个多代理框架,通过模拟数千个真实的边缘案例交互,对话式 AI 代理进行压力测试,以发现失效点并优化性能。

GoogleCloudPlatform/agent-starter-pack

一个 Python 包,提供生产就绪的模板和基础设施自动化,用于在 Google Cloud 上的 GenAI 代理人,简化从原型到生产的路径。

lumina-ai-inc/chunkr

一个开源文档智能 API,通过布局分析和 OCR 将 PDF、PPT、Word 文档和图像转换为结构化、RAG 就绪的块。

automl/auto-sklearn

一个作为 scikit-learn 估计器即插即用替代品的自动机器学习工具包,用于自动化模型选择和超参数调优。

auto-differentiation/xad

为性能关键系统提供前向和反向模式自动微分的高性能 C++ 库,运行时开销极低。