atopos31/llmio

一个基于 Go 的 LLM 负载均衡网关,为多个 AI 提供商提供统一的 REST API、加权调度和详细的可观测性。

WaveSpeedAI/waverless

一个高性能的无服务器 GPU 任务编排系统,通过智能自动扩缩容,在多个计算提供商之间高效管理 AI 工作负载。

rburkholder/trade-frame

一个用于高容量、低延迟交易的 C++ 框架,提供专门工具以追踪期权组合、计算实时希腊字母并在多个经纪商之间执行交易。

pranjalssh/fast.cu

一组为H100和GB300量身定制的高性能自定义GPU内核,优化矩阵乘法和求和归约操作。

microsoft/pai

OpenPAI 是一个全栈 AI 平台,使组织能够共享 GPU 和 FPGA 等计算资源,并管理 AI 资产,以简化训练流水线。

crate/crate

一个将 NoSQL 的可扩展性与标准 SQL 的强大功能相结合的分布式 SQL 数据库,适用于实时分析海量数据集。

Sergio0694/ComputeSharp

一个.NET 库,通过 DX12 和 D2D1 动态生成 HLSL 着色器,使开发人员能够在 GPU 上并行运行 C# 代码。

xtensor-stack/xsimd

一个 C++ 库,提供 SIMD 内建函数的统一包装器,以加速不同 CPU 架构上的数值计算。

PyWavelets/pywt

一个用于小波变换的 Python 库,可实现多维信号和数据的时间-频率分析。

trailofbits/claude-code-config

一套有倾向性的配置、沙箱规则和钩子,用于 Claude Code,以实现安全、高吞吐量的自主 AI 编码。

KeyValueSoftwareSystems/agent-opfor

基于 OWASP 标准提供自动化漏洞扫描的开源对抗模拟框架,专为红队测试 AI 代理和 MCP 服务器而设计。

PrimeIntellect-ai/OpenDiloco

通过分布式权重平均化减少通信开销的大型模型全球分布式训练开源框架。

google/paxml

一个基于 Jax 构建、专为 Cloud TPU 和 GPU 基础设施优化的大规模机器学习实验配置与运行框架。

neuralhydrology/neuralhydrology

一个基于 PyTorch 的 Python 库,专为水文学中的深度学习研究而设计,允许用户通过配置文件训练神经网络。

ROCm/composable_kernel

一个提供编程模型的库,用于编写可在不同 GPU 和 CPU 架构之间移植的高性能机器学习内核。

langgenius/dify-plugins

Dify 的插件生态系统和市场,使开发者能够通过自定义模型、工具和代理推理策略来扩展 AI 应用。

robertknight/rten

一个用 Rust 编写的机器学习运行时,可在 Rust 和 WebAssembly 环境中运行 PyTorch 等 Python 框架训练的 ONNX 模型。

agentscope-ai/Trinity-RFT

一个通用的 LLM 强化微调框架,通过解耦探索、训练和数据缓冲,支持多种 RL 算法和智能体工作流。

reductstore/reductstore

面向机器人技术和工业物联网的高性能时间索引对象存储系统,允许按时间范围和标签查询二进制数据。

rl-tools/rl-tools

一个为从微控制器到 GPU 的各种硬件环境优化的快速、可移植的 C++ 库,专用于深度强化学习和连续控制。

enoche/MMRec

一个现代的多模态推荐工具箱,为各种基于研究的推荐模型提供统一的框架和源代码。

kyegomez/BitNet

1-bit Transformer 的 PyTorch 实现,通过将标准线性层替换为二值化投影,大幅降低 LLM 的内存和计算需求。

sintel-dev/Orion

一个用于无监督时序异常检测的机器学习库,提供经过验证的 ML 流水线来识别信号中的稀有模式。

OEvortex/llm4free

一个 Python 工具包,为 40 多种免费和付费的 AI 模型提供统一且与 OpenAI 兼容的接口,包括文本、图像和语音生成。

justrach/codedb

codedb 是一个基于 Zig 的代码智能引擎,构建仓库(符号、调用者、依赖项、三元组搜索等)的本地索引,并通过 Model Context Protocol (MCP)(JSON-RPC over stdio)向 AI 编码助手提供信息。它提供 `codedb_context`、`codedb_explain` 和 `codedb_callpath` 等 MCP 工具,实现毫秒级以下的快速查询,同时作为代理的只读“指南针”。可作为原生二进制或 npm 包装器安装,支持 macOS、Linux 和 Windows,支持混合本地/远程语义检索,并可作为 HTTP 服务器用于调试。

MatthewZMD/aidermacs

Aider 的 Emacs 集成,为 Emacs 编辑器带来 AI 伙伴编程和自动代码编辑功能。

cisco-ai-defense/mcp-scanner

一款使用 YARA、LLM 和 Cisco AI Defense 检测恶意行为和漏洞的 Model Context Protocol (MCP) 服务器和工具安全扫描工具。

oxylabs/oxylabs-ai-studio-py

一个用于 Oxylabs AI Studio 的 Python SDK,提供 AI 驱动的网页抓取、爬取和浏览代理,以使用自然语言提示词来提取结构化数据。

NVIDIA/raft

一个 CUDA 加速的基础算法与原语库,供机器学习和数据挖掘使用,设计为高性能 AI 应用的构建块。

cyrusbehr/tensorrt-cpp-api

一个现代 C++ 库,用于使用 NVIDIA TensorRT 对 CNN 模型进行高性能 GPU 推理,具备安全的引擎缓存和零拷贝 Python 绑定。

geomstats/geomstats

A Python package for computations, statistics, and machine learning on manifolds, enabling the analysis of non-Euclidean data like rotations and shapes.

meta-pytorch/opacus

一个用于使用差分隐私训练机器学习模型的 PyTorch 库,允许用户在跟踪跟踪隐私损失的同时保护敏感的训练数据。

WenjieDu/PyPOTS

一个用于部分观测时间序列机器学习的 Python 工具箱,提供统一的 API 以在缺失值数据上执行插补、预测与异常检测。

Trusted-AI/AIF360

一个可扩展的开源库,支持 Python 与 R,提供度量指标和算法,用于检测和缓解机器学习模型中的算法偏见。

flashlight/flashlight

一个快速、灵活的 C++ 机器学习库,提供核心张量接口和神经网络工具,适用于语音、视觉和文本的高性能 AI 研究。

tensorflow/serving

一个高性能的机器学习模型服务系统,旨在管理模型生命周期,并通过 gRPC 和 HTTP 在生产环境中提供版本化推理。

aws/amazon-sagemaker-examples

官方 Amazon SageMaker 示例笔记本和 SageMaker-Core SDK 的集合,用于在 AWS 上构建、训练、部署和运营机器学习模型。

bespokelabsai/curator

一个用于构建可扩展合成数据管道的 Python 库,提供批量推理和结构化输出工具,以策划高质量的后训练数据集。

aidatatools/ollama-benchmark

一个跨平台 CLI 工具,基于用户可用的系统 RAM,测量通过 Ollama 运行的本地 LLM 的每秒令牌吞吐量。

matrixhub-ai/matrixhub

一个开源、自托管的 AI 模型注册表,作为私有的 Hugging Face 替代方案,加速模型分发并保障企业推理的权重安全。

Intrect-io/OpenSwarm

一个自主 AI 代理编排器,用于管理代码工作者以解决来自 Linear 或本地追踪器的问题,具备沙箱验证的 Worker/Reviewer 流水线。

emcf/thepipe

一个使用视觉语言模型(VLM)从复杂文档中抓取干净的 Markdown 和结构化数据的多模态数据提取包,适用于 RAG 和 LLM 应用。

giaf/blasfeo

专为嵌入式优化应用中通常使用的、可放入缓存的小型矩阵优化的高性能线性代数库。

element-plus-x/Element-Plus-X

基于 Vue 3 和 Element-Plus 的企业级 AI UI 组件库,提供聊天机器人、语音交互和流式界面的即用组件。

AliAkhtari78/SpotifyScraper

一个无需 API 密钥即可提取公开 Spotify 元数据的 Python 库,内置 AI 代理用 MCP 服务器,并支持歌词和字幕。

snowflakedb/ArcticInference

一个开源的 vLLM 插件,通过高级并行和推测解码优化 LLM 和嵌入推断,以提升吞吐量并降低延迟。

alphadl/AdaRubrics

AdaRubric 是一个框架,可生成任务特定的评估标准和密集奖励信号,以可靠地评估和过滤 LLM 代理轨迹,用于奖励学习。

andrea9293/mcp-documentation-server

专为AI代理设计的本地优先文档管理与语义搜索服务器,提供私有知识库、内置Web UI和混合搜索功能。