Mohamedelrefaie/DrivAerNet

一个包含 8,150 个高保真 CFD 汽车设计的高质量多模态数据集和基准测试,用于训练用于空气动力学优化和性能预测的 AI 模型。

h2oai/h2o-llmstudio

一个无需编码即可实验超参数和高级训练技术的大型语言模型微调无代码 GUI 和框架。

facebookincubator/nimble

由 Meta 设计的一种列式文件格式,专为大型、宽泛的数据集设计,优化了机器学习训练表和特征工程的存储与访问。

pykeen/pykeen

PyKEEN 是一个用于训练和评估知识图谱嵌入模型的 Python 包,提供了一个全面的内置数据集和模型库。

mlpack/mlpack

A fast, header-only C++ machine learning library that provides a wide array of ML methods and functions with bindings for Python, Julia, Go, and R.

tensorflow/tfjs

一个硬件加速的 JavaScript 库,用于在浏览器和 Node.js 中训练与部署机器学习模型。

clearml/clearml-agent

一种 MLOps/LLMOps 调度器和编排工具,通过零配置实现本地和云端资源上的 ML 实验自动执行。

paulpierre/markdown-crawler

一个多线程网页爬虫,将网站页面转换为 markdown 文件,以简化 RAG 和 LLM 微调的文档解析与切分。

usemoss/moss

Moss是一款亚10毫秒的语义搜索运行时,将检索和嵌入直接嵌入应用程序进程中,以消除实时AI代理的网络延迟。

vearch/vearch

Vearch 是一个云原生分布式向量数据库,能够为 AI 应用提供嵌入向量的高效相似度搜索。

avibe-bot/avibe

Avibe 是一个本地优先的「Agent OS」,可让您在自己的机器上运行官方 AI 代理 CLI(如 Claude Code、Codex 和 OpenCode),并通过浏览器或消息应用远程控制它们。

easy-graph/Easy-Graph

一个支持 GPU 加速和高阶网络学习的高性能 Python 库。

nunchux-ai/ComfyUI-nunchaku

Nunchaku 推理引擎的 ComfyUI 插件,可实现图像生成和编辑模型的高效 4 位量化推理。

apple-aiml-research/ml-ane-transformers

一个基于 PyTorch 的库,提供针对 Apple Neural Engine 优化的 Transformer 模型的参考实现和 Hugging Face 兼容实现,在 A14/M1 级设备上可实现最高 10 倍推理速度提升和 14 倍内存降低。

shaiwz/data-platform-open

一个利用AI帮助用户无需编写代码即可构建数据管道和查询模板的零代码、可视化拖拽式大数据集成平台。

igerber/diff-diff

一个用于差分的差分因果推断的 Python 库,提供广泛的经济计量估计器,用于衡量活动提升、政策影响和分阶段实施效果。

Joyi-code/DeepSeekMonitorWindows

使用 Tauri 和 Rust 构建的 Windows 桌面应用程序,用于监控 DeepSeek API 账户余额、月度支出和令牌使用趋势。

1broseidon/cymbal

一个快速、语言无关的代码导航器,将代码库索引到 SQLite 中,为人类和 AI 代理提供毫秒级延迟的符号查找、影响分析和结构化导航。

deepnote/deepnote

一个 AI 原生数据笔记本平台,通过将 Jupyter 的 JSON 格式替换为人类可读的 YAML 结构,从而实现更好的协作和版本控制。

EmuKit/emukit

用于不确定性下决策的 Python 工具包,提供代理建模、贝叶斯优化和数据稀缺复杂系统的主动学习工具。

mljar/supertree

支持 scikit-learn、XGBoost、LightGBM 和 ONNX 模型的 Jupyter Notebook 交互式决策树可视化工具。

ValeevGroup/tiledarray

一个可扩展的块稀疏张量框架,用于高性能张量运算,允许用户使用类似数学的 C++ 语法组合复杂表达式。

qdrant/vector-db-benchmark

一个在相同硬件约束下,用于比较不同向量搜索引擎性能和效率的通用框架。

ml-energy/zeus

一个用于在 NVIDIA、AMD 和 Apple Silicon 等多种硬件平台上测量和优化深度学习工作负载能源消耗的库。

dollspace-gay/chainlink

一款本地优先的问题跟踪器 CLI,为 AI 辅助开发提供持久记忆层和行为规范,以防止跨会话丢失上下文。

yifanzhang-pro/deep-delta-learning

一种新型神经网络架构,通过可学习的 Delta 算子动态控制跨层的信息擦除与注入,从而实现残差连接的泛化。

pyt-team/TopoModelX

一个用于在拓扑域(如单体复形)上进行深度学习的 Python 模块,适用于科学和工程领域。

quarkiverse/quarkus-langchain4j

一组与 LangChain4j 库集成的 Quarkus 扩展,使 Java 开发者能够轻松地将 LLM、嵌入和文档存储集成到其应用程序中。

vllm-project/compressed-tensors

一个扩展 safetensors 格式的库,旨在为各种 LLM 压缩和量化方案提供统一的存储和管理系统。

sophgo/LLM-TPU

LLM‑TPU 是 SOPHGO 的开源项目,可将 HuggingFace 的 LLM 与视觉语言模型编译为与 SOPHGO TPU 相兼容的 bmodels。它支持一键编译、丰富的量化模型目录、动态/KV‑cache 推理、多芯片扩展以及为 BM1684X、BM1688 和 CV186X 芯片提供现成的 Python/C++ demos。

data-privacy-stack/presidio-research

一个用于评估 PII 检测模型并使用模板生成合成 PII 数据集的工具包,以提高命名实体识别(NER)的准确性。

mixa3607/ML-gfx906

一组为已弃用的 AMD GFX906 架构优化的机器学习软件构建和工具,使旧硬件仍能运行现代 AI 工作负载。

Chaoses-Ib/ComfyScript

用于 ComfyUI 的 Python 前端和库,允许用户使用 Python 脚本而不是可视化节点图来定义和运行图像生成工作流。

microsoft/ai-dev-gallery

为 Windows 开发者提供的交互式 AI 示例库,可探索本地 AI 模型并将其导出为 C# Visual Studio 项目。

growthxai/output

一个 TypeScript 框架,用于构建 AI 工作流和代理,将提示管理、追踪和评估整合到单一代码库,以避免 SaaS 碎片化。

docsagent/docsagent

一个 MCP 服务器,利用高性能 C++ 搜索引擎,使 AI 代理能够搜索和管理本地 Zotero 库,实现私有、本地优先的 RAG。

wanghetommy/ichartjs

一种代理优先、与渲染器无关的可视化运行时,允许 AI 代理检查数据、规划、验证并渲染交互式图表和图表。

neurodsp-tools/neurodsp

一个用于使用数字信号处理技术分析和模拟神经时间序列的 Python 工具箱,以研究振荡性和非周期性活动。

AlickH/Copool

一款用于管理多个 Codex/ChatGPT 账户的 macOS SwiftUI 应用,具备智能配额切换功能和本地/远程 API 代理工作流。

projectglow/glow

一个将基因组分析集成到 Apache Spark 中的开源工具包,可实现生物银行规模的生物信息学和大规模基因组数据处理。

piperhex/codex-switch

为 Codex 和 ChatGPT 用户设计的桌面工作台,将图形化代码助手与多账户及第三方提供商管理相结合。

NVIDIA/gdrcopy

一个基于 NVIDIA GPUDirect RDMA 的低延迟 GPU 内存复制库,允许 CPU 直接映射并操作 GPU 内存,以减少传输开销。

fraunhoferportugal/tsfel

一个用于时间序列分析的 Python 库,提供超过 65 种涵盖统计、时间、频谱和分形领域的集中式特征,用于机器学习准备。

XTraceAI/cuhepy

一个用于 Python 的 GPU 加速同态加密库,实现了 Paillier 和 BFV 方案,以实现加密最近邻搜索等隐私计算。

unum-cloud/UStore

一个用于 AI 和语义搜索的模块化、多模态事务数据库,将文档、图形和向量存储整合到单一符合 ACID 的系统中。

stripe/rainier

基于马尔可夫链蒙特卡洛的高性能 Scala API,使用户能够构建生成模型并从观测数据中推断后验分布。

tidymodels/yardstick

一个基于 tidy data 原则的 R 包,提供一致的接口用于计算分类和回归模型的性能指标。

huggingface/gpu-fryer

一款用于检测 NVIDIA GPU 热节流和性能下降的 GPU 压力测试工具,确保 ML 工作负载达到最佳性能。