foxminchan/BookWorm

一个展示多代理 AI 编排与标准化 AI 工具集成到微服务架构中的云原生参考应用。

facebookresearch/pixio

Pixio 是一种通过增强像素重建预训练优化的视觉编码器,适用于深度估计和语义分割等密集预测任务。

torchmd/torchmd-net

一个基于 PyTorch 的库,提供用于分子模拟的最先进神经网络势及其训练工具。

Lornatang/SRGAN-PyTorch

基于生成对抗网络的 PyTorch 重实现 SRGAN,可生成恢复精细纹理的 4 倍放大照片级真实感图像。

smartscanapp/smartscan-android

一款使用设备端处理和自动媒体分组,将图片和视频转换为可搜索个人知识库的 Android 应用。

NVIDIA/tilus

Tilus 是一种区块级 GPU 内核编程语言,支持对共享内存和寄存器的显式控制,实现高性能低精度计算。

uqfoundation/mystic

专为科学机器学习、不确定性量化和人工智能设计的受约束非线性优化框架,提供对求解器工作流的细粒度控制。

BoxcarsAI/boxcars

一个 Ruby 框架,允许开发者通过统一、可组合的架构协调工具、数据查询和 AI 提供商。

microsoft/Conversation-Knowledge-Mining-Solution-Accelerator

一个从大量对话数据中提取洞察的AI驱动管道和分析平台,具备LLM驱动的聊天界面和自动生成的KPI仪表板。

openml/automlbenchmark

一个使用标准化环境和精选数据集来评估和比较开源 AutoML 系统的框架,以确保研究的可复现性。

h2oai/h2o4gpu

一组 GPU 加速的机器学习求解器,可作为 scikit-learn 的即插即用替代品,提供 Python 和 R API,实现更快的模型训练。

jax-ml/jax-triton

一个集成库,允许 JAX 用户在 JAX 程序中调用自定义 Triton 内核,以实现高性能 GPU 操作。

microblink/blinkid-android

使用机器学习和原生 C++ 库的 Android SDK,用于安全的身份证明文件扫描和数据提取。

landingbj/LinkMind

一种企业级多模态 AI 中间件,提供统一的 API 层,用于管理多个模型提供商、RAG 和代理运行时,并具备集中式路由和治理功能。

stephenhky/PyShortTextCategorization

一个用于监督和无监督短文本分类的 Python 包,提供文本表示、主题建模和神经网络分类的工具。

noahgolmant/pytorch-hessian-eigenthings

一个用于高效计算神经网络 Hessian 特征分解、迹和谱密度的 PyTorch 库,且不会遇到平方级内存瓶颈。

erthorpabar/pabar_agent_runtime

一个集成聊天、RAG 和代理循环的 AI 代理运行时框架,支持跨桌面和移动平台的专业自动化任务。

ImDarkTom/LlamaPen

一个用于 Ollama 及其他本地 LLM 提供方的网页 GUI,允许用户通过注重隐私的界面与自托管模型进行聊天。

sapientml/sapientml

一种通过从人类编写的解决方案语料库中学习,合成高质量机器学习流水线的表格数据 AutoML 技术

SJTU-ViSYS/Ground-Fusion

一种用于地面车辆的低成本传感器融合SLAM系统,整合RGB-D、IMU、轮式里程计和GNSS,确保在挑战性边缘情况下的稳健定位。

josstei/maestro-orchestrate

一个通过结构化 Express 和 Standard 工作流协调 39 个 AI 专家在各种编码运行时中管理软件开发的多代理协调平台。

wavlab-speech/versa

一个综合性工具包,提供90多种指标的统一接口,用于评估语音和音频的质量、可懂度和技术属性。

SciML/DataDrivenDiffEq.jl

一个用于数据驱动的微分方程结构估计与识别的 Julia 包,允许用户从数据中自动发现数学模型。

daydreamlive/scope

一个使用自回归扩散模型和可组合架构,用于运行和自定义实时、交互式生成式 AI 视频流水线的工具。

ip2a/mcpstore

一个用Rust构建的高性能MCP管理系统,用于编排AI代理和应用程序的模型上下文协议服务。

DeepL/deepl-node

DeepL API 的官方 Node.js 客户端库,使开发者能够将高质量的文本和文档翻译功能集成到其应用程序中。

awslabs/graphrag-toolkit

一套用于使用层次化词汇图和结构化知识图构建图增强型生成式AI应用的Python工具集合。

Eclectic-Sheep/sheeprl

由 Lightning Fabric 加速的可扩展 PyTorch 强化学习框架,将 RL 算法与环境解耦,实现更高灵活性。

BakeLens/crust

Crust 是一个开源、本地运行的代理,位于 AI 编码助手与 LLM 提供商之间。它检查每一次工具调用(文件读取、shell 命令、网络请求等),并阻止可能暴露密钥或损害主机的操作。该网关可作为 HTTP 代理、MCP/ACP stdio 包装器或 Docker 容器运行,内置 42 个安全规则、51 个 DLP 模式,并支持自定义策略插件。它完全在用户机器上运行,日志加密存储于操作系统密钥环中,并通过 Swift 包支持 iOS 集成。

jiafeng5513/Evision

一个使用 ELAS 和 ADCensus 等算法进行相机校准、视差映射和 3D 重建的双目视觉系统。

v0lta/PyTorch-Wavelet-Toolbox

一个为信号和图像处理设计的 PyTorch 原生小波变换工具箱,支持 GPU 加速和梯度计算。

tensorflow/tflite-support

一个用于在移动设备上开发和部署 TFLite 模型的工具包,提供元数据管理、自动 API 生成和优化的任务库。

infinitered/react-native-mlkit

一组封装 Google 的 MLKit 原生库的 Expo 模块,使 Expo 应用能够实现人脸和物体检测等设备端机器学习功能。

Stability-AI/stable-codec

一种高质量、低比特率的语音编码器,可将音频压缩为离散标记,专为文本转语音等下游任务优化。

chr15m/runprompt

一个用于执行.prompt 文件的命令行工具,允许用户将 LLM 提示词视为可版本化的制品,并通过 Shell 实现 AI 工作流自动化。

PersiaML/PERSIA

一个基于 PyTorch 的并行训练系统,旨在利用普通硬件将深度学习推荐模型扩展至 100 万亿参数。

AIGeeksGroup/3D-R1

3D-R1 是一种通用 3D 视觉-语言模型,通过合成 CoT 数据和强化学习提升空间推理与场景理解能力。

qdrant/rust-client

一个原生 Rust 客户端,可在 Rust 应用程序中实现高性能向量搜索和数据库管理。

FujitsuResearch/OneCompression

一个使用 QEP 和 AutoBit 等先进量化技术来减少模型大小和 VRAM 使用的 Python 包。

hujiecpp/PE3R

PE3R 是一种感知高效的 3D 重建系统,利用零样本泛化将 2D 图像转换为语义理解的 3D 场景。

kermitt2/delft

一个基于 Keras 和 TensorFlow 的文本处理框架,支持序列标注和文本分类,并原生支持结构化文档(如 PDF 或 HTML)中的富文本布局信息。

deepqmc/deepqmc

用于模拟电子基态和激发态的开源软件套件,支持深度学习分子波函数的变分优化。

Deep-unlearning/smol-audio

一系列实用的笔记本,用于在Hugging Face生态系统中对ASR和音频字幕等任务的音频AI模型进行微调和优化。

dluvizon/deephar

一个用于实时2D和3D人体姿态估计及动作识别的多任务深度学习框架。

kozistr/pytorch_optimizer

一个与 PyTorch 兼容的库,通过单一且一致的 API,整合了 100 多种研究型优化器、多种学习率调度器(LR schedulers)和损失函数,并提供低精度训练的选用整合功能。

atomicstrata/atomicmemory

一个可检查且具备修正意识的 AI 代理记忆系统,可在会话间提供持久的上下文,且不与特定模型或框架耦合。

asagi4/comfyui-prompt-control

一个 ComfyUI 扩展,允许你使用简单的文本提示词来控制复杂的 AI 图像生成工作流(如 LoRA 加载、提示词调度和区域提示词),而无需手动连接数十个节点。

syne-tune/syne-tune

一个支持分布式执行和先进调优方法的大规模、可复现超参数优化(HPO)库。