cosanlab/py-feat

一个用于面部表情研究的 Python 工具箱,可从图像和视频中检测人脸并提取情绪、面部肌肉运动和关键点。

DragonKingpin/Hydra

一个分布式基础设施框架,使个人能够以大型组织的运营能力管理 PB 级数据仓库、大规模抓取和任务编排。

deepmodeling/dpgen

DP‑GEN是一个Python平台,可自动化创建深度学习原子间势(Deep Potential模型)。它运行一个并发学习循环——采样结构、选择信息量最大的结构进行DFT计算、重新训练模型——同时处理HPC集群上的作业调度,并与许多MD和量子化学代码接口。

simonw/llm-openrouter

一款适用于 LLM CLI 工具的插件,可让您访问 OpenRouter 托管的各类 AI 模型,并支持视觉、结构化输出和托管服务器工具。

kstonekuan/tambourine-voice

一个开源的通用语音转文字接口,利用 AI 将语音转录并格式化为干净文本,直接输入到任何活动应用程序中。

NVIDIA/Megatron-Energon

一个为 Megatron-LM 设计的多模态数据加载器,支持大规模、分布式加载和混合海量数据集,用于训练大模型。

allenai/ScienceWorld

一个基于标准化小学科学课程衍生任务的文本型虚拟环境,用于对 AI 代理进行基准测试。

VectifyAI/pageindex-mcp

一个 Model Context Protocol (MCP) 服务器,通过分层树结构使 LLM 能够对长 PDF 进行基于推理的无向量 RAG。

qdrant/vector-db-benchmark

一个在相同硬件约束下,用于比较不同向量搜索引擎性能和效率的通用框架。

robosoft-ai/SMACC2

SMACC2 是一款用于在 ROS 2 上构建实时、事件驱动状态机的 C++ 库,针对复杂的多组件机器人。它提供正交区域、编译时验证、现成的 ROS 2 客户端封装,以及状态机库,并附带完整的 Doxygen 文档和免费的运行时可视化工具。

tylergraydev/claude-code-tool-manager

一款为 Claude Code 和 Cursor 等多种 AI 编程助手提供可视化界面,用于管理 MCP 服务器、命令和代理的桌面应用程序。

ml-energy/zeus

一个用于在 NVIDIA、AMD 和 Apple Silicon 等多种硬件平台上测量和优化深度学习工作负载能源消耗的库。

dollspace-gay/chainlink

一款本地优先的问题跟踪器 CLI,为 AI 辅助开发提供持久记忆层和行为规范,以防止跨会话丢失上下文。

microsoft/microxcaling

一个支持 MX 兼容格式和 bfloat 量化的 PyTorch 模拟库,使数据科学家能够探索低精度数值格式对 DNN 的影响。

qiboteam/qibo

一个开源的全栈API,用于量子模拟和量子硬件控制,提供设备无关的方式来执行量子电路。

Arenukvern/mcp_flutter

一个 Dart MCP server 和 Flutter package,允许 AI agent 在调试模式下检查、驱动并与运行中的 Flutter 应用进行交互。

BAAI-DCAI/SpatialBot

SpatialBot 是一种视觉-语言-动作模型,可增强 VLM 的空间理解与深度感知能力,实现精确的空间推理与机器人操作。

vinavfx/ComfyUI-for-Nuke

一个将 ComfyUI 节点集成到 Nuke 的 API,使 VFX 艺术家能够直接在其专业合成软件中使用生成式 AI 工作流。

PEPETII/danmuai

一款 Windows 桌面助手,使用视觉模型实时分析屏幕内容并生成滚动 AI 评论(danmu),并可选提供语音合成功能。

kkirchheim/pytorch-ood

pytorch‑ood 是一个基于 PyTorch 构建的真正 Python 库,用于分布外检测。它集成了超过 30 种检测器、损失函数、预训练模型、数据集和实用工具,与 pytorch‑lightning 集成,并提供简单 API 和基准辅助工具。通过 `pip install pytorch-ood` 安装,只需几行代码即可开始使用 `EnergyBased` 等检测器。

Lucassssss/eechat

一款支持 Model Context Protocol (MCP) 的安全本地 AI 聊天应用,可轻松集成 AI 工具和服务,同时将数据本地存储。

stefanoamorelli/sec-edgar-mcp

一个将 AI 助手连接至 SEC EDGAR 申报文件的 MCP 服务器,提供对公司财务报表和内部人交易数据的精确访问。

ServiceNow/Fast-LLM

一款利用 3D 并行和优化内核来减少训练时间和成本的高性能大语言模型训练库。

anthropics/anthropic-sdk-csharp

官方的 C# SDK,让 .NET 开发者能够将其应用程序与 Anthropic 的 Claude API 集成。

zgiai/zgi

一个源代码开放的 Agent 运行时平台,用于构建、编排和操作 AI 代理及可执行工作流,内置治理和沙箱执行能力。

Lamatic/AgentKit

AgentKit 是一个开源 SDK,提供 70 个现成的“套件”(完整应用、流水线或模板),用于构建、测试和部署 AI 代理。套件由一个简单的配置文件定义,可在可视化流程工作室中编辑,并以无服务器运行的 Next.js 应用形式交付。该集合涵盖支持分诊、代码审查、RAG 聊天、招聘助手、法律/医疗机器人等众多业务导向的代理,是一个开箱即用的平台,可快速构建可靠、企业级的 AI 代理。

Zyphra/zuna

ZUNA1.1 是一个用于 EEG 的开源基础模型,利用 3D 头皮坐标实现信号去噪、缺失通道重建和稀疏电极布局的上采样。

Utopai-Research/pai-pro

一个以本地为中心的 AI 影视制作工作区,将编码代理与可视化画布和统一的媒体 API 集成,用于生成图像、视频和语音。

Pixel-Talk/PEAR

PEAR 是一个实时框架,能够从图像或视频中以 100 FPS 预测富有表现力的 3D 人体网格参数。

google-research/era

ERA 是一个 AI 系统,通过将 LLM 与树搜索算法结合,迭代生成和评分候选程序,帮助科学家编写专家级的经验性软件。

scu-zjz/IMDLBenCo

提供图像篡改检测与定位的全面基准和模块化代码库,包含标准化组件和最先进模型实现。

gongnyang/gongnyang-prompt-kit

专为 Claude Code 设计的提示编译工具包,可将模糊的图像请求转化为适用于 gpt-image-2 的专业且经过验证的提示

NevermindNilas/TheAnimeScripter

专为动画设计的AI驱动视频增强工具包,可在单次处理中实现放大、运动插值和修复。

quarkiverse/quarkus-langchain4j

一组与 LangChain4j 库集成的 Quarkus 扩展,使 Java 开发者能够轻松地将 LLM、嵌入和文档存储集成到其应用程序中。

vllm-project/compressed-tensors

一个扩展 safetensors 格式的库,旨在为各种 LLM 压缩和量化方案提供统一的存储和管理系统。

aiplan4eu/unified-planning

一个用于以与规划器无关的方式建模和求解自动化规划问题的 Python 库,支持多种求解器和 PDDL 格式。

sophgo/LLM-TPU

LLM‑TPU 是 SOPHGO 的开源项目,可将 HuggingFace 的 LLM 与视觉语言模型编译为与 SOPHGO TPU 相兼容的 bmodels。它支持一键编译、丰富的量化模型目录、动态/KV‑cache 推理、多芯片扩展以及为 BM1684X、BM1688 和 CV186X 芯片提供现成的 Python/C++ demos。

shlokkhemani/rabbithole

一个允许用户在现有内容的任意点通过提问分支到新文档的无限学习画布。

jd-opensource/JoySafeter

一个用于构建和编排安全代理的AI原生平台,可自动化复杂任务,如漏洞分析和渗透测试。

elder-plinius/GL4SS

一个时空影像与视频引擎,能够从 2.52 亿年前到公元 3050 年,生成地球上任何地点在任何时间点的 AI 视觉效果。

microsoft/Tutel

Tutel 是 Microsoft 开源的高性能 MoE 库,适用于大型语言模型。它提供动态并行、低精度推理(NVFP4、MXFP4、FP8、BF16)、支持高达 1M token 的上下文,以及视觉扩展功能,并提供 Docker 镜像来运行 DeepSeek-V3.2、Kimi-K3、GLM-5.x、Qwen-3 和 GPT-OSS 等模型,支持 NVIDIA 和 AMD GPU。可以通过 pip 从 Git 仓库安装,或从源码构建,然后运行提供的 Docker 容器,或使用 Python API 进行自定义 MoE 路由。

IDEA-CCNL/Fengshenbang-LM

一个开源的中文预训练基础模型生态系统,以及用于自然语言理解、生成和多模态任务的支持框架。

Core-Mate/OpenGUI

一个用于 Android 的移动 GUI 代理框架,使 AI 代理能够在真实设备上感知并操作应用界面,实现复杂、长期运行的自动化工作流。

istupakov/onnx-asr

一个用于自动语音识别 (ASR) 的轻量级 Python 包,使用 ONNX 模型,无需 PyTorch 或 Transformers 即可在边缘和服务器硬件上实现快速部署。

cyberofficial/Synthalingua

一款用于将直播、麦克风音频和视频文件实时转录并翻译成英语及其他语言的自托管 AI 工具。

AudarAI/Audar-ASR-V1

一套以阿拉伯语为首要目标的生成式语音识别模型家族,可为方言阿拉伯语和代码切换语音提供业界领先的转录性能。

janvarev/Irene-Voice-Assistant

一款默认离线运行的俄语语音助手,支持可扩展的插件和基于 LLM 的自然语言命令处理。

cmusphinx/pocketsphinx

PocketSphinx 是一个开源、离线的语音转文本引擎(C 库,带 Python 绑定),可在低资源设备上高效运行。它提供命令行工具和 API,用于识别或对齐音频,并将结果输出为 JSON 格式。