Deep-MI/FastSurfer
一种基于深度学习的快速神经影像处理流程,用于脑部 MRI 图像的体积和基于表面的厚度分析,作为 FreeSurfer 的高速替代方案。
yzfzzz/depth-detect
一个高性能 C++ 和 TensorRT 框架,融合 YOLO 物体检测与单目/双目深度估计,用于实时追踪物体并估算其运动状态。
prov-gigapath/prov-gigapath
一种用于数字病理学的全切片基础模型,采用切片与全切片编码器架构,用于分析巨大的病理图像。
Stevenic/vectra
一个支持元数据过滤、余弦相似度和本地或基于 API 的嵌入的本地文件后端内存向量数据库。
Compresr-ai/Context-Gateway
一个位于 AI 代理与 LLM API 之间的代理,可在后台压缩对话历史,防止达到上下文限制时出现延迟。
princepainter/ComfyUI-PainterI2V
一个 Wan2.2 用的 ComfyUI 节点,通过增加运动幅度并提升相机运动响应性,解决图像到视频生成中的慢动作问题。
david8862/keras-YOLOv3-model-set
一个全面的 TensorFlow Keras 流水线,支持 YOLOv2、v3 和 v4 物体检测,涵盖多种骨干网络、高级训练技术,并支持设备端部署。
ucinlp/autoprompt
一种使用梯度引导搜索自动为掩码语言模型生成优化提示的自动化提示生成工具,用于执行 NLP 任务。
mlcommons/ck
一个面向 AI/ML 研究的社区驱动型自动化框架,可在不同的硬件、软件和数据集之间实现可复现且可移植的工作流。
uxlfoundation/oneDAL
一个 C++ 和 DPC++ 库,为 CPU、GPU 和分布式系统上的表格数据提供硬件加速的机器学习例程。
bytedance/vidi
用于视频理解和创作的大规模多模态模型 (LMM) 系列,能够实现时间检索、时空定位和自动视频编辑等任务。
aryn-ai/sycamore
一个用于 ETL 和 RAG 的 AI 驱动文档处理引擎,可将非结构化文档转换为向量数据库使用的高质量数据分块。
talmolab/sleap
一个利用人机协同 GUI 快速标注并量化动物行为的多动物姿态追踪深度学习框架。
linkedin/venice
专为行星规模工作负载设计的派生数据存储平台,通常用作机器学习特征存储的状态后端,以实现低延迟的在线推理。
jingkaihe/matchlock
一个 CLI 工具和 SDK,通过 MITM 代理实现网络允许列表和安全密钥注入,在隔离的临时 microVM 中运行 AI 代理。
tidyverse/ellmer
一个使 R 语言轻松使用大语言模型的包,支持广泛的提供商以及流式传输和工具调用等功能。
orbital-materials/orb-models
用于分子和晶体的快速、高精度原子模拟的预训练神经网络势能库,替代昂贵的DFT计算。
chennuo0125-HIT/LIO-SAM_based_relocalization
基于 LIO-SAM 的重定位系统,使机器人能够在先前保存的地图中确定自身位置。
hackingmaterials/matminer
一个用于材料科学的数据挖掘库,提供检索数据集和为分析进行材料数据特征化的工具。
cgnomads/GSOPs
一个 SideFX Houdini 插件,为 VFX 生产提供全面的高斯点云场景导入、编辑和动画工具集。
f-dangel/backpack
通过在反向传播过程中重用信息,高效计算标准梯度之外的量(如单样本梯度和梯度方差)的 PyTorch 扩展。
francescofugazzi/3dgsconverter
一款高性能工具,支持在多种格式间转换3D高斯溅射文件,并具备GPU加速过滤和压缩功能。
krishn404/Git-Friend
一个 AI 驱动的 GitHub 助手,提供 Git 帮助的 AI 聊天、自动 README 生成和 Gitmoji 支持,以简化仓库管理。
scikit-tda/scikit-tda
一组专为非拓扑学家设计的拓扑数据分析(TDA)Python 库,旨在让拓扑数据工具更易于使用。
PKU-Alignment/safety-gymnasium
一个可扩展且可定制的安全强化学习基准库,提供标准化的环境集,用于评估安全约束下的 AI 智能体。
Samsung/ONE
ONE 是一个高性能的设备内神经网络推理框架,可使 TensorFlow 和 PyTorch 的 AI 模型在各种硬件加速器上高效运行。
sambanova/bloomchat
BLOOMChat 是一个从开源 BLOOM 模型微调而来的 1760 亿参数多语言聊天 LLM。该仓库提供了数据准备、分词和训练脚本(后者用于 SambaNova 的 RDU 硬件),以及使用 Hugging Face 的 Bloom 推理代码的详细 GPU 推理说明。这是一个真正的大规模 LLM 项目,旨在帮助研究人员和开发者复现或运行该模型。
deepgenteam/deepgen
DeepGen 1.0 是一个轻量级 5B 参数统一多模态模型,将图像生成、编辑和推理整合到一个框架中。
remyxai/VQASynth
一个将图像数据集转换为空间 VQA 数据集的流水线,以提升视觉-语言模型的 3D 空间推理和距离估计能力。
matiasdelellis/facerecognition
一个为 Nextcloud 设计的面部识别应用,可在本地检测、分析并分组图像中的人脸,实现私密的基于人物的照片组织。
ZimoLiao/scholaraio
为专业研究和学术写作提供结构化证据、库管理与可重复工作流的 AI 代理学术 harness。
FaceAISDK/FaceRecognition_ReactNative
一个 React Native 演示和集成指南,用于支持 iOS 和 Android 上 1:1 验证和活体检测的离线人脸识别 SDK。
mlverse/torch
一个将 PyTorch 功能引入 R 生态系统的 R 包,支持机器学习中的张量操作和自动微分。
maquina-app/rails-mcp-server
一个 Ruby 实现的 Model Context Protocol (MCP) 服务器,允许 LLM 通过结构化工具和文档分析并与 Rails 项目进行交互。
TheAuditorTool/Auditor
一个本地、以数据库优先的代码智能和 SAST 平台,将代码库转化为可查询的事实,以降低 AI 代理和安全团队的令牌成本。
AutoLab-SAI-SJTU/Paper2Rebuttal
一个由 AI 驱动的多智能体系统,帮助研究人员分析审稿人评论、搜索支持文献并起草正式的学术论文反驳意见。
whitzard-ai/jade-db
JADE 是一个利用语言变异生成高风险数据集,用于测试 LLM 和 AI 代理安全防护机制与对齐性的安全评估平台。
SciML/Catalyst.jl
用于化学反应网络和动力系统高性能仿真与分析的符号建模包。
DataDog/toto
一个针对可观测性指标优化的多变量时间序列预测基础模型,提供零样本和概率预测。
OpenGVLab/VideoChat-Flash
VideoChat-Flash 是一种用于高效处理长达三小时的长上下文视频的多模态大语言模型,采用分层压缩技术。
polyaxon/traceml
一个与主要深度学习框架深度集成的 ML 和数据追踪、可视化与可解释性引擎,用于记录指标、输入和制品。
brontoguana/krasis
一个 LLM 运行时,通过管理 VRAM 和 CPU RAM 之间的专家驻留,使得在消费级 NVIDIA GPU 上运行庞大的混合专家模型成为可能。
WenjieDu/SAITS
一种基于自注意力机制的多变量时间序列插补框架,解决了 RNN 基础模型的速度和内存问题
echoVic/orca-agent
一个原生支持 DeepSeek 的终端编码代理,能够读取代码、编辑文件并运行命令,自主解决开发任务。
milvus-io/milvus-sdk-java
一个用于 Milvus 的 Java 客户端库,使 Java 开发者能够将其向量数据库功能集成到 AI 应用中。
nihui/zimage-ncnn-vulkan
一个基于 ncnn 的便携式 Z-Image 生成器实现,可在任何支持 Vulkan 的 GPU 上实现高性能图像生成、图像修复和 ControlNet 支持。
kanadeblisst00/wechat_ocr
一个允许用户调用 WeChat Windows 客户端内置本地 OCR 模型来对图像进行文本识别的 Python 库。
kyegomez/VisionMamba
Vision Mamba是一种双向状态空间模型,用于高效视觉表示学习,其速度显著快于传统视觉Transformer,且内存效率更高。