Odevio/Odevio-CLI

一款 CLI 工具,使 AI 代理能够在远程 Mac 上构建和发布 Flutter iOS 应用,无需本地 Mac 硬件或 iOS 生态系统专业知识。

microsoft/azurechat

一个用于在 Azure 订阅中使用 Azure OpenAI Service 部署私有、安全 AI 聊天租户的解决方案加速器,具备数据集成和企业级安全功能。

ShenhanQian/VHAP

VHAP 是一个用于人头对齐的光度优化管道,利用自适应外观先验来追踪单目和多视角视频中无特征点的区域,如头发和耳朵。

meilisearch/arroy

一个使用 LMDB 实现低内存、内存映射向量索引与检索的 Rust 库。

stochasticai/xTuring

一个利用 LoRA 和 INT4/INT8 量化等高效技术,实现开源 LLM 私有微调、评估和运行的框架。

open-gigaai/giga-models

GigaModels 是一个开源 Python 工具箱,将数十个预训练的视觉、扩散和多模态模型(例如:Grounding DINO、Depth Anything、GigaBrain‑0、Pi0、Cosmos‑Predict2.5)封装在统一的 `load_pipeline` API 之后。它支持推理和训练,提供即用型脚本,并可通过 conda + pip 安装。

open-gigaai/giga-train

GigaTrain 是一个可扩展的训练框架,通过自动化分布式训练、日志记录和检查点,简化了大型 AI 模型的开发。

megagonlabs/ginza

一个基于 Universal Dependencies 的开源日语 NLP 库,提供高精度的分词、句法分析和命名实体识别。

securefederatedai/openfederatedlearning

一个 Python 框架,允许组织在不共享原始数据的情况下,协作训练和验证机器学习模型,适用于敏感数据场景。

CryptoDmitry/Ghost-Agent

一个为 LLM agent 提供统一运行时的系统,用于执行结构化工具调用链,其特点是与 Solana 区块链深度集成,并支持 Model Context Protocol (MCP)。

tinyflow-ai/tinyflow

Tinyflow 是一个轻量级 AI 代理编排组件,通过框架无关的 UI 和多语言后端支持,使开发者能够将代理能力集成到传统应用程序中。

WorksApplications/sudachi.rs

Sudachi 日语形态分析器的高性能 Rust 实现,用于高效处理日语文本的分词与语法分析。

jacbz/Lofi

一种利用 VAE 模型将音乐轨道表示并生成为特征向量的机器学习支持的 lo-fi 音乐生成器。

lartpang/PySODMetrics

一个轻量级的 Python 库,用于计算显著对象检测(SOD)指标,提供比 Matlab 基础评估工具箱更快且可验证的替代方案。

naruya/gaussian-vrm

一个three.js实现,可让现实感强、可动画的3D角色在Web、移动和VR应用中渲染。

worldcoin/open-iris

利用计算机视觉和机器学习技术,实现安全生物识别验证与大规模唯一性确认的高级虹膜识别流水线。

facebook/FAI-PEP

一个与框架和后端无关的基准测试平台,用于比较 ML 推理运行时指标,并检测各种硬件与软件环境中的性能衰退。

huangzh13/StyleGAN.pytorch

一个用于生成高分辨率现实主义图像的原始 StyleGAN 架构的历史性 PyTorch 实现。

MrGiovanni/SyntheticTumors

一种用于生成逼真合成肿瘤以训练AI分割模型的框架,减少对人工标注医学影像数据的依赖。

richawo/minimal-llm-ui

一个用于 Ollama 的极简 Web 界面,允许用户与本地 LLM 聊天、保存对话历史,并在对话中切换模型。

TutoriaLLM/TutoriaLLM

一个专为 K-12 教育设计的自托管编程学习平台,允许创作者构建并从中学习教育内容。

autogluon/autogluon-assistant

一个多智能体系统,自动化端到端的多模态机器学习工作流,无需人工干预即可将原始数据转化为 ML 解决方案。

MemTensor/skills-vote

一个代理技能生命周期治理框架,提供即时推荐、基于归因的反馈以及可复用技能库的演进。

Mengqi97/chinese-medical-dataset

一个为医疗问答、实体识别和知识图谱构建等任务提供支持的开源中文医疗数据集的精选集合,旨在推动医疗AI的发展。

huggingface/huggingface-gemma-recipes

一套用于实现 Gemma 模型家族的多模态推理、微调和 RAG 的最小化配方与笔记本集合。

microsoft/project-oagents

一个基于 Semantic Kernel 和 Orleans 构建的带有主见性的 .NET 框架,用于创建和托管事件驱动的 AI 代理。

dmlc/XGBoost.jl

一个为回归、分类和排序任务提供可扩展且高效的分布式梯度提升框架的 Julia 接口。

MrGiovanni/AbdomenAtlas

通过人机协同 AI,提供大规模多器官 CT 数据集和工具集,将腹部分割的标注时间从数十年缩短至数周。

GamePhanesStudio/GamePhanes

一个针对编码代理的基准测试,通过在多个游戏引擎中验证实际运行时行为,评估其构建、调试和修复交互式游戏的能力。

microsoft/XPretrain

XPretrain 是 Microsoft Research 的一个仓库,它为视频-文本和图像-文本对的大规模多模态预训练提供了代码、预训练权重和 HD-VILA-100M 视频-语言数据集。它包含了 HD-VILA、LF-VILA、CLIP-ViP、Pixel-BERT、SOHO 和 VisualParsing 等模型,每个模型都与近期的会议论文相关联。

foo123/FILTER.js

一个纯 JavaScript 图像和视频处理及计算机视觉库,支持通过 WebGL、WebAssembly 和 Web Workers 实现硬件加速。

OliverDOU776/Few-step-probabilistic-glucose-forecasting-from-continuous-glucose-monitoring-and-meal-images

一种利用条件化修正流将大规模源数据集的知识迁移到小规模目标数据集的快速概率预测工具。

bolderflight/invensense-imu

一个用于与Invensense MPU-6500和MPU-9250/9255 IMU通信的C++库,通过I2C或SPI轻松访问运动和磁场数据。

microsoft/archai

一个通过优化延迟和内存等目标来加速神经架构搜索(NAS),以生成高效深度网络的框架。

ROCm/legacy-rocm-build

ROCm / legacy‑rocm‑build 是(现已弃用的)仓库,用于组装 AMD 的开源 GPU 计算栈——驱动程序、HIP 运行时、数学库、性能分析工具等,使开发者可在 AMD GPU 上运行 AI/ML 工作负载。该仓库引导用户前往安装指南和更新的 TheRock 单体仓库。

Unity-Technologies/arfoundation-samples

一组官方 Unity 示例场景和代码,展示如何使用 AR Foundation 实现跨多平台的增强现实功能。

ErosZy/sablejs

一种快速的 AOT 编译型 JavaScript 沙箱,用于执行用户编写的或由 AI 生成的代码,具备安全隔离和源映射调试功能。

datalorax/equatiomatic

一个将拟合的统计模型自动转换为 LaTeX 方程的 R 包,减少撰写研究论文时编写数学公式的手动工作量。

jjazzboss/JJazzLab

JJazzLab 是一个开源应用程序,可根据和弦符号和选定的音乐风格生成包含鼓、贝斯、吉他和钢琴的真实、动态伴奏轨道。

guillermo-navas-palencia/optbinning

一个使用数学规划来优化连续变量分箱的 Python 库,以提升预测模型和评分卡的特征工程效果。

r-causal/ggdag

一个 R 包,通过将 dagitty 与 tidyverse 和 ggplot2 集成,用于可视化和分析因果有向无环图(DAG)。

welch-lab/liger

LIGER 是一个使用整合性非负矩阵分解来整合和分析多个单细胞数据集的包,以识别共享和数据集特异性因子。

Teycir/BurpAPISecuritySuite

一款专业级的 Burp Suite 扩展,提供自动化探测、智能模糊测试和 AI 就绪数据导出,用于检测 OWASP API Top 10 漏洞。

tidymodels/recipes

一个用于 R 语言特征工程与数据预处理的框架,使用可管道化的步骤序列来为机器学习模型准备数据。

pyushkevich/itksnap

ITK-SNAP 是一款开源软件应用程序,用于在医学图像中对解剖结构进行用户引导的 3D 活性轮廓分割。

qingmeng1/bilijump-ai

一个 Chrome/Firefox 扩展程序,使用基于 LLM 的字幕或音频分析来自动检测并跳过 Bilibili 视频中的广告片段,并提供可选的手动跳过、用户可编辑的广告时间戳,以及支持自定义 AI 端点。

tudelft-iv/view-of-delft-dataset

一个包含同步LiDAR、相机和3+1D雷达数据的多传感器汽车数据集,附带城市交通中道路使用者检测的3D边界框标注。

jingsewu/open-wes

一个开源的仓库执行系统(WES),利用机器人和物联网技术,为自动化仓库提供实时编排和AI驱动的优化。