mhahsler/dbscan

一个 R 包,提供基于密度的聚类算法(如 DBSCAN 和 HDBSCAN)的快速 C++ 实现,用于空间数据分析和异常值检测。

autogluon/autogluon-assistant

一个多智能体系统,自动化端到端的多模态机器学习工作流,无需人工干预即可将原始数据转化为 ML 解决方案。

Mengqi97/chinese-medical-dataset

一个为医疗问答、实体识别和知识图谱构建等任务提供支持的开源中文医疗数据集的精选集合,旨在推动医疗AI的发展。

dmlc/XGBoost.jl

一个为回归、分类和排序任务提供可扩展且高效的分布式梯度提升框架的 Julia 接口。

GamePhanesStudio/GamePhanes

一个针对编码代理的基准测试,通过在多个游戏引擎中验证实际运行时行为,评估其构建、调试和修复交互式游戏的能力。

microsoft/archai

一个通过优化延迟和内存等目标来加速神经架构搜索(NAS),以生成高效深度网络的框架。

ErosZy/sablejs

一种快速的 AOT 编译型 JavaScript 沙箱,用于执行用户编写的或由 AI 生成的代码,具备安全隔离和源映射调试功能。

kdcokenny/opencode-worktree

一个 OpenCode 插件,可自动创建 Git worktree 并启动专用终端,让 AI 代理在隔离环境中工作。

datalorax/equatiomatic

一个将拟合的统计模型自动转换为 LaTeX 方程的 R 包,减少撰写研究论文时编写数学公式的手动工作量。

guillermo-navas-palencia/optbinning

一个使用数学规划来优化连续变量分箱的 Python 库,以提升预测模型和评分卡的特征工程效果。

r-causal/ggdag

一个 R 包,通过将 dagitty 与 tidyverse 和 ggplot2 集成,用于可视化和分析因果有向无环图(DAG)。

welch-lab/liger

LIGER 是一个使用整合性非负矩阵分解来整合和分析多个单细胞数据集的包,以识别共享和数据集特异性因子。

NaturalIntelligence/imglab

一个支持 COCO 和 Pascal VOC 等格式的网页图像标注工具,用于创建对象检测器的训练数据。

jpmml/sklearn2pmml

一个将 Scikit-Learn 管道转换为 PMML 格式的 Python 包,以提高模型在不同环境中的可移植性和部署能力。

ysig/GraKeL

一个 Python 库,提供统一框架,包含 16 种不同的图核,用于在机器学习中测量图之间的相似度。

oxylabs/headless-browser

一个基于云的无头浏览器基础设施,提供集成住宅代理和自动验证码解决功能,适用于复杂网页抓取和自动化场景。

seratch/ChatGPT-in-Slack

一个连接到 OpenAI 的 ChatGPT(以及 DALL‑E 3)的 Slack 应用,允许用户在频道线程、私信或主页标签中聊天、校对和生成图像。它可通过环境变量配置,使用 Docker 在 Socket Mode 下部署,并支持可选的 Azure OpenAI。

JuliaStats/MultivariateStats.jl

一个用于多变量统计与数据分析的 Julia 包,提供降维与回归工具。

dell/omnia

Omnia 是 Dell 开发的开源 Ansible 基础工具包,可自动配置 Linux 服务器、安装驱动程序,并部署 Slurm 或 Kubernetes 以及 AI/ML 框架。它简化了 HPC 或本地 AI 集群的构建,采用 Apache 2.0 许可证,由包括 Dell、Intel、大学及其他合作伙伴在内的社区积极维护。

r3bl-org/r3bl-open-core

一个纯异步、即时模式响应式 Rust TUI 框架,为终端应用带来了类似 Web 的布局和样式易用性。

ussumant/llm-wiki-compiler

一个 Claude Code 和 Codex 插件,能将分散的 markdown 文件和代码库编译成综合的、基于主题的 wiki,以降低 AI 代理的上下文成本。

wangdabaoqq/LinJun

CLIProxyAPI 的跨平台桌面管理器,集中管理 AI 账户、配额追踪和 AI 编码代理配置。

BayraktarLab/cell2location

一个整合单细胞和空间转录组数据的贝叶斯模型,用于在组织结构中映射细粒度细胞类型及其丰度。

eamid/trimap

一种利用三元组约束保留高维数据全局结构的降维方法,相比 t-SNE 或 UMAP 提供更优的全局视图。

yu-xin-c/Sea-mult-agent

一个专注于论文复现、自定义数据基准测试以及预算约束下超参数与方法优化的多代理系统,用于自动化科学研宄。

oxylabs/AI-Search-py

一个基于 Python 的搜索代理,允许开发人员使用自然语言搜索网络,并自动抓取结果中的内容,包括对 JavaScript 渲染的支持。

mattn/go-tflite

一个用于在 Go 应用程序中执行预训练 ML 模型的 TensorFlow Lite Go 语言绑定。

vivy-company/aizen

适用于 macOS 的代理优先型开发者工作区,支持开发者在隔离的终端、浏览器和 AI 代理会话中并行运行多个项目和分支。

IBM/lale

一个用于半自动化数据科学的 Python 库,可为 scikit-learn 兼容的管道自动执行算法选择和超参数调优。

kengz/SLM-Lab

一个用于深度强化学习的模块化 PyTorch 框架,允许用户通过 JSON 规范在各种 Gymnasium 环境中配置并运行 RL 实验。

EuniAI/Prometheus

一个利用多代理系统和知识图谱自动化 bug 修复、功能实现和代码库导航的 AI 驱动软件工程平台。

AgnostiqHQ/covalent

一个 Python 库,抽象化基础设施管理,使 AI/ML 和科学计算代码只需一行代码即可在任何云或本地集群上运行。

alexander-zuev/supabase-mcp-server

一个让 AI IDE 能够安全执行 SQL、管理模式并处理 Supabase 项目认证的 MCP 服务器。

ntucllab/libact

一个提供多种查询策略和元算法以自动选择最佳策略的池化主动学习 Python 包。

lonr-6/cc-desktop-switch

一个轻量级桌面应用,让 Claude Desktop 用户通过本地网关管理并切换第三方 Anthropic 兼容 API 提供商。

caspianmoon/memoripy

一个证据优先的本地记忆体运行时,适用于 AI 代理,可防止噪音摄取,并提供可验证的双时态记录与检索收据。

alinaqi/maggy

一个为 Claude Code 设计的工程工具链,通过多模型路由、TDD 强制和持久化架构记忆,构建一个自我审查的 AI 开发系统。

google/seqio

一个为序列模型提供统一框架的任务型数据集、预处理和评估的顺序数据处理库。

canwhite/AgentEval

一个透明的 HTTP 代理,用于捕获 Agent-LLM 通信,以实现 AI 代理评估的自动评分、行为诊断和源码探查。

pgvector/pgvector-node

一个 JavaScript/TypeScript 客户端库,使 Node.js、Deno 和 Bun 应用程序能够使用 pgvector PostgreSQL 扩展来存储和查询向量嵌入。

GeorgesAlkhouri/nvim-aider

一个将 Aider AI 伙伴程序员集成到 Neovim 的插件,使用户能够直接从编辑器向 AI 发送缓冲区、诊断信息和文件。

facebookresearch/PhysicsLM4

一个研究型仓库,实现LLM和线性模型的Canon层,以改进架构设计和知识存储,包含合成数据生成器和预训练配方。

GFNOrg/torchgfn

一个用于 GFlowNets 的 Python 包,提供了一个解耦的框架,用于原型设计算法,包括各种环境、损失函数和采样策略。

JayantDevkar/claude-code-karma

一个本地优先的仪表板,从本地 JSONL 文件中读取 Claude Code 会话数据,提供成本、令牌使用量和工具活动的分析。

papercomputeco/tapes

一个为内容寻址的 LLM 交互提供持久化存储和 OpenTelemetry 仪器化的代理遥测系统。

Arch1eSUN/Arcgentic

为 Codex 和 Claude Code 设计的哈希工程层,将 AI 编码转变为具有规划、开发和审计等专业角色的门控工作流。

Optimization-AI/LibAUC

一个用于直接优化复杂性能指标(如 AUROC、AUPRC 和 NDCG)的深度学习库,适用于不平衡数据和排序任务。

zaina-ml/ml_forge

一个无需编写代码即可通过拖拽界面构建、训练和运行图像分类模型的可视化 PyTorch 流水线编辑器。