docker/model-runner

一个通过 Docker 管理和部署 AI 模型的工具,通过 llama.cpp 和 vLLM 等后端简化 LLM 的拉取和提供流程。

pymc-devs/pytensor

一个用于定义和优化包含多维数组的符号数学表达式的 Python 库,作为 PyMC 的计算后端。

saidsurucu/borsa-mcp

一个为 LLM 提供 Borsa Istanbul、美国股票、TEFAS 基金和加密货币的实时与历史金融数据的 MCP 服务器,支持 AI 驱动的金融分析。

berabuddies/Semia

一种用于 AI 代理技能的安全审计工具,通过分析基于 Markdown 的技能来识别潜在安全风险,并在执行前提供基于证据的报告。

lightonai/next-plaid

一个将多个嵌入存储于每个文档的多向量搜索引擎(NextPlaid)和相应的语义代码搜索工具(ColGREP),通过保留多嵌入实现高精度检索

antgroup/vsag

用于相似性搜索的高性能 C++ 向量索引库,支持稀疏和密集向量的专用索引,并提供 Python 和 TypeScript 绑定。

motherduckdb/mcp-server-motherduck

一个 Model Context Protocol (MCP) 服务器,将 AI 助手连接至 DuckDB 和 MotherDuck,用于在本地、S3 和 MotherDuck 数据库上执行 SQL 分析和数据工程。

rsmdt/the-startup

一个为 Claude Code 设计的多代理 AI 框架,通过结构化规划和并行专业代理,实现以规范驱动的开发工作流,将想法转化为可交付的代码。

InternLM/WildClawBench

WildClawBench 是一个端到端的智能体基准测试,它测试 AI 智能体在实时环境中使用浏览器和 bash 终端等真实工具执行复杂现实世界任务的能力。

stevesolun/ctx

通过在真实任务上测试候选配置,自动分析仓库并应用最便宜、最可靠的 AI 编码配置的工具。

SharpAI/SwiftLM

一个为 Apple Silicon 设计的原生 Swift 推理服务器,通过兼容 OpenAI 的 API 提供 MLX 模型服务,具备 SSD 专家流式传输和 KV 缓存压缩功能。

NVIDIA/kvpress

KVPress 是一个由 NVIDIA 维护的 Python 库,提供了一套“压缩器”(presses)——用于压缩基于 Transformer 的大语言模型(LLM)的键值(KV)缓存。通过在提示词预填充阶段(以及可选的解码阶段)修剪或近似 KV 条目,KVPress 大幅减少了长文本推理所需的内存,从而实现更便宜、更快速的超长提示词生成。

theaniketgiri/create-llm

一个用于生成生产就绪的 LLM 训练项目的 CLI 工具,提供不同模型大小的模板以及从分词到部署的完整流水线。

neo4j-contrib/mcp-neo4j

一组 Model Context Protocol (MCP) 服务器,使 LLM 能够查询 Neo4j 数据库、管理 Aura 云实例,并维持持久的知识图谱记忆。

ultracontext/ultracontext

一个开源的实时上下文基础设施,可同步 AI 代理会话,使用户能够在不同 AI 工具间共享和版本化上下文。

philippgille/chromem-go

一个可嵌入、零依赖的 Go 向量数据库,无需独立数据库服务器即可实现 RAG 和语义搜索。

MiaAI-Lab/DeepSeek-v4-Flash-One-DGX-Spark

NVIDIA DGX Spark 上用于 DeepSeek V4 Flash 的单节点启动器,支持预测解码和高达 384k 令牌的上下文窗口,实现高吞吐量服务。

AaronWong1999/hermesclaw

一个轻量级 Python 代理,允许在单个 WeChat 账号上同时运行多个 AI 代理,包括 Hermes Agent、OpenClaw 和 OpenCode。

allenai/dolma

用于语言模型预训练的大型语料库筛选与清洗的高性能工具包和 3 万亿 token 开放数据集。

data-prep-kit/data-prep-kit

用于准备大型语言模型(LLM)预训练、微调和RAG应用的可扩展工具包,用于清理、转换和丰富非结构化数据。

PrimeIntellect-ai/prime

Prime Intellect 提供基于 Python 的 CLI 和 SDK,用于从命令行中配置云 GPU Pod、运行托管模型训练、管理已验证环境、推送评估结果,并与沙箱代码协作。

metarank/metarank

一个开源的排序服务,利用机器学习和 LLM 为搜索和推荐系统提供实时个性化和重排序功能。

fuji-mak/Capsomnia

一款 macOS 菜单栏应用,将 Caps Lock 键变为物理开关,用于在合上盖子时保持 MacBook 唤醒并持续运行进程。

cdxiaodong/cain-agent

一个用于授权安全评估的 AI 驱动渗透测试工程师,可自动化发现全球及中国云服务商中的业务逻辑缺陷和云配置错误。

akto-api-security/akto

一个开源的 API 安全平台,利用真实流量数据提供持续的 API 清单和业务逻辑漏洞测试。

lihongxun945/gobang

一个基于Minimax算法和Alpha-Beta剪枝的浏览器端五子棋AI,具备可调节难度和全面的性能评估套件。

narwhals-dev/narwhals

一个轻量级兼容层,使开发者能够编写不依赖 pandas、Polars 和 cuDF 等库的数据框无关代码,且无需将其作为依赖项。

durable-workflow/workflow

一个适用于 Laravel 的持久化执行运行时,允许长时间运行的 PHP 工作流保存状态,并在故障或重启后恢复执行。

scverse/spatialdata

用于处理和分析单模态及多模态空间组学数据集的通用数据框架和序列化格式。

aws-devtools-labs/aws-blocks

一个用于构建全栈 AWS 应用的后端工具包,允许开发者在部署到 AWS 之前,先在本地运行完整的后端。

alibaba/AliSQL

一个开源的 MySQL 分支,集成了用于高性能分析的 DuckDB 和用于 AI 应用的原生 HNSW 向量搜索。

PythonOT/POT

一个为机器学习、信号处理和图像处理中使用的最优运输问题提供广泛求解器的Python库。

wcandillon/react-native-webgpu

一个使用 Dawn 实现来为 React Native 应用提供 WebGPU 能力的库。

neo4j/graph-data-science

一个为 Neo4j 提供图算法、转换和机器学习流水线的图数据科学库,通过 Cypher 过程进行操作。

trueleaf/apiflow

支持本地优先使用和自托管的 AI 驱动免费替代 Postman 的 API 测试、模拟和协作工具。

JuliaGPU/GPUArrays.jl

一个面向开发者的 Julia 工具包,为在不同硬件后端上创建新的 GPU 数组类型提供标准化接口和可复用功能。

OpenMathLib/OpenBLAS

一个优化的基本线性代数子程序(BLAS)库,可在多种 CPU 架构上提供高性能的线性代数例程。

thomasahle/sunfish

一个简单、紧凑的基于 Python 的国际象棋引擎,专为实验搜索算法和神经网络评估而设计。

rbonghi/jetson_stats

一个为 NVIDIA Jetson 系列板卡提供实时硬件状态监控和系统管理的监控与控制包,可通过终端 UI 或 Python 库实现。

primocms/primo

一个面向开发者的 CMS,将客户使用的可视化浏览器编辑器与开发者的本地文件工作流同步,使 AI 代理能够直接编辑网站。

apioo/fusio

一个开源的 API 管理平台,可将业务逻辑和遗留数据库转换为可扩展的 API 产品和 AI 代理工具。

coder-hxl/x-crawl

一个使用 LLM 基于语义意义提取网页数据的 Node.js AI 辅助爬虫库,使爬虫对网站布局变化具有韧性。

psalias2006/gpu-hot

支持单机或多节点集群追踪的轻量级自托管实时 NVIDIA GPU 监控仪表盘

steedos/steedos-platform

一种使用通用元数据标准,通过文本描述即时生成企业级软件的 AI 原生基础设施。

spiculedata/saiku

一个开源的分析用语义层,支持拖拽式数据探索,并为 AI 代理提供类型化 API,使其无需编写 MDX 即可查询数据立方体。

SpikeInterface/spikeinterface

一个统一的 Python 框架,将多种电生理学工具和算法整合到一个代码库中,用于神经数据的分析。

invertase/docs.page

一个开源平台,可将公开的 GitHub Markdown 文件转换为现代、AI 就绪的文档网站,并内置 AI 聊天和 MCP 支持。

sadjow/claude-code-nix

一个自动更新、自包含的原生二进制 Claude Code Nix flake,用于声明式和可重现的安装。