ys1231/appproxy
一个基于 tun2socks 的轻量级 Android VPN 代理工具,支持按应用代理,并可通过 Model Context Protocol (MCP) 进行远程控制。
richhickson/claudecodeusage
一款轻量级的 macOS 菜单栏应用,用于追踪 Claude Code 使用限制,并在 AI 代理会话需要用户关注时提供通知。
ww-w-ai/bkit-claude-code
一个将 AI 原生开发转变为结构化系统的 Claude Code 插件,支持上下文预算冲刺、多代理编排和自动化质量验证。
AnswerDotAI/gpu.cpp
一个通过 WebGPU 实现 GPU 计算的轻量级 C++20 接口,简化了在原生和浏览器环境之间进行着色器分派和数据移动的流程。
reczoo/FuxiCTR
FuxiCTR 是一个开源的 Python 库(PyPI 包),用于点击率预测。它集成了 40 多个现代 CTR 模型——包括经典的因子分解机类模型和近期的序列感知架构——并分别在 PyTorch 和 TensorFlow 上实现。该库强调可配置性、自动超参数调优、可复现的基准测试以及易扩展性,适用于从事广告、推荐或赞助搜索系统的研究人员和工程师。
InternScience/GraphGen
一个使用知识图谱生成知识驱动合成数据的框架,以填补大型语言模型(LLM)中的知识空白,从而改善监督微调。
ttttccxxui/DataInfra-RedactionEverything
一个本地优先的文档匿名化工作台,利用语义NER和视觉定位技术,从非结构化文件中删除敏感文本和视觉元素。
tensorflow/cloud
一组 API,可让开发者轻松地将 TensorFlow 和 Keras 模型训练从本地环境迁移到 Google Cloud Platform 上的分布式训练和调优。
skilld-dev/skilld
一个为跨多个平台的 AI 代理提供人类创作技能发现、安装和管理的精选注册表和 CLI。
JayJokerr/arknights-pixel-autofill
一款 Windows 实用工具,可将图像转换为 40 色调色板,并通过计算机视觉和鼠标自动化,在《明日方舟》中自动填充 24x24 像素艺术画布。
aws/aws-sdk-pandas
一个 Python 库,提供 pandas DataFrames 与各种 AWS 服务之间的简易集成,简化了数据湖与数据库的数据移动和管理。
mljar/mercury
一个将 Python 笔记本转换为交互式 Web 应用的框架,允许用户直接从 .ipynb 文件部署聊天、AI 代理和仪表板。
kokkos/kokkos
一种 C++ 编程模型和核心库,使性能可移植应用能够高效地在所有主要 HPC 平台运行。
meta-pytorch/torchtune
torchtune 是一个基于 PyTorch 的库,提供多种现代大语言模型(Llama、Gemma、Qwen、Phi 等)的微调、RL-HF、蒸馏、量化感知训练和推理的即用型配方与配置。它通过简单的 CLI(`tune`)和 YAML 文件抽象了分布式训练、内存优化技巧和设备支持,与 Hugging Face、torch-ao、FSDP2 和日志工具集成。尽管 2025 年开发已停止,但它仍是 LLM 实验的实用、开源工具包。
marqo-ai/marqo
一个使用语义搜索和个性化技术来提升在线品牌产品发现与转化率的AI原生电商搜索平台。
owlbarn/owl
为 OCaml 设计的综合科学计算系统,为高性能分析代码提供 n 维数组、线性代数和深度学习功能。
octos-org/octos
用 Rust 编写的可嵌入式 AI 代理调度内核,提供代理驱动应用所需的执行循环、内存和协调基础设施。
MushroomRL/mushroom-rl
MushroomRL 是一个模块化的 Python 强化学习库,提供广泛的经典和深度 RL 算法,并与流行的张量库和基准集成。
alvarobartt/hf-mem
hf-mem 是一个轻量级的 Python CLI(及库),用于估算运行任何使用 Safetensors 或 GGUF 权重的 Hugging Face 模型所需的 RAM。它仅通过 HTTP range 请求获取元数据,支持 Transformers、Diffusers、Sentence-Transformers,并可选择性地估算 KV-cache 内存和 MoE 分解。可以作为独立工具、Hugging Face CLI 扩展或 Agent 技能进行安装。
PrimeIntellect-ai/prime-diloco
一个用于在互联网上高效、全球分布式训练 AI 模型的框架,具备容错通信和优化网络带宽利用的特点。
bold-lab-ai/JaxMARL
一个用于多智能体强化学习的 JAX 原生库,提供 GPU 加速环境和基准算法,用于高效基准测试。
EleutherAI/sparsify
一个轻量级库,用于在 HuggingFace 语言模型激活上训练和加载 k-稀疏自编码器(SAE)和转码器,以促进机制可解释性研究。
EXboys/evotown
一个面向企业级 AI 代理的私有控制平面,统一管理跨不同本地代理运行时的模型路由、技能分发与知识管理。
OpenRouterTeam/ai-sdk-provider
一个用于 Vercel AI SDK 的 OpenRouter 提供者,通过统一接口访问超过 300 种 LLM 和嵌入模型。
TheAuditorTool/Auditor
一个本地、以数据库优先的代码智能和 SAST 平台,将代码库转化为可查询的事实,以降低 AI 代理和安全团队的令牌成本。
google/orbax
一个用于 JAX 模型的检查点和持久化库,能够实现模型状态的高效保存和恢复,包括对异步检查点的支持。
kacper-daftcode/vLLM-Moet
vLLM‑Moet 是 vLLM 的一个修补分支,增加了 2‑bit 专家量化、FP4 恢复、分层 GPU/主机/NVMe 专家存储以及推测解码功能,旨在在消费级 RTX PRO 6000 或 RTX 5090 GPU 上运行超大规模 MoE 模型(例如 753 B GLM‑5.2)。它提供 Docker 镜像、自定义 SM 120 内核以及一系列可配置参数,以平衡内存、速度与质量。
i207M/PINNacle
一个针对物理信息神经网络(PINN)的全面基准,实现了多种变体和一个具有挑战性的数据集,用于评估其在求解偏微分方程方面的性能。
qdrant/rust-client
一个原生 Rust 客户端,可在 Rust 应用程序中实现高性能向量搜索和数据库管理。
chalk-lab/Mooncake.jl
一个用于 Julia 的高性能自动微分包,支持变异并利用优化的中间表示进行高效的微分计算。
pzqpzq/LSF_MDia
MDia 是一个 Python 库,将 LLM 的中间推理形式化为可重用的“方言卡”(LSF),并提供一个确定性的八阶段流水线(collect → create → evolve → profile → select → run → validate-rules → report),用于在异构模型间生成、演化、分析、路由和审计这些协议。它支持黑盒 LLM API,提供多种路由计划,包含 100 条规则库,并通过在测试评估前冻结决策来保证可复现性。该仓库包含一个无需任何 API 密钥的玩具离线演示、详尽的文档、MIT 许可证,以及对 ICML 2026 海报和 arXiv 论文的引用。
hustcer/deepseek-review
一个使用 DeepSeek 模型通过 GitHub Actions 或本地 CLI 自动化 PR 审查的 AI 驱动代码审查工具。
simonw/llm-openrouter
一款适用于 LLM CLI 工具的插件,可让您访问 OpenRouter 托管的各类 AI 模型,并支持视觉、结构化输出和托管服务器工具。
xiaol/wkvm
专为线性及混合线性模型设计的状态原生推理虚拟化平台,用固定大小的状态槽替代分页 KV 缓存,实现高效的会话管理
taketwo/llm-ollama
一个为 LLM CLI 工具开发的插件,可与本地、远程或基于云的 Ollama 服务器上托管的模型进行交互。
microsoft/microxcaling
一个支持 MX 兼容格式和 bfloat 量化的 PyTorch 模拟库,使数据科学家能够探索低精度数值格式对 DNN 的影响。
wisent-ai/ster
一个用于开放权重 Llama 模型激活引导和 LoRA 微调的原生 Rust 工具包,旨在控制模型的行为和特征。
gergap/vim-ollama
一个使用 Ollama 在本地执行 LLM 并保障隐私的 Vim 插件,为 Vim 带来类似 Copilot 的 AI 代码补全、聊天和基于工具的编辑功能。
IBM/prompt-declaration-language
一种基于 YAML 的声明式语言,用于创建可靠、可组合的 LLM 提示,并支持控制流和代码执行,可轻松集成到软件系统中
hermes-hq/hermes-ide
一款集成项目感知 AI 协助的 AI 原生终端模拟器,可预测命令、解决错误并自主执行任务。
hongjin-he/MicroWorld
一种用于量化金融的世界模型架构,将市场参与者建模为博弈中的代理,以预测去噪后的均衡价格并检测制度不稳定性。
TryCaspian/caspian-sdk
一个为 AI 代理提供统一接口的通信 SDK,使其能够通过单一处理器在 Slack、Discord、Telegram 等多个渠道与人类交互。
JuliusBrussee/cavemem
一种用于代码助手的跨代理持久记忆系统,利用压缩本地存储和MCP,使AI代理能够在会话间保持信息记忆。
google/edward2
一种简单的概率编程语言,允许用户将模型定义为程序,并操作其计算以实现灵活的训练和推理。
Trans-N-ai/swama
基于 Apple 的 MLX 框架的高性能 Swift ML 运行时,可在 macOS 上实现 LLM、VLM 和音频模型的本地推理。
digantamisra98/Mish
Mish 是一种自正则化的非单调激活函数,通过创建更平滑的损失曲面来提升深度神经网络的准确率和优化性能。
google-gemini/genai-processors
一个轻量级的 Python 库,用于构建模块化、异步且可组合的 AI 流水线,统一多模态内容处理和流式传输。
jjang-ai/mlxstudio
一款在 Apple Silicon 上使用 MLX 框架本地运行 LLM、VLM 与图像生成模型的原生 macOS 桌面应用。