NSHipster/sosumi.ai

sosumi.ai 是一个基于 Node 的服务,可将 Apple 开发者文档(包括 Swift 文档、HIG 和 WWDC 转录)转换为干净的 Markdown 格式,使 AI 模型和自动化工具易于使用。提供简单的 URL 重写、HTTP/MCP API、CLI、Chrome 扩展,并可在 Cloudflare Workers 或任何 Hono 兼容运行时环境中自托管。

databricks-industry-solutions/pixels

一个医学影像解决方案加速器,可摄入并索引 DICOM 文件,以实现基于 SQL 的元数据分析和使用 MONAI 的 AI 驱动图像分割。

bodo-ai/Bodo

一个高性能 DataFrame 库,作为 Pandas 的即插即用替代品,利用 MPI 和 JIT 编译加速 AI/ML 的大规模数据处理。

NyanNyanovich/nyan

一个从多个频道抓取内容、聚类相似帖子,并按可信度组织成可靠资讯流的 Telegram 新闻聚合器。

teest114514/chatlog_alpha

一款针对 WeChat 4.x 的本地聊天数据读取与自动化工具,可解密本地数据库和媒体文件,通过 API 和 TUI 提供结构化访问。

udecode/dotai

一个标准的共享可复用技能和工作流程库,用于编码代理,以标准化 PR 解决、目标跟踪和 TDD 等任务。

agiwhitelist/auteur

一个通过艺术指导、资产生成和严格反粗糙 linting 的纪律化流程,指导 AI Agent 创建电影级、高性能网站的 AI Agent 技能。

cltk/cltk

一个为前现代和历史语言量身定制的自然语言处理工具 Python 库,支持 LLM 和传统 NLP 后端。

SteveMacenski/spatio_temporal_voxel_layer

一种基于OpenVDB和时间衰减的高性能3D体素层,用于高效表示机器人导航中的动态环境。

0xgasless/agentkit

一个为 AI 代理提供托管钱包和无 Gas 稳定币支付能力的工具包,使其能够自主支付网络工具和服务费用。

Quantco/glum

一个高性能的 Python 库,用于广义线性模型(GLM),支持多种分布和正则化技术,具有类似 scikit-learn 的 API。

fastvideo/gpu-camera-sample

一个高性能 GPU 加速的相机应用程序,支持实时原始图像处理和 ISP 流水线,兼容多种工业相机。

rookiestar28/ComfyUI-OpenClaw

一个经过安全强化的 ComfyUI 扩展,增加了 LLM 辅助节点、远程管理控制台、自动化 HTTP API 以及聊天平台连接器(Discord、Telegram、WhatsApp 等),从而使 ComfyUI 可以被远程且安全地操作。

NyxFoundation/speca

一种通过从自然语言规范中推导安全属性,并验证代码是否证明这些不变性来发现漏洞的代理式安全审计框架。

ParisNeo/lollms-webui

一个统一的本地Web界面,用于访问数百个LLM和多模态AI模型,支持文本、图像、视频和音乐生成。

esbatmop/MNBVC

一个大规模开源中文语料库项目,旨在收集并提供总计253TB的多样化互联网文本和多模态数据,用于训练大规模AI模型。

pyro-ppl/numpyro

一个由 JAX 驱动的轻量级概率编程库,通过在 GPU/TPU/CPU 上进行 MCMC 和变分推论提供快速的贝叶斯推论。

aws/sagemaker-python-sdk

一个开源库,用于在 Amazon SageMaker 上训练和部署机器学习模型,支持主流框架和基础模型微调。

NVlabs/nvdiffrec

一种通过联合优化从多视角图像中提取三角形3D模型、材质和光照的可微分渲染框架。

FluxML/Zygote.jl

一个为 Julia 提供源到源自动微分的系统,可实现复杂函数和机器学习模型的梯度计算。

patched-codes/patchwork

一个自托管的 CLI 工具,通过可自定义的 LLM 辅助工作流,自动化 PR 审查、缺陷修复和安全补丁等开发任务。

yangheng95/PyABSA

一个统一各种情感分析子任务的训练、评估和推理流程的模块化框架。

plasma-umass/ChatDBG

一个基于 AI 的 C/C++/Python/Rust 调试助手,与 pdb、lldb 和 gdb 集成,实现自动根因分析并提出修复建议。

PyThaiNLP/pythainlp

一个全面的泰语自然语言处理库,提供分词、标注、转写和拼写纠正工具。

Stonesjtu/pytorch_memlab

pytorch_memlab 是一个 Python 库,可逐行分析 CUDA 内存使用情况,列出活跃张量,并能临时将 GPU 数据移至 CPU。它通过 `%mlrun` 魔法命令与 IPython/Jupyter 集成,帮助调试 PyTorch 模型中的内存不足错误。

qiskit-community/qiskit-machine-learning

一个为量子机器学习提供基础构建模块的库,能够实现量子核、神经网络以及混合量子-经典模型。

googleapis/python-aiplatform

Gemini Enterprise Agent Platform (原 Vertex AI) 的 Python SDK 使开发人员能够构建、部署和优化 AI 智能体、管理提示词并评估生成式 AI 模型。

SMTorg/smt

一个提供代理建模方法和采样技术集合的 Python 包,特别侧重于导数和梯度增强建模。

facebookresearch/ocean

Ocean 是一个用于在移动、桌面和 Meta Quest 等多种平台上构建计算机视觉和增强现实应用的 C++ 框架。

jamesrochabrun/SwiftOpenAI

一个用于轻松与 OpenAI API 及其他 OpenAI 兼容提供方交互的 Swift 包,支持文本、图像、音频和实时语音对话。

onnx/sklearn-onnx

一个将 scikit-learn 模型转换为 ONNX 格式的库,可借助 ONNX Runtime 实现高性能推理。

AgentTorch/AgentTorch

一个用于构建大规模人口模型(LPM)的 GPU 优化平台,可模拟数百万个相互作用的代理,以建模复杂的社 会动态。

truffle-ai/dexto

一个开放的代理手柄和编排层,将 LLM 转化为具有持久记忆、通过 MCP 实现工具集成,并内置生产就绪编码代理的状态化代理。

MioMioOS/MioIsland

Claude Code 的 macOS 原生伴侣,将代理状态监控和权限审批带入 Dynamic Island,并实现与 iPhone 的会话实时同步。

Ronchy2000/Multi-agent-RL

一个从基础算法到MADDPG、MATD3和HAPPO等高级多智能体系统的RL与MARL实现集合。

ldclabs/anda

一个用于构建可组合 AI 代理运行时的 Rust 框架,将模型、工具和记忆整合到一个统一的编排执行环境中。

jamjamjon/usls

一个基于 ONNX Runtime 的跨平台 Rust 库,可高效推理参数量低于 10 亿的视觉与视觉-语言模型。

Torsion-Audio/Scyclone

一款基于 RAVE 架构的神经音色转换(neural timbre transfer)音频插件,可实时转换音频信号的音质。

sh4den/Montscan

一个自动化文档处理器,通过 Ollama 使用本地 Vision AI 来分析扫描的 PDF,并自动以描述性文件名重命名它们。

redis/redis-vl-python

一个为生产环境准备的 AI 原生 Python 客户端,用于 Redis,提供向量搜索、混合搜索,以及用于 LLM 记忆和语义缓存的生产就绪扩展。

huisezhiyin/sdd-riper

SDD‑RIPER Light 是一个轻量、原生于仓库的框架,为基于 LLM 的编码代理添加控制平面。它定义了一个清晰的循环——重述目标、创建最小规格、等待人类审批、执行、用证据验证,并将结果同步回项目,使代理能安全、可审计、可恢复地修改代码。四个模块化“技能”(light、strict、codemap、new‑chat‑ready)覆盖日常任务、高风险工作、陌生代码库和交接场景。

huanchong-99/SoloDawn

SoloDawn 是一个开源 Web 应用,可实现全栈软件开发自动化。它通过一个由 LLM 驱动的主代理,按需生成子代理来编排多个 AI 命令行工具(Claude Code, Codex 等)。任务在并行的 Git 分支中执行,每个分支都会通过三层质量检查。当生成的代码满足 90 分的评分标准时,会自动合并,从而根据简单的自然语言描述交付生产就绪的产品。

mjkwon2021/CAT-Net

一种通过分析 JPEG 压缩伪影来检测和定位图像篡改的网络,为图像取证研究提供工具。

data-privacy-stack/presidio-research

一个用于评估 PII 检测模型并使用模板生成合成 PII 数据集的工具包,以提高命名实体识别(NER)的准确性。

talesofai/comfyui-browser

一个 ComfyUI 浏览器和管理器,允许用户通过 Git 整理、搜索和同步其工作流及输出。

markfulton/NanoBananaEditor

基于 React 和 TypeScript 的编辑器,支持 Google 的 Gemini 图像模型,实现文本生成图像、遮罩编辑和搜索接地提示。

mrhan1993/Fooocus-API

为 Fooocus 构建的基于 FastAPI 的 REST API,允许开发者无需手动调整参数即可通过编程方式生成高质量图像。

alephpi/Texo

一个仅包含 20M 参数的极简开源 LaTeX OCR 模型,可将数学公式图像转换为 LaTeX 代码。