ott-jax/ott

一个基于 JAX 的库,利用离散求解器和神经网络方法,可大规模求解点云之间的最优传输和匹配问题。

sleuth-io/sx

一种用于 AI 资产(如技能、提示词和代理)的分发与版本控制系统,允许团队通过共享文件夹或 Git 保险库在不同 AI 工具之间共享这些资产。

hako-mikan/sd-webui-regional-prompter

AUTOMATIC1111 的 Stable Diffusion WebUI 的自定义脚本,允许用户为图像的不同区域指定不同的提示词,以防止提示词溢出。

py-why/causal-learn

一个用于因果学习的开源平台,通过多种发现算法从观测数据中恢复因果结构。

symgraph/IDAssist

一款通过 LLM 驱动的函数解释、语义知识图谱和基于 RAG 的文档搜索,辅助二进制逆向工程的 AI 驱动 IDA Pro 插件。

google/cameratrapai

一个使用目标检测器和物种分类器自动对相机陷阱图像中的野生动物物种进行分类的 AI 模型集成。

tensorgi/TPA

一种使用张量积注意力来提升性能并减少KV缓存大小的Transformer模型架构,从而实现更高效的大型语言模型推理。

bakrianoo/mazinger

一个端到端的视频配音流水线,自动化完成转录、翻译、语音克隆和音频合成,整合为单一工作流。

AXERA-TECH/ax-samples

一组用于在 Axera AI SoC 硬件上部署常见开源深度学习算法的示例代码和基准测试。

SterlingChin/marvin-template

一个扩展 Claude Code 的 AI 首席幕僚,提供会话连续性、目标追踪以及与 Google Workspace 和 Slack 等生产力工具的集成。

Makememo/MemoAI

一款基于 AI 的工具,可从本地文件或 YouTube 链接中转录音频和视频,提供翻译和字幕功能。

microsoft/multilspy

一个 Python LSP 客户端库,提供统一 API 以查询多个语言服务器的静态分析结果,支持 AI 驱动的代码生成和代理。

AaronZ345/GTSinger

一个大规模、多语言的歌唱语料库,包含专业录音和真实音乐乐谱,旨在提升 AI 歌唱语音合成与技术控制能力。

tabularis-ai/be_great

一个利用预训练Transformer语言模型生成高质量合成表格数据的框架,支持基于训练和基于模式的生成。

jdubois/dr-jskill

一个 AI 代理技能,可自动化生成使用 Java 25、PostgreSQL 和多种前端选项的生产就绪 Spring Boot 4.x 应用程序。

IBM/terramind

面向地球观测的任意输入输出生成基础模型,支持多模态空间数据生成与环境监测。

1c7/Translate-Subtitle-File

一款让用户连接自己的翻译 API 密钥,以低成本高效翻译 .srt、.vtt 和 .ass 文件的字幕翻译工具。

android/androidify

一个开源的 Android 示例应用,展示如何使用 Gemini API、Imagen 和 Jetpack Compose 构建 AI 驱动的体验,以重新构建 Android 机器人制作器。

LuisaGroup/LuisaRender

支持 CUDA、DirectX 和 Metal 等多种硬件后端的高性能跨平台蒙特卡洛渲染器,适用于流式架构。

krumjahn/applehealth

一个将 Apple Health 导出数据转化为对话式分析工具的终端 AI 助手,支持本地和云 LLM,实现私密的健康指标追踪。

ekzhu/datasketch

用于在海量数据集上进行快速相似性估计和基数计数的概率数据结构库。

cardenluo/ComfyUI-Apt_Preset

ComfyUI‑Apt_Preset 是可视化 AI 工作流工具 ComfyUI 的插件。它将加载、control-net 和采样步骤打包为预设驱动的节点,提供适用于多种模型家族的通用加载器、用于视频/动画/control-net 的控制器堆栈、组合采样器节点以及实用图像/掩码工具。通过克隆到 `custom_nodes` 并运行 `install.bat` 进行安装;可选的配套插件和资源包可增加额外功能。该插件简化了复杂的图像生成图,使其更易于构建和维护。

Avaiga/taipy

一个让数据科学家和机器学习工程师无需前端知识即可构建和部署生产就绪的 AI 和数据驱动 Web 应用程序的 Python 框架。

quantumlib/OpenFermion

一个用于在量子计算机上模拟费米子系统和量子化学的量子算法编译与分析的 Python 包。

agiwhitelist/auteur

一个通过艺术指导、资产生成和严格反粗糙 linting 的纪律化流程,指导 AI Agent 创建电影级、高性能网站的 AI Agent 技能。

videoflow/videoflow

一个 Python 框架,用于构建可本地运行或在 Kubernetes 上使用 NATS JetStream 运行的分布式视频和流处理管道。

modal-labs/modal-client

Modal 平台的官方 SDK,使开发者能够部署高性能无服务器应用并交互平台资源。

TorchSim/torch-sim

一个基于 PyTorch 构建的开源原子模拟引擎,通过自动批处理和 GPU 加速来加速机器学习原子间势函数 (MLIPs)。

kyegomez/Gemini

一个开源的多模态 Transformer 模型实现,可在单一架构中原生处理文本、图像和音频。

KernelTuner/kernel_tuner

一个用于 GPU 内核的自动调优工具,可在多种 GPU 编程语言中对参数进行基准测试和优化,以提升性能和能效。

facebookresearch/xformers

为 Transformer 模型提供经过优化的、可定制的构建模块工具箱,通过提供内存高效且高性能的 CUDA 内核来加速研究。

cocel-postech/genz-icp

GenZ-ICP 是一种对退化环境具有鲁棒性的 LiDAR 里程计系统,通过自适应加权机制确保在几何特征较少的环境中实现稳定定位。

enoche/MMRec

一个现代的多模态推荐工具箱,为各种基于研究的推荐模型提供统一的框架和源代码。

railwayapp/railway-skills

一组能让 AI 代理(如 Claude、ChatGPT、Cursor)管理 Railway 云端基础设施的代理技能与插件集合。

awizemann/harness

一款原生 macOS 工具,利用 AI 代理模拟真实用户在 iOS、macOS 和 Web 应用中的操作,以识别 UX 摩擦并测试用户目标。

pax-beehive/paxm

为 AI 编码代理设计的内存适配器,提供统一的跨代理记忆层,用于存储和回忆项目上下文与决策。

ratel-ai/ratel

一种用于 AI 代理的上下文工程层,通过动态选择每次交互中最相关的工具和技能,降低 token 成本并提高准确性。

ailia-ai/ailia-models

包含419个跨视觉、音频和文本等不同领域的预训练AI模型,全部可通过统一CLI运行,并自动下载权重。

mereyabdenbekuly-ctrl/clodex-ide

一个开源、以本地为先的代理式 IDE,适用于长期工程工作,能在多个会话之间保留任务历史与环境状态。

ChatLunaLab/chatluna

一个高度可扩展的 Koishi 聊天机器人框架,整合多家 LLM 提供商,支持语音、图像等多样化输出格式。

shobcoder/shob

Shob 是一个 AI 代理工作空间,允许开发者通过整合了 Git 和权限控制的单一环境,并行运行多个 AI 工作流。

LSH9832/edgeyolo

EdgeYOLO 是一款无锚点的目标检测器,针对 Nvidia Jetson 等嵌入式边缘设备的实时性能进行优化,支持包括 TensorRT 与 RKNN 在内的多种部署格式。

AvaLovelace1/BrickGPT

BrickGPT 是一款通过微调 Llama-3.2 模型,从文本提示生成物理稳定且可搭建的积木模型 AI 系统。

Correr-Zhou/OmniShow

OmniShow 是一个统一文本、参考图像、音频和姿态条件的多模态视频生成模型,可生成人类与物体交互的高保真视频。

Lakonik/LakonLab

用于实验大型扩散模型的高性能代码库,实现了先进的流匹配(flow-matching)与蒸馏技术,以实现高效的几步图像生成。

PaddlePaddle/FastDeploy

基于 PaddlePaddle 的面向生产的 LLM 与 VLM 部署工具包,提供高性能推理和广泛的硬件兼容性。

tensorflow/gnn

一个用于构建和扩展图神经网络(Graph Neural Networks)的 TensorFlow 库,提供异构图表示和分布式图采样工具。

pykeen/pykeen

PyKEEN 是一个用于训练和评估知识图谱嵌入模型的 Python 包,提供了一个全面的内置数据集和模型库。