semantic-router: 一个为 LLMs 和 agents 使用语义向量空间进行路由的超快速决策层
一个为 LLMs 和 agents 提供的高速决策层,它使用语义向量空间根据含义而非缓慢的 LLM 生成来路由请求。
Decepticon: 一个在加固沙箱中执行专业攻击链和杀伤链的自主红队智能体
一个在加固沙箱中执行真实的、专业的攻击链和杀伤链的自主红队智能体,用于自动化安全测试和防御验证。
transformer-explainer: 一个用于学习 GPT-2 内部操作的交互式浏览器可视化工具
一个在浏览器中运行实时 GPT-2 模型的交互式可视化工具,旨在帮助用户学习基于 Transformer 的模型如何预测文本。
ChatGPT-Shortcut: 一个用于在多个平台提升 AI 输出质量的精选提示词库和管理工具
一款 AI 提示词管理工具,提供包含 5,000 多个提示词的精选库,并提供各种工具来在不同 AI 平台中组织、创建和分享自定义提示词。
morphic: 一个具有生成式 UI 的 AI 搜索引擎,可从流式 JSON 渲染丰富的内联组件
一款由 AI 驱动的搜索引擎,使用生成式 UI 渲染丰富的、带有引用的回答,并包含交互式组件,而非纯文本。
krita-ai-diffusion: 一个为 Krita 开发的生成式 AI 插件,集成了扩散模型以实现精确的图像编辑和绘画
一个为 Krita 开发的插件,将生成式 AI 扩散模型集成到绘画工作流中,提供局部重绘、实时绘画和精确结构控制的工具。
outlines: 一个通过类型约束生成来保证 LLM 结构化输出的库
一个通过将生成过程约束为匹配特定 Python 类型或 Pydantic 模型,从而保证 LLM 结构化输出的库。
Open-Generative-AI: 一个具有本地推理和多模型支持的、不受限制的 AI 视频平台开源替代方案
一个开源、不受限制的 AI 工作室,可使用 200 多种模型生成图像和视频,具有本地推理选项和可视化工作流构建器。
openui:一个开源的 AI 驱动 UI 生成器,可将实时描述渲染为框架就绪代码
一款开源工具,允许你使用自然语言描述 UI 组件并实时渲染,同时支持将其转换为 React、Svelte 或 Web Components。
TurboDiffusion:一种将视频生成扩散延迟降低 100‑200 倍的加速框架
TurboDiffusion 是一种视频生成加速框架,通过注意力优化和时间步蒸馏,在单 GPU 上实现 100‑200 倍的扩散生成加速。
MAGI-1: 一种用于可扩展高保真视频生成且具有强物理准确性的自回归世界模型
MAGI-1 是一种自回归视频生成模型,通过逐块生成高保真视频来确保时间一致性和物理准确性。
ComfyUI-LTXVideo: 用于高级 LTX-2 视频生成和音频合成的自定义 ComfyUI 节点
一套自定义 ComfyUI 节点和工作流集合,通过 HDR 输出、对口型和生成式放大等功能扩展了 LTX-2 视频生成模型。
transformerlab-app:一个统一 AI 研究工具和集群编排的开源机器学习平台
一个统一训练、微调、推理和评估为单一界面的开源机器学习平台,适用于个人和研究实验室。
maestro: 一个加速多模态视觉语言模型微调的精简工具
一个用于加速 Florence-2、PaliGemma 2 和 Qwen2.5-VL 等多模态视觉语言模型微调的精简工具。
SimpleTuner: 一个用于微调多模态生成式模型并具备企业级编排功能的统一训练框架
一个用于微调图像、视频和音频生成式模型的全面训练框架,支持广泛的架构,并专注于简单性和内存效率。
OneTrainer: 训练和微调多种扩散模型的全方位解决方案
一套全面的扩散模型训练套件,通过 GUI 或 CLI 提供数据集准备、微调和模型转换工具。
OpenDeepWiki: 一个由 AI 驱动的仓库知识库,可从代码库生成结构化文档、聊天界面和 MCP 端点
一个由 AI 驱动的知识库生成器,可将 Git 仓库和本地目录转换为结构化文档、可搜索的聊天界面和 MCP 端点。
MetaClaw:一个通过真实世界对话实现 AI 助手元学习与进化的智能体代理
一种通过技能注入和异步 RL 微调,使 AI 助手能够通过真实世界对话进行元学习与进化的智能体代理。
Kiln: 一个面向提示词优化、评估和智能体编排的本地优先 AI 开发工作台
一个面向提示词优化、评估、RAG 和微调的本地优先 AI 开发工作台,为团队提供单一的工作流。
h2o-llmstudio:一个无需编码的 GUI 和框架,用于在支持内存高效训练的情况下微调大语言模型
一个无需编码的 GUI 和框架,用于微调大语言模型,支持 LoRA 等内存高效技术以及 DPO 等高级优化方法。
CosyVoice: 基于大语言模型的可扩展多语言零样本文本转语音合成器
一种基于 LLM 的文本转语音系统,用于实现具有高说话人相似度和低延迟流式传输的零样本多语言语音合成。
any-llm: 一个无需代理、使用官方 SDK 访问任何 LLM 提供商的统一 API
一个统一的 Python SDK,提供单一接口以访问 OpenAI、Anthropic 和 Mistral 等多个 LLM 提供商,而无需更改代码。
dstack:跨多个云和本地集群的 GPU 供应与编排统一控制平面
一个统一的 GPU 供应与编排控制平面,简化了在任何 GPU 云、Kubernetes 或本地集群上的开发、训练和推理流程。
XNNPACK: 一个为跨平台推理提供优化神经网络原语的底层加速库
XNNPACK 是一个高度优化的底层性能原语库,用于在 ARM、x86、WebAssembly 和 RISC-V 平台上加速神经网络推理。
optimum: 一个用于在各种 AI 加速器上最大化训练和推理效率的硬件优化工具包
Hugging Face 生态系统的扩展,提供优化工具,以便在目标硬件加速器上以最高效率训练和运行 AI 模型。
zml: 一个将 AI 工作负载与专用硬件解耦的生产级推理栈
一个将 AI 工作负载与专用硬件解耦的生产级推理栈,允许使用单一代码库在 NVIDIA、AMD、Intel 以及 TPU/Trainium 加速器上运行模型。
FastDeploy: 一个具备 PD 分离和广泛硬件加速能力的生产级 LLM 和 VLM 部署工具包
基于 PaddlePaddle 的 LLM 和 VLM 生产级部署工具包,提供高性能推理和广泛的硬件兼容性。
csghub:类似 Hugging Face 的私有本地部署 LLM 资产管理平台
一个开源的本地部署替代方案,类似 Hugging Face,用于管理、存储和分发 LLM 资产、数据集和代码。
typedb:一种强类型数据库,将关系、文档和图模型统一在声明式查询语言中
TypeDB 是下一代数据库,将关系、文档和图模型统一为单一强类型系统,以简化复杂、相互关联数据的管理。
open_model_zoo:一套用于高性能推理的优化预训练深度学习模型和工具集合
一套用于加速高性能推理应用开发和部署的优化预训练深度学习模型及工具集合。
CTranslate2: 一个具有先进量化和硬件优化的 Transformer 模型高性能推理引擎
一个用于高效 Transformer 模型推理的 C++ 和 Python 库,通过使用量化和自定义运行时来加速 CPU 和 GPU 上的执行并减少内存使用。
whichllm: 一个基于硬件感知的推荐引擎,根据系统规格和真实基准测试对最佳本地 LLMs 进行排名
一种硬件感知的 LLM 推荐工具,根据您的特定 GPU/CPU/RAM 和真实基准测试性能对最佳 HuggingFace 模型进行排名。
argmax-oss-swift: 为 Apple 平台提供语音转文本、文本转语音和说话人日志功能的端侧音频推理框架
一套为 Apple 平台提供的端侧推理框架集合,使用 Core ML 提供语音转文本、文本转语音和说话人日志功能。
TensorRT: 用于在 NVIDIA GPU 上加速 AI 模型的高性能推理优化器和运行时
一种 AI 推理优化器和运行时,可在 NVIDIA GPU 上加速各种模态的深度学习模型执行。
ncnn:面向移动、嵌入式和桌面部署的高性能神经网络推理框架
面向移动、嵌入式和桌面部署的高性能神经网络推理框架,无第三方运行时依赖。
ColossalAI: 一个用于高效大规模模型训练和推理的分布式深度学习框架
一个分布式深度学习框架,通过先进的并行和内存管理,使大型 AI 模型的训练和推理变得更快、更便宜。
keras-tcn: 一个用于 Keras 的 Temporal Convolutional Network 层,用于在序列建模中替代 LSTMs 和 GRUs
一种 Keras 实现的 Temporal Convolutional Networks (TCN),为长序列建模提供了一种比 LSTMs 和 GRUs 更稳定且更具并行性的替代方案。
pykeen: 一个用于训练和评估知识图谱嵌入模型的 Python 框架
一个用于训练和评估知识图谱嵌入模型的 Python 包,具有广泛的内置数据集和模型。
PyPOTS: 一个用于分析含有缺失值的多元时间序列的机器学习工具箱
一个用于部分观测时间序列机器学习的 Python 工具箱,为含有缺失值的数据提供填补、预测和异常检测的统一 API。
diffrax: 一个基于 JAX 的用于自动微分和 GPU 加速的数值微分方程求解器库
一个基于 JAX 的数值微分方程求解器库,具备自动微分和 GPU 加速能力,支持 ODE、SDE 和 CDE。
SimpleHTR:一个将单词和文本行图像转换为数字文本的手写文本识别系统
一个基于 TensorFlow 的手写文本识别系统,使用 CNN 和 LSTM 层将单个单词或文本行的图像转换为数字文本。
xlstm: 一种扩展 LSTM 以在在语言建模中与 Transformers 竞争的循环神经网络架构
一种新的循环神经网络架构,扩展了 LSTM 以与 Transformers 和 State Space Models 竞争,其特点是具有用于高效推理的 7B 参数语言模型。
GeneticAlgorithmPython: 一个用于优化机器学习模型和复杂函数的直观遗传算法库
一个用于构建遗传算法以优化数学函数和机器学习模型的 Python 库,原生支持 Keras 和 PyTorch。
raster-vision: 一个用于在卫星和航空图像上构建 ML 模型的地理空间计算机视觉框架
一个使用 PyTorch 在卫星、航空和无人机图像上构建计算机视觉模型的 Python 库和低代码框架。
audiomentations: 一个用于深度学习的快速且易于使用的音频数据增强库
一个用于音频数据增强的 Python 库,提供多种多样的转换,使音频深度学习模型在实际应用中更加鲁棒。
torchio: 一个基于 PyTorch 的工具包,用于通过领域特定伪影对 3D 医学图像进行预处理和增强
一个用于 PyTorch 的 Python 库,提供高效加载、预处理和增强 3D 医学图像的工具。
synthetic-data-generator: 一个支持 GANs、LLMs 和十亿级数据集的隐私保护型表格数据生成器
一个专门用于使用统计模型、GANs 和 LLMs 生成高质量、隐私保护型合成表格数据的框架。
torchmetrics: 一个用于分布式训练和评估的可扩展 PyTorch 指标库
包含超过 100 种 PyTorch 指标实现的集合,可自动在分布式设备之间进行累积和同步,从而减少机器学习流水线中的样板代码。
kompute: 一个面向不同显卡品牌实现高性能加速的跨厂商 GPU 计算框架
一个基于 Vulkan 的跨厂商 GPU 计算框架,能够在 AMD、NVIDIA 和 Qualcomm 硬件上为机器学习和数据处理实现高性能加速。
deepdetect: 一个用于跨多种模态进行统一训练和推理的深度学习运行时和 REST 服务器
一个深度学习运行时和 REST 服务器,为图像、文本和表格数据的训练和推理提供统一的 API。