agntcy/oasf
一种用于定义和管理 AI 代理能力与元数据的标准化模式框架,以实现分布式代理系统间的互操作性和发现。
ROCm/rocm-examples
ROCm 平台的示例和教程集合,提供 HIP 运行时功能、GPU 加速应用和 AI 模型执行的代码。
nhaouari/obsidian-textgenerator-plugin
一个开源的 Obsidian AI 助手插件,支持通过多种 LLM 提供方在知识库内直接生成文本、摘要和创意。
decisionintelligence/TFB
TFB 是一个开源库,用于时序预测方法的公平且全面的基准测试,提供标准化的流程以防止评估偏差。
robfiras/loco-mujoco
一个包含多样化人形和四足环境以及广泛动捕数据集的全身控制模仿学习基准。
python-adaptive/adaptive
一个用于数学函数并行主动学习的 Python 库,通过智能选择参数空间中最佳采样点,有效降低计算成本。
CUNY-CL/wikipron
一个从 Wiktionary 中挖掘多语言发音数据以创建音素到音标(G2P)数据集的命令行工具和 Python API。
openbezal/rhema
一个实时AI驱动的桌面应用,可检测直播音频流中的圣经经文,并通过NDI渲染为可广播的叠加层
universal-tool-calling-protocol/utcp-specification
一种标准化协议,用于 AI 系统通过 HTTP、WebSocket 和 CLI 等多种通信协议发现和调用工具。
geekyutao/Inpaint-Anything
一个结合SAM和生成式修复模型的统一框架,可实现图像、视频和3D场景中的对象移除、填充或替换。
sloria/TextBlob
一个用于处理文本数据的 Python 库,为情感分析、标记和分类等常见 NLP 任务提供简单的 API。
antiwork/shortest
一个基于 Playwright 和 Anthropic Claude 的 AI 驱动端到端测试框架,可通过自然语言执行浏览器和 API 测试。
meta-pytorch/torchtune
torchtune 是一个基于 PyTorch 的库,提供多种现代大语言模型(Llama、Gemma、Qwen、Phi 等)的微调、RL-HF、蒸馏、量化感知训练和推理的即用型配方与配置。它通过简单的 CLI(`tune`)和 YAML 文件抽象了分布式训练、内存优化技巧和设备支持,与 Hugging Face、torch-ao、FSDP2 和日志工具集成。尽管 2025 年开发已停止,但它仍是 LLM 实验的实用、开源工具包。
facebookresearch/ReAgent
一个专为大规模分布式任务和无模拟器离线训练设计的端到端应用强化学习平台。
Azure-Samples/cognitive-services-speech-sdk
一组跨平台代码示例,展示如何使用 Microsoft Cognitive Services Speech SDK 实现语音识别、合成和翻译。
JusticeRage/Gepetto
一个用于 IDA Pro 的 Python 插件,利用大语言模型(LLM)解释反编译函数并自动重命名变量,以辅助逆向工程。
jdkato/prose
一个用于英文文本的纯 Go 自然语言处理库,提供分词、词性标注和命名实体识别。
nutonomy/nuscenes-devkit
一个用于 nuScenes 和 nuImages 数据集的软件开发工具包,提供加载、分析和评估自动驾驶研究中多模态传感器数据的工具。
NVIDIA/NeMo-Retriever
一个可扩展的框架,用于从文档中提取文本、表格、图表和信息图表,以支持高性能RAG和生成式AI应用。
facebookresearch/Pearl
Meta 提供的生产就绪强化学习库,用于构建能够处理复杂现实环境、稀疏反馈和动态动作空间的模块化 AI 智能体。
VOICEVOX/voicevox_engine
VOICEVOX 引擎是一个开源 HTTP 服务器,封装了 VOICEVOX 日语 TTS 核心。它允许您通过 REST 端点发送文本(或详细合成查询)并接收 WAV 音频,支持流式传输、用户词典、预设、语音变形、歌唱合成以及可选的 GPU 加速。Docker 镜像和模拟模式使部署变得简单,API 文档位于 `/docs`。
joeynyc/hermes-hudui
一个为 Hermes AI 代理提供内存、成本和内部状态可视化的浏览器端监控仪表板。
lucidrains/transfusion-pytorch
一个 PyTorch 实现的 Transfusion 架构,将文本的下一个标记预测与图像等连续模态的流匹配统一在一个模型中。
CloudAI-X/claude-workflow-v2
适用于 Claude Code 及其他 AI 代理的通用工作流插件,提供专用代理、斜杠命令和自动化钩子,以简化软件开发。
google-deepmind/android_env
一个 Python 库,可将 Android 设备转变为强化学习环境,使智能体能够通过触摸屏交互学习导航操作系统和应用程序。
alibaba/Tora
Tora 是一种面向轨迹的扩散变换器,可通过文本、视觉和轨迹引导,精确控制物体运动,实现高质量视频生成。
automl/SMAC3
一个多功能的贝叶斯优化包,旨在高效地为机器学习算法找到最优的超参数配置。
okisdev/ChatChat
一个统一的、自托管的聊天和搜索平台,提供单一界面以访问多个主要 AI 提供商。
aws/deep-learning-containers
一组用于在 AWS 上运行 AI/ML 工作负载的预构建、已打安全补丁的 Docker 镜像,为 PyTorch、TensorFlow 和 vLLM 等框架提供优化环境。
openvinotoolkit/nncf
NNCF(神经网络压缩框架)是一个开源的 Python 库,为 PyTorch、TorchFX、ONNX 和 OpenVINO 模型添加训练后和训练时压缩(量化、权重压缩、剪枝等),实现更小、更快的推理,且精度损失极小。
ros-visualization/rviz
rviz 是机器人操作系统(ROS)框架的 3D 可视化工具,允许开发者以三维方式查看机器人数据。
Fadi002/de4py
结合本地 LLM 与 AST 清理、模式匹配的高级 Python 去混淆工具,帮助恶意软件分析师和逆向工程师恢复可读代码。
landing-ai/ade-python
LandingAI ADE API 的 Python 库,可将 PDF 和图像解析为结构化 Markdown,并使用 Pydantic 模型提取类型化数据。
allenv0/AirPosture
一款利用 AirPods 的头部追踪和本地 AI 技术,为减少颈部压力提供实时姿势指导和提醒的 iOS 应用。
wangziqi06/724-office
使用纯 Python 构建的无框架、自我进化型 AI Agent 系统,通过多租户路由和三层记忆系统提供 24/7 全天候个人助手服务。
langwatch/scenario
一个使用模拟、用户模拟器和裁判智能体来评估 AI 智能体在多轮对话中行为和鲁棒性的智能体测试框架。
beizhu-1209/AIHelms
一个企业级 AI 资源管理平台,通过集中式身份和预算追踪,帮助组织控制 AI 成本、管理模型访问权限,并量化 AI 生产力。
google-deepmind/xmanager
一个用于在本地环境、Kubernetes 和 Google Cloud Platform 上打包、运行和追踪机器学习实验的框架。
nengo/nengo
Nengo 是一个用于构建和模拟大规模神经模型的 Python 库,支持脉冲和非脉冲模拟。
microsoft/typeagent-py
TypeAgent KnowPro 的 Python 实现,用于构建结构化 RAG 系统,作为结构化检索的实验性原型。
SeldonIO/MLServer
一个开源的推理服务器,提供标准化的 REST 和 gRPC 接口,用于跨多种框架部署机器学习模型。
ls1intum/Artemis
一个为大学提供可扩展的个性化反馈、自动评估以及可选 LLM 驱动辅导的开源平台。
sangrokjung/claude-forge
Claude Forge 是一个插件包,可将基础的 Claude Code 终端编码助手升级为生产级开发环境。它增加了 16 个专业 AI 代理、35 个斜杠命令、33 个已保存的“技能”、22 个安全钩子、14 个行为规则和 4 个外部工具连接。可通过一行脚本(完整安装)或通过 Claude Code 的插件市场(仅命令)安装。该包自动实现规划、测试优先开发、安全审查、文档同步,以及要求独立代理批准每个变更的对抗性验证循环。采用 MIT 许可证,持续维护(v4.3.0,2026 年 9 月)
kyegomez/Open-AF3
一个开源的 PyTorch 实现,用于预测包括蛋白质、核酸和配体在内的生物分子相互作用的三维结构。
lucasjinreal/Kokoros
通过 CLI、Rust crate 和 OpenAI 兼容 API 服务器提供快速文本转语音合成的 Kokoro TTS 模型高性能 Rust 实现。
go-kratos/blades
Go语言的多模态AI代理框架,支持可插拔模型、工具和记忆功能,帮助开发者构建复杂的AI工作流。
fishaudio/fish-diffusion
支持多说话人训练和高效硬件利用的基于扩散模型的文本转语音(TTS)、歌声合成(SVS)和歌声转换(SVC)训练框架。
Kevin-thu/StoryMem
StoryMem 是一个使用记忆条件化扩散模型生成长篇、连贯叙事视频的多镜头视频生成框架,可保持角色一致性。