nova452/Rebalance-Pack

一系列自定义 ComfyUI 节点,旨在简化图像生成和编辑,并提供对 Krea 2 和 Ideogram 4 模型的专门支持。

AeternaLabsHQ/pullmd

PullMD 是一个自托管服务,可将任何公开 URL(包括网页、Reddit/Hacker News 线程、PDF、Office 文档、图像、音频和 YouTube 视频)转换为干净的 Markdown。它提供 PWA UI、REST API 和 MCP 流式端点,支持可选的 JavaScript 渲染、OCR 和媒体字幕生成侧车。输出高度节省 Token:内容位于正文,所有元数据(源 URL、时间戳、OCR 模型、Token 使用量等)置于 YAML 前置元数据中。功能包括可共享的实时链接、SSRF 保护、覆盖率保护、可配置缓存保留和三种认证模式(开放、单管理员、多用户)。通过单个 Docker Compose 文件部署,支持可选 Traefik,适用于 LLM 代理、RAG 管道,以及任何需要隐私保护、无广告 Markdown 提取的用户。

ruvnet/open-claude-code

一个开源的 Claude Code CLI 洁净室实现,提供具有多提供商 LLM 支持和 MCP 集成的代理式编程界面。

Gitlawb/zero

一个基于终端的 AI 编程代理,允许用户使用自己选择的 LLM 提供商编辑文件和运行命令,同时保持本地控制和安全性。

xeronsh/openOii

一个使用 LangGraph 协调从故事创意到最终视频合成的多代理流水线的 AI 漫画视频生成项目

nishuzumi/gemini-teacher

基于 Google Gemini 的 AI 驱动英语口语助手,提供实时发音反馈和语法修正。

autowarefoundation/AWSIM

专为 Autoware 设计的高保真数字孪生模拟器,提供 ROS2 原生环境和真实的传感器模拟,助力自动驾驶开发。

agentscope-ai/agentscope-studio

为 AgentScope 开发者提供的本地可视化工具包,通过实时交互和追踪,支持代理应用的开发、调试和评估。

yee-yore/DorkAgent

一个由 LLM 驱动的智能体,可为漏洞赏金狩猎和渗透测试自动化执行 Google Dorking,以识别安全漏洞和敏感信息泄露。

open-rmf/rmf

Open-RMF 是一个允许多个不同厂商的机器人在相同环境中协同运行的多车队机器人管理平台。

TW-NLP/ChineseErrorCorrector

一个全面的中文文本纠错平台,提供最先进模型、评估工具和数据增强功能,用于拼写与语法错误纠正。

TongmingLAIC/AKO4ALL

AKO4ALL 是一个以 Claude Code 技能形式打包的自动化 GPU 内核优化工具,通过迭代地进行性能分析、代码重写和基准测试,实现专家级性能。

JuliusBrussee/cavekit

一种高效的、规范驱动的开发框架,使用压缩编码和单一持久规范文件来维持项目记忆。

Dao-AILab/sonic-moe

一个针对 NVIDIA Hopper 和 Blackwell GPU 优化的、高性能的混合专家模型 (MoE) 实现,旨在降低内存使用量并提高训练吞吐量。

Wirasm/prp

一个为Claude Code设计的提示与代理技能框架,通过结构化的计划-实施-审查循环,将产品需求转化为生产就绪代码。

lihongxun945/gobang

使用Minimax算法和Alpha-Beta剪枝实现的浏览器端五子棋AI,具备全面的AI强度评估系统。

PythonOT/POT

一个为机器学习、信号处理和图像处理中使用的最优运输问题提供广泛求解器的Python库。

dkogan/mrcal

mrcal 是一个通用工具包,用于解决相机校准和结构从运动(SfM)问题,提供C和Python库以及命令行工具。

dipy/dipy

DIPY 是一个专为 MR 扩散成像分析设计的 Python 库,为研究人员提供处理医学影像数据的工具。

YingfanWang/PaCMAP

一种用于可视化、同时保留高维数据局部和全局结构的降维方法。

kimtaeyoon83/mcp-server-youtube-transcript

一个模型上下文协议服务器,允许AI模型检索YouTube字幕,并可选地使用TwelveLabs进行视觉视频分析。

Samge0/ragflow-upload

一个用于 RAGFlow 的批量文档上传与解析工具,通过 API 自动将大型本地数据集导入知识库。

me2resh/apexyard

一个为 AI 编码代理设计的治理框架,强制执行专业 SDLC,提供 shell 钩子、专用代理角色和合并门禁,以安全地将代理构建的代码移入生产环境。

managedcode/dotnet-skills

一个提供现代 .NET 实现指导的目录和管理工具,防止 AI 代理建议过时的编码模式。

Bing-su/adetailer

一个用于 Stable Diffusion web UI 的扩展,可自动完成掩码与修复,以优化生成图像的细节。

Dicklesworthstone/llm_aided_ocr

一种先进的 OCR 流水线,利用 LLM 纠正 Tesseract OCR 的原始输出错误,并将其转换为高质量、格式化的 Markdown 文档。

VOICEVOX/voicevox_engine

VOICEVOX 引擎是一个开源 HTTP 服务器,封装了 VOICEVOX 日语 TTS 核心。它允许您通过 REST 端点发送文本(或详细合成查询)并接收 WAV 音频,支持流式传输、用户词典、预设、语音变形、歌唱合成以及可选的 GPU 加速。Docker 镜像和模拟模式使部署变得简单,API 文档位于 `/docs`。

nsfw-filter/nsfw-filter

一款注重隐私的浏览器扩展,通过在设备上运行 AI 来阻止 NSFW 图像,而无需将数据上传到任何服务器。

johnson7788/MultiAgentPPT

通过协调负责大纲拟定、并行研究和质量检查的专业代理,实现高质量、可编辑 PPT 自动生成的智能多代理系统。

datagouv/datagouv-mcp

一个 MCP 服务器,使 AI 聊天机器人能够通过自然语言对话搜索、探索和分析来自 data.gouv.fr 的法国国家开放数据。

blueberrycongee/Lumina-Note

一个本地优先的 Markdown 工作区,集成了一个可以读取、写入并重新组织用户整个库中笔记的 AI 智能体。

microsoft/Multi-Agent-Custom-Automation-Engine-Solution-Accelerator

一个基于 Microsoft Azure 的参考解决方案,展示如何构建一个用于自动化复杂业务工作流的多代理 AI 编排平台。整合了 Azure OpenAI(Foundry)、Container Apps、Cosmos DB 及其他 Azure 服务,并包含部署指南、成本指导和安全建议。

amd/RyzenAI-SW

一套用于在 AMD Ryzen AI 基础 PC 上优化和部署 AI 推理的工具和运行时库,以最大化硬件加速。

superhq-ai/shuru

一个面向本地优先的 microVM 沙箱,为 AI Agent 提供安全、可丢弃的 Linux 环境,用于执行代码和安装工具,而不会影响宿主机系统。

linwhitehat/ET-BERT

一种基于 Transformer 的加密网络流量分类模型,通过预训练和微调学习数据报的上下文关系

zh-plus/openlrc

一个使用 faster-whisper 进行音频转录,并利用 LLM 将文本翻译并润色为同步 .lrc 字幕的 Python 库。

OpenRouterTeam/ai-sdk-provider

一个为 Vercel AI SDK 提供的插件,通过 OpenRouter API 实现对 300 多个 LLM 和嵌入模型的无缝访问。

pacifio/cersei

一个完整的 Rust SDK,用于构建高性能编码代理,内置工具执行、图结构内存和子代理编排功能。

crawfordxx/xiaoma-durex-copywriter

一个 Claude Code 技能,通过结合 AI 图像与代码布局管线,应用专业广告方法论来生成机智、极简的营销文案与海报。

rsasaki0109/kalman_filter_localization_ros2

基于 ROS 2 的误差状态扩展卡尔曼滤波器 (ESEKF),通过融合 GNSS、IMU 和里程计来实现高精度定位,用于估计位置、速度和姿态。

NVIDIA-ISAAC-ROS/isaac_ros_nvblox

nvblox 的 ROS 2 集成,实现基于视觉的障碍物避让所需的实时 3D 场景重建和 2D 成本地图生成。

ros-controls/ros2_control

一个用于在 ROS 2 生态系统中控制机器人、提供标准化方式管理机器人硬件和控制回路的框架。

foxglove/mcap

MCAP 是一个与序列化无关的日志记录库和文件格式,专为机器人应用中的高效数据记录与分析而设计的。

ros2-rust/ros2_rust

一组使开发者能够使用 Rust 编写 ROS 2 应用程序的库和工具,为 C++ 和 Python 提供高性能且内存安全的替代方案。

magicrew/doc7

一款使用多模态视觉模型将 PDF、Office 文件和图像转换为 AI 友好 Markdown 的文档转换工具,支持本地推理以保障隐私和成本效益。

OpenGVLab/InternVideo

一系列旨在用于多模态视频理解、长上下文建模和上下文推理的视频基础模型及大规模数据集。

Pimzino/spec-workflow-mcp

通过强制执行需求、设计和任务的顺序工作流,并配备实时监控仪表板,为 AI 智能体实现结构化、规范驱动的开发。这是一个 MCP 服务器。

u14app/deep-research

一款 AI 驱动的研究工具,可自动从网络和本地文件中收集信息,生成全面且深入的报告。