lmnr
Laminar 是一个面向 AI agent 的开源可观测性平台,提供追踪、评估和监控功能,帮助开发者调试和优化 LLM 应用程序。
CubeSandbox: 它是什么,解决了什么问题以及为什么它正受到关注
一种为 AI agent 提供的高性能、安全的沙箱服务,提供硬件级隔离,启动时间低于 60ms 且内存开销较低。
Guardrails
一个开源工具包,用于为基于 LLM 的应用程序添加可编程护栏,以控制对话流、确保安全性并防止 prompt injection 等漏洞。
microsandbox
Microsandbox 提供快速、本地的 microVMs,通过硬件级隔离安全地运行 AI agent 代码和插件等不受信任的工作负载。
PraisonAI
PraisonAI 是一个使用 Python、CLI 或无代码 YAML 构建和部署自主 AI agent 和多 agent 团队的框架,支持 100 多种 LLM。
obsidian-skills: 它是什么,解决了什么问题以及为什么它正受到关注
一套 agent skills,使 Claude Code 和 Codex 等 AI agent 能够使用 Obsidian 特定语法和 JSON Canvas 格式在 Obsidian vault 中创建和编辑内容。
langflow: 它是什么,解决了什么问题以及为什么它正受到关注
Langflow 是一个用于构建和部署 AI 智能体和工作流的可视化平台,允许开发者设计、测试并将 AI 逻辑导出为 API 或 MCP 服务器。
open-knowledge: 它是什么,解决了什么问题以及为什么它正受到关注
一款面向知识库和 LLM wikis 的本地优先 markdown 编辑器,可与 Claude 和 Codex 等 AI 代理集成,实现协作编辑。
53AIHub:用于启动和运营生产级 AI 代理和工具的开源 AI 门户
一个开源 AI 门户,通过与现有 AI 平台集成,帮助用户快速构建和运营生产级的 AI 代理、提示词和工具中心。
astron-agent:具备原生 RPA 集成的企业级代理工作流平台,实现跨系统自动化
一个企业级代理工作流开发平台,集成 AI 编排、RPA 自动化和模型管理,为生产就绪的 AI 代理提供完整解决方案。
meetily:它是什么、解决了什么问题以及为何受到关注
Meetily 是一款以隐私为先、开源的 AI 会议助理,提供本地转录和 AI 驱动的摘要,确保敏感会议数据永不离开用户设备。
oh-my-pi:它是什么、解决了什么问题以及为何受到关注
一款具备深度 IDE 集成的高能力编码代理,提供内置 LSP/DAP 支持、Hashline 编辑以及庞大的工具表面,实现自治的软件工程。
9router:它是什么、解决了什么问题以及为何受到关注
一个智能 AI 路由器和 token 节省器,通过在订阅、低价和免费 AI 模型之间提供自动回退,优化 API 成本并防止停机。
Anthropic-Cybersecurity-Skills:它是什么、解决了什么问题以及为何受到关注
一个全面的开源库,包含 817 条结构化的网络安全技能和工作流,旨在为 AI 代理提供高级安全分析师的领域专长。
langgraph:它是什么、解决了什么问题以及为何受到关注
一个底层编排框架,用于构建、管理和部署长期运行的有状态 AI 代理,具备持久执行和 Human-in-the-Loop 能力。
langextract
一个使用 LLM 从非结构化文本中提取结构化信息的 Python 库,具有精确的源头溯源功能并支持长文档。
ponytail:它是什么、解决了什么问题以及为何受到关注
一套针对 AI 编码代理的规则和插件,通过强制它们优先选择最简方案,防止过度设计,从而减少代码膨胀和 token 成本。
learn-claude-code:它是什么、解决了什么问题以及为何受到关注
一个学习项目,教授如何为 AI 代理构建运行基础设施(外壳),从简单的代理循环逐步演进到复杂的多代理协同。
caveman:它是什么、解决了什么问题以及为何受到关注
一个用于 AI 代理的插件,通过去除填充词压缩 AI 输出,约降低 65% 的 token 使用量,同时保持完整的技术准确性。
TradingAgents:它是什么、解决了什么问题以及为何受到关注
一个多代理大模型框架,模拟专业交易公司的工作流程,以协同分析市场数据并为研究目的提供交易决策。
langchain:它是什么、解决了什么问题以及为何受到关注
LangChain 是一个通过串联可互操作的组件和第三方集成来构建 AI 代理和 LLM 驱动应用的框架。
oxylabs-ai-studio-py:一个用于通过自然语言提示进行 AI 驱动网页数据提取和代理浏览的 Python SDK
一个用于 Oxylabs AI Studio API 的 Python SDK,能够通过自然语言提示实现 AI 驱动的网页抓取、爬取和代理浏览。
ComfyUI-Copilot:一个能够自动创建、调试和参数调优 ComfyUI 工作流的智能开发伙伴
一个为 ComfyUI 设计的智能助手,通过基于 LLM 的代理实现图像生成工作流的自动生成、调试和优化。
sports: 一套用于高精度运动分析和球员追踪的计算机视觉工具
一套用于运动分析的计算机视觉工具和数据集的集合,专注于球体追踪、球员重识别和球衣号码 OCR 等挑战。
lazycodex: 一个为 Codex 提供项目记忆、战略规划和经过验证的任务完成能力的 agent harness,适用于复杂代码库
一个为 Codex 提供项目记忆、战略规划和经过验证的任务完成能力的 agent harness,通过使用 OmO 引擎为复杂代码库提供支持。
chonkie: 一个用于快速高效 RAG 文本分块的轻量级摄取库
一个用于 RAG 流水线的轻量级、高性能文本分块库,提供多种拆分策略以及与向量数据库和嵌入提供商的广泛集成。
astron-rpa: 一个具有低代码可视化设计和原生 AI agent 集成的企业级 RPA 平台
一款企业级机器人流程自动化 (RPA) 桌面应用程序,通过原生 AI agent 集成,实现 Windows 桌面软件和网页的低代码自动化。
HunyuanVideo:一种采用混合双流转单流 Transformer 架构的大规模开源视频基础模型
HunyuanVideo 是一个参数量超过 130 亿的大规模开源视频基础模型,能够生成运动流畅、文本对齐度高的高质量视频。
stemroller: 一个使用 Demucs 算法分离人声和伴奏的免费音频解混应用
StemRoller 是一个免费应用,它使用 Demucs 算法从通过集成的 YouTube 搜索找到的歌曲中分离人声和伴奏 stems。
MathModelAgent:用于数学建模和学术论文生成的端到端自动化代理
一个 AI 代理系统,通过分析问题、编写代码并生成格式化的学术论文,实现数学建模竞赛的全流程自动化。
lamda: 一个集成了 UI 自动化、网络抓包和 AI 驱动代理的全面 Android 设备控制平台
一个全能的 Android 自动化和控制平台,将 UI 自动化、远程桌面、网络抓包和 AI 代理集成到一个统一的框架中。
node-llama-cpp: 一个用于通过自动硬件加速和结构化输出运行本地 LLM 的 Node.js 库
一个为 llama.cpp 提供预构建绑定的 Node.js 库,使开发人员能够通过自动硬件加速和 TypeScript 支持在本地运行 LLM。
opencompass: 一个面向多种基准测试的公平且可复现的大模型评估一站式平台
一个全面的大语言模型评估平台,为在数十个数据集上进行模型性能基准测试提供了一种标准化的、可复现的方法。
claw-compactor: 一个用于 LLM token 压缩的 14 阶段融合流水线,具备可逆检索和 AST 感知代码分析功能
一种用于 LLMs 的 token 压缩引擎,使用 14 阶段融合流水线在无需 LLM 推理的情况下将 prompt 尺寸减少 15-82%。
distributed-llama:一种通过张量并行将家庭设备聚合以运行大型 LLM 的分布式推理引擎
一种通过以太网将家庭设备聚合共享内存、利用张量并行加速 LLM 性能的分布式推理引擎。
LLMLingua:一种提示压缩工具包,可将令牌使用量降低至 20 倍,以降低成本并加速 LLM 推理
一种提示压缩工具包,可从 LLM 提示中移除非必要的令牌,以降低成本、突破令牌限制并提升长上下文性能。
ktransformers: 针对超大规模 MoE 模型的 CPU-GPU 混合推理与微调框架
一个灵活的框架,利用 CPU-GPU 异构计算进行高性能 LLM 推理和微调,专门针对消费级硬件上的超大规模 MoE 模型进行了优化。
llama.cpp:在多种硬件上本地运行量化 LLM 的高性能 C/C++ 推理引擎
一个纯 C/C++ 实现的 LLM 推理库,利用量化技术在广泛硬件上实现模型的高性能本地运行。
ghost-pepper: 一款适用于 macOS 的私密本地语音转文本及会议转录工具
一款 100% 私密的、适用于 macOS 的本地语音转文本及会议转录应用,使用本地 AI 模型以确保没有任何数据离开机器。
RealtimeSTT: 一个集成了语音活动检测和唤醒词支持的 Python 语音转文本库
一个 Python 语音转文本库,为 AI 助手和听写工具提供快速转录、语音活动检测和唤醒词支持。
Handy: 一个注重隐私的离线语音转文本工具,可将转录文本直接粘贴到任何活动文本框中
一款免费、开源、离线的语音转文本应用程序,可将口头语言直接转录到计算机上的任何文本框中。
diff-svc:一种基于扩散的歌声转换系统,用于音色迁移和音高校正
一种歌声转换工具,使用扩散模型将输入的歌声转换为目标音色,并支持基础的音高校正。
kimodo: 一种用于可控3D人体与机器人运动生成的运动学扩散模型
一种通过文本提示和运动学约束生成可控3D人体与机器人运动的运动学运动扩散模型。
LLaDA:一种大规模掩码扩散语言模型,在性能上可与自回归 LLM 相媲美
LLaDA 是一种大规模掩码扩散语言模型,通过扩散过程预测 token,而非传统的下一个 token 预测,能够实现与 LLaMA3 8B 等自回归模型相当的性能。
ComfyUI: 一个用于精确控制生成式内容创作工作流的模块化节点图 AI 引擎
一个模块化的、基于节点的 AI 引擎,供视觉专业人士用于创建生成图像、视频、3D 模型和音频的复杂工作流。
JoyAI-Image: 一个用于空间推理、图像生成和指令引导编辑的统一多模态基础模型
JoyAI-Image 是一个统一的多模态基础模型,它结合了图像理解和生成,以实现高保真的空间推理和可控的图像编辑。
openrag: 一个由智能体驱动的用于智能文档搜索和 AI 对话的 RAG 平台
一个由智能体驱动的智能文档搜索平台,使用 RAG 技术使用聊天界面使用户能够上传、处理并查询文档。
azure-search-openai-demo: 一个用于通过引用和多模态支持查询私有文档的参考 RAG 聊天应用程序
一个参考 RAG 聊天应用程序,允许用户使用 Azure OpenAI 和 Azure AI Search 与自己的文档进行交互。
verl-agent: 一个用于训练具有可定制记忆和步长无关 rollouts 的长程 LLM 智能体的强化学习框架
veRL 的扩展,用于通过强化学习训练 LLM 智能体,其特点是具有步长无关的 rollout 机制,可高效处理长程、多轮任务。
comfyui_LLM_party: 用于构建复杂 LLM 和智能体工作流的 ComfyUI 节点综合套件
一套用于构建 LLM 工作流的 ComfyUI 节点综合套件,支持将 AI 智能体、RAG 和 VLMs 集成到视觉图像生成流水线中。