351

browser-harness

一个轻量级的 CDP 工具箱,可将 LLMs 直接连接到真实的 Web 浏览器,允许智能体编写并更新其自身的辅助代码以解决复杂的 Web 任务。

352

LangBot

LangBot 是一个开源平台,可以通过单个仪表板在 Slack, Discord, 和 Telegram 等多个即时通讯平台构建和部署生产级 AI agent。

353

opik

Opik 是一个开源的 AI 可观测性和评估平台,旨在帮助开发者从原型到生产阶段追踪、测试和优化 LLM 应用和智能体系统。

354

toon

一种紧凑、具有 token 效率的 JSON 数据模型编码方式,旨在最大限度地降低 LLM 输入的 token 成本并提高结构可靠性。

355

mastra

Mastra 是一个用于构建和扩展 AI 应用及自主代理的 TypeScript 框架,具有模型路由、基于图的工作流和生产级可观测性等特性。

356

langfuse:它是什么、解决了什么问题以及为何受到关注

一个开源的 LLM 工程平台,通过可观测性、提示管理和测试数据集,实现 AI 应用的开发、监控和评估。

357

repomix

Repomix 将整个代码库打包成一个单一的、对 AI 友好的文件 (XML、Markdown 或 JSON),为 LLM 提供全面的上下文。

358

daily_stock_analysis:一个自动化的 AI 股票分析系统,提供全球市场的每日决策仪表盘

一个 AI 驱动的股票分析系统,自动聚合全球市场数据,并将每日决策仪表盘和风险警报发送至消息应用。

359

img2threejs: 通过 agent-led sculpting 从图像重建对象的程序化 Three.js 模型生成器

一种工具,使用分阶段的 agent-led sculpting 管道,将单张参考图像转换为程序化且可动画化的 Three.js 模型。

360

Bonsai-demo: 高度压缩的 1-bit 和 三进制模型,使消费设备能够进行本地视觉和推理

一个用于运行 Bonsai 的演示仓库,Bonsai 是一系列 1-bit 和 三进制量化语言模型族,使得在消费硬件上实现视觉、推理和工具调用能力成为可能。

361

agent-chat-ui: 用于与 LangGraph 服务器交互的 Next.js 聊天界面

一个 Next.js 聊天界面,允许用户与任何 LangGraph 服务器交互,为 AI 代理提供专业的前端。

362

arxiv-mcp-server: 一个用于搜索、下载和分析来自 arXiv 的科学论文的 MCP 服务器

一个 MCP 服务器,使 AI 代理能够搜索 arXiv、下载论文、检索 LaTeX 节,并在科学文献上执行语义搜索。

363

img2threejs: 一个分阶段雕刻流水线,能够从单张图像重建对象为过程化 Three.js 代码

一个代理流水线,能够将单张参考图像转换为完全用 TypeScript 编写的过程化、可直接用于动画的 Three.js 模型。

364

off-grid-ai-mobile: 为移动端和 Mac 提供端侧文本、图像和视觉能力的全面离线 AI 套件

一款适用于 Android、iOS 和 macOS 的完整离线 AI 套件,通过完全在设备端提供文本、图像和视觉 AI 能力,确保数据的绝对隐私。

365

cube-studio: 一个具有可视化流水线编排和异构计算调度功能的云原生一站式 ML 平台

一个开源的、云原生的、一站式机器学习平台,提供数据标注、交互式开发、可视化流水线编排以及分布式训练和推理的工具。

366

ODS: 一个通过单条命令实现硬件检测与服务编排的本地 AI 服务器技术栈

一个本地 AI 服务器技术栈,通过在您自己的硬件上自动部署推理、聊天、RAG 和自动化工具,实现私有、主权 AI。

367

jcodemunch-mcp: 一个通过 AST 解析实现精确 GitHub 源代码检索的高效 Token MCP 服务器

一个使用 tree-sitter AST 解析来为 AI agent 实现精确、符号级别代码检索的 MCP 服务器,可减少高达 95% 的 Token 成本。

368

data-juicer: 一个使用可组合算子进行 AI 就绪型多模态数据集策展的云规模数据处理系统

一个云原生数据处理系统,提供包含 200 多个算子的模块化库,用于为基础模型和 AI 智能体清洗、合成和分析大规模多模态数据。

369

mobile: 一个用于设备端文本、图像和视觉生成的完整离线 AI 套件

一个适用于 Android、iOS 和 macOS 的完整离线 AI 套件,为实现最大隐私保护,完全在设备端提供文本、图像和视觉 AI 能力。

370

open-code-review: OpenCodeReview – 为任何 Git 仓库提供 AI 驱动、行级精准的代码审查

OpenCodeReview 是一个开源 CLI 工具,可以在 Git diff 或整个文件上运行 AI 驱动的代码审查。它将确定性的文件选择逻辑与可配置的 LLM(Anthropic、OpenAI 或自定义)相结合,以生成精准的行级注释。可以通过 npm 或预构建的二进制文件安装,配置供应商后,运行 `ocr review`(或 `ocr scan`)即可获得比通用代码审查 Agent 更便宜、更准确的自动化审查。

371

SkillOpt: 一种用于自我进化的代理技能的执行策略,通过深度学习优化原则优化技能文档

SkillOpt 是一个框架,它将代理技能文档视为可训练的状态,使用优化器模型在不修改模型权重的情况下,通过严格的训练循环来演进它们。

372

MoneyPrinterTurbo: 一站式 AI 短视频生成器,自动化脚本、资产匹配和发布

一个由 AI 驱动的短视频生成工具,能够从简单主题自动创建脚本、匹配素材并添加旁白和字幕。

373

javacv: 针对流行计算机视觉和多媒体库的 Java 封装

JavaCV 为 OpenCV 和 FFmpeg 等广泛使用的计算机视觉和多媒体库提供了 Java 封装,从而能够在 Java 平台和 Android 上实现高性能的图像和视频处理。

374

CosyVoice: 基于先进 LLM 的文本到语音系统,用于零样本多语言语音合成

CosyVoice 是一个基于先进 LLM 的文本到语音系统,专为高质量、零样本多语言语音合成和语音克隆而设计。

375

ReadAny: 基于 RAG 的 AI 电子书阅读器,具备本地优先的聊天和语义搜索功能

一个本地优先的 AI 电子书阅读器,使用 RAG 和语义搜索帮助用户与他们的图书库聊天并构建私人知识库。

376

kelivo: 一个具有多模态输入和 MCP 工具集成的跨平台 LLM 聊天客户端

一个基于 Flutter 的跨平台 LLM 聊天客户端,为多个 AI 提供商提供统一界面,支持多模态输入和 MCP 工具集成。

377

OpenMontage: 一个将研究、剧本编写和编辑编排进完整制作流水线的智能体视频制作系统

一个开源的、智能体驱动的视频制作系统,它通过编排研究、剧本编写、素材生成和编辑,从而根据自然语言提示词创建专业的视频。

378

mlx-audio: 为 Apple Silicon 优化的音频处理库,支持 TTS、STT 和 STS

一个为 Apple Silicon 优化的高性能音频处理库,提供优化的文本转语音、语音转文本和语音转语音功能。

379

Sana:面向高效的框架,用于支持 4K 图像和实时流式的高分辨率图像与视频生成

面向高效的框架,用于高分辨率图像和视频生成,使得在消费级 GPU 上即可实现 4K 图像创作和实时视频编辑。

380

eidos: 一个具有 AI 驱动数据交互功能的、可扩展的本地优先个人数据管理框架

一个可扩展的个人数据管理框架,通过将 SQLite 转换为具有类 Notion 文档和数据库功能的、本地优先且 AI 驱动的数据库。

381

outlines: 通过类型约束生成保证结构化 LLM 输出的库

一个通过将生成限制为匹配特定 Python 类型或 Pydantic 模型来保证 LLM 结构化输出的库

382

aiden: 一个能够在系统接口之间规划、执行并验证多步计算机任务的自主工作引擎

一个自主的 AI 工作引擎,能够在文件、终端、浏览器和 APIs 之间规划并执行多步任务,具有内置的验证功能和用户控制的权限。

383

Speech: 一个用于构建和部署优化的 ASR、TTS 和语音集成 LLMs 的综合工具包

一个基于 PyTorch 的工具包,用于开发和部署自动语音识别(ASR)、文本到语音(TTS)和语音 LLMs,具有高性能的 NVIDIA 优化模型。

384

ai-agent-book: 一本开源书籍和实验代码库,用于掌握 AI 代理设计与工程

一个开源教育资源,由一本全面的书籍和大量动手实验集合组成,用于学习 AI 代理设计与工程。

385

council-of-high-intelligence: 结构化多视角审议框架,用于高风险决策制定

一个结构化的多视角审议框架,利用多样化的人工智能人格来挑战假设,并通过对抗性推理达到高风险决策。

386

harbor: 用于部署和管理完整本地 LLM 技术栈的统一编排器

一个用于编排完整本地 LLM 技术栈的 CLI 和配套应用,可自动完成后端、前端和智能体工具的 Docker Compose 设置。

387

FastVideo: 一个用于加速视频生成的统一后训练与实时推理框架

FastVideo 是一个统一的后训练与实时推理框架,旨在通过稀疏蒸馏和优化的注意力机制来加速视频生成。

388

gpustack: 用于 AI 模型推理服务和实例配置的开源 GPU 集群管理器

一款开源的 GPU 集群管理器,通过编排推理引擎并配置 GPU 实例,实现可扩展的 AI 模型推理服务。

389

pennylane: 一个用于量子机器学习和化学的硬件无关量子软件平台

一个用于量子计算、量子机器学习和量子化学的开源量子软件平台,可跨各种硬件和模拟器运行。

390

SwanLab:一个用于指标观测和实验追踪的专业 AI 训练分析平台

一个 AI 训练分析和观测平台,提供训练可视化、自动日志记录和实验比较,以加速模型迭代。

391

khazix-skills: 一套标准化的指令集合,用于扩展 AI 代理在系统实用、研究和写作方面的能力

一套标准化的 AI 代理技能集合,用于磁盘清理、AI 新闻追踪、项目文档同步和深度研究报告等任务。

392

ailia-models:一个经过验证的 400+ 预训练 AI 模型库,针对高速跨平台推理进行优化

一个包含 400 多个预训练 AI 模型的集合,已针对 ailia SDK 进行优化,可在移动端、桌面端和嵌入式设备上实现高速跨平台推理。

393

forkd:用于 AI 代理并行的微 VM 沙箱运行时,具备毫秒级快照分叉

一种用于 AI 代理并行的微 VM 沙箱运行时,利用快照写时复制在毫秒级生成隔离的热环境。

394

OmniRoute: 一个聚合数百个提供商的单一端点的 AI 网关,具有自动回退和令牌压缩

OmniRoute 是一个 AI 网关,将数百个 LLM 提供商聚合到单一端点,提供自动回退、令牌压缩以及免费层的统一管理。

395

CyberStrikeAI:具备集成 C2 与多代理编排的 AI 原生安全测试平台,实现自动化漏洞发现

一款 AI 原生安全测试平台,集成 100+ 安全工具和 C2 框架,通过 AI 代理实现漏洞发现和攻击链分析的自动化。

396

Olares:用于自托管数据和本地 AI 模型的开源个人云操作系统

一个开源的个人云操作系统,让用户在本地托管自己的数据和 AI 模型,以重新获得数字自主权和隐私。

397

self-hosted-ai-starter-kit: 用于快速初始化自托管本地 AI 和低代码开发环境的 Docker Compose 模板

一个 Docker Compose 模板,捆绑了 n8n、Ollama 和 Qdrant,用于快速搭建自托管本地 AI 开发环境,以构建 AI 代理和工作流。

398

orca: 一个用于在并行隔离的工作树中运行多个 CLI 编码代理的 AI 编排器

一个 AI 编排器,允许开发者在并行隔离的工作树中通过统一的桌面和移动端界面运行多个基于 CLI 的 AI 编码代理。

399

herdr: 为 AI 编程代理设计的终端复用器,具备实时状态跟踪和持久化会话功能

一款为 AI 编程代理设计的终端复用器,在单个终端界面内提供持久化会话和实时状态跟踪(被阻塞、工作、完成)。

400

ChatLab:使用 AI 代理和 SQL 的私人桌面社交聊天历史分析器

一款开源桌面应用,使用 SQL 引擎和 AI 代理在本地私密地分析并提取社交聊天历史的洞见。