jcode: 一个具有语义记忆和协作式多智能体集群的高性能编码智能体框架
一个具有语义记忆、用于协作编码的多智能体集群以及资源高效的 CLI 界面高性能编码智能体框架。
Open-Interface: 一个使用 LLM 模拟鼠标和键盘输入的跨平台计算机自动化工具
一种 AI 驱动的计算机自动化工具,通过根据视觉反馈模拟键盘和鼠标输入,利用 LLM 自主驱动 PC。
terrain-diffusion: Perlin noise 的学习型继任者,用于实现无限且确定性的实时地形生成
Perlin noise 的学习型继任者,使用扩散模型生成无限、确定且可随机访问的实时地形和气候数据。
SkillOpt:一种使用深度学习式优化循环的自我进化代理技能的执行策略
SkillOpt 是一个框架,将代理技能文档视为可训练状态,利用深度学习式的优化循环在不修改模型权重的前提下演化并提升代理性能。
BallonsTranslator: 一款基于深度学习辅助的漫画翻译工具,具备自动修补与排版功能
一款基于深度学习辅助的漫画翻译工具,可实现漫画和漫画作品的文本检测、图像修补和排版自动化。
ccg-workflow:Claude Code 的多模型编排器,可将专门工作委派给 Codex 和 Gemini
一个工作流引擎,使 Claude Code 成为多模型编排器,将任务委派给 Codex 和 Gemini 进行并行分析和审查。
dramaclaw: 一个将剧本到成片过程自动化的工业化剧本制作流水线
一种工业化的 AI 制作流水线,通过自动化剧本生成、分镜设计、资产管理和视频组装,将剧本转化为短剧。
fulling: 一个具有安全 Kubernetes 凭据边界的持久化 AI 工作区基础架构
Fulling 是构建专用 AI 工作区的基础架构,它在基于 Kubernetes 的安全凭据边界内结合了运行时、记忆和技能。
trainer:一个 Kubernetes 原生的分布式 AI 平台,用于可扩展的 LLM 训练和微调
一个 Kubernetes 原生的分布式 AI 平台,用于在 PyTorch、JAX、XGBoost 等多种框架上实现可扩展的 LLM 微调和训练。
maxtext: 一个用于可扩展 LLM 预训练和后训练的高性能 JAX 参考实现
一个基于 JAX 的高性能 LLM 库,用于在 Google Cloud TPUs 和 GPUs 上对 Gemma 和 Llama 等模型进行可扩展的预训练和后训练。
oumi: 一个用于训练、评估和部署基础模型的零样板代码端到端平台
一个简化了从数据准备、训练到评估和部署的基础模型完整生命周期的开源平台。
openvino: 一个用于在多种硬件平台上优化和部署深度学习模型的开源工具包
一个用于在 CPU, GPU, 和 NPU 上优化和部署深度学习模型的开源工具包,支持多种框架和生成式 AI。
aimet: 一个用于量化和压缩 ML 模型以减少内存占用并提高边缘设备推理速度的工具包
一个用于量化和压缩已训练 ML 模型的软件工具包,旨在提高运行时性能并减少边缘设备部署时的内存占用。
TransformerEngine: 一个在 NVIDIA GPU 上使用低精度数值格式加速 Transformer 模型的库
一个通过利用 FP8, MXFP8 和 NVFP4 等低精度格式来加速 NVIDIA GPU 上 Transformer 模型的库,旨在提高性能并减少内存使用。
huggingface_hub:用于与 Hugging Face Hub 平台交互的官方 Python 客户端
官方的 Hugging Face Hub Python 客户端,使用户能够下载、上传和管理开源机器学习模型、数据集以及演示应用。
lance: 为多模态 AI 设计的具有高性能向量搜索和随机访问能力的开放式 lakehouse 格式
一种为多模态 AI 设计的开放式 lakehouse 格式,提供高性能向量搜索、随机访问以及针对 embeddings 和多模态数据的原生存储。
onnx:一种开源的 AI 模型格式,可实现不同框架和硬件之间的互操作性
一个开放生态系统,提供标准化的 AI 模型格式,以实现不同框架和硬件之间的互操作性,主要用于推理。
nono:一个零延迟、零配置的沙箱,用于在最小特权安全环境中运行 AI 代理
一个零延迟、零配置的沙箱,使 AI 代理能够在安全的最小特权环境中运行,无需容器或虚拟机。
cli-printing-press:用于生成具备本地数据持久化的 Agent 原生 CLI 和 MCP 服务器的工厂
一个生成器,可为 AI Agent 创建令牌高效的 Go CLI 与 MCP 服务器,具备本地 SQLite 持久化和基于浏览器的 API 逆向工程功能。
agent-scripts: 一个用于在本地工作区跨管理共享 AI agent 规则和可重用工作流技能的中心枢纽
一个用于在本地工作区跨管理共享 AI agent 指令、可重用技能和可移植辅助脚本的集中式管理系统。
OpenAgentsControl: 一个通过人工引导审批门槛来强制执行团队编码模式的上下文感知 AI 编码框架
一个 AI 编码框架,通过教授智能体特定的编码模式来生成无需重构的生产就绪代码,其特点是具有人工引导的审批门槛和 Token 高效的上下文管理。
nixtla: 用于零样本时间序列预测和异常检测的基础模型
一种用于时间序列预测和异常检测的基础模型,可在多个领域提供零样本推理和微调功能。
infinity
Infinity 是一款 AI 原生数据库,为 LLM 与 RAG 应用提供稠密和稀疏嵌入、张量以及全文数据的高性能混合搜索。
PixelRAG: 什么是它,它解决了什么问题以及为什么它正受到关注
PixelRAG 是一个视觉 RAG 系统,它将文档渲染为截图而非解析为文本,从而允许 AI 检索并对表格和图表等视觉元素进行推理。
nexent
Nexent 是一个零代码平台,可通过自然语言提示自动生成生产级 AI 代理,具备多代理协作和内置知识库等特性。
cactus
一种面向移动设备和可穿戴设备的混合边缘‑云 AI 引擎,提供快速、低内存的多模态推理,并具备自动云回退功能。
DeepTutor: 它是什么,解决了什么问题,以及为什么它正受到关注
DeepTutor 是一个原生于智能体的个性化辅导工作区,它将辅导、研究和掌握练习集成到一个具有共享记忆和多引擎 RAG 的单一系统中。
opendataloader-pdf: 适用于 AI 就绪数据提取和自动化 PDF 可访问性标记的高精度 PDF 解析器
一款高精度 PDF 解析器和可访问性工具,可将 PDF 转换为适用于 AI 流水线的结构化 Markdown、JSON 或 Tagged PDFs,并符合屏幕阅读器合规性。
ruby_llm
一个统一的 Ruby 框架,用于通过单一且具有表现力的接口,在多个 AI 提供商之上构建 AI agent、聊天机器人和 RAG 应用。
openagents
OpenAgents 是一个面向 AI 代理的协作操作系统,提供统一的工作区,使多个不同的 AI 代理能够协同工作、共享文件,并通过单一界面进行管理。
GLM-5: 面向长程智能体工程与复杂系统任务的旗舰级 LLM 系列
一系列专为长程智能体任务和复杂系统工程优化的旗舰级 LLM,其 5.2 版本具备 1M-token 上下文窗口。
obsidian-skills: 它是什么,解决了什么问题以及为什么它正受到关注
一套 agent skills,使 Claude Code 和 Codex 等 AI agent 能够使用 Obsidian 特定语法和 JSON Canvas 格式在 Obsidian vault 中创建和编辑内容。
awesome-llm-apps: 它是什么,它解决了什么问题,以及为何受到关注
一个包含 100 多个即用型 AI 代理和 RAG 模板的完整工具箱,开发者可以克隆并定制,以交付生产级 LLM 应用。
minds
MindsHub Cowork 是一个用于将多步骤任务委派给开源 AI agent 的统一工作空间,允许用户连接数据并将 agent 输出转化为可分享的 artifact
manga-ocr: 针对漫画文本气泡和复杂布局优化的日语 OCR 引擎
一款专门针对日语漫画优化的 OCR 工具,能够识别多行文本、注音 (furigana) 以及纵向和横向布局。
ML:面向 PHP 语言的高级机器学习和深度学习库
面向 PHP 的高级机器学习和深度学习库,提供 40 多种算法和完整的 ML 生命周期工具。
voice-pro: 用于 YouTube 处理、声音克隆和多语言翻译的一站式 AI 配音工作室
一款由 AI 驱动的 Web 应用程序,用于语音识别、翻译和多语言配音,将 ASR、TTS 和声音克隆集成到单一的工作流程中。
ai-job-search: 一个由 AI 驱动的求职申请框架,可自动完成简历的定制化、PDF 布局验证和 ATS 兼容性检查
一个由 AI 驱动的求职申请框架,通过使用“起草者-审核者”工作流,自动完成职位搜索、定制化 LaTeX CV 和求职信以及面试准备。
OM1: 一个用于在物理机器人和模拟器中部署多模态智能体的模块化 AI 运行时
一种用于在数字环境和物理机器人(包括人形机器人和四足机器人)中创建和部署多模态 AI 智能体的模块化 AI 运行时。
voltagent
一个端到端的 AI 代理工程平台,包含用于构建代理的 TypeScript 框架和用于生产可观测性与部署的控制台。
unity-mcp: 一个基于 MCP 的桥接器,使 LLM 能够通过自然语言控制 Unity Editor
一个通过 Model Context Protocol 连接 AI 助手与 Unity Editor 的桥接器,使开发者能够使用自然语言管理场景, 资源, 和脚本。
MemOS
MemOS 是面向 LLM 和 AI 代理的记忆操作系统,提供持久的、图结构的长期记忆系统,以实现个性化和上下文感知的交互。
meetily: 它是什么,解决了什么问题以及为什么它正受到关注
Meetily 是一款隐私优先、开源的 AI 会议助手,提供本地转录和 AI 驱动的摘要,以确保敏感的会议数据永远不会离开用户的设备。
Vibe-Trading:一个通过集成回测和经纪商连接实现研究到执行全流程自动化的个人交易代理
一款 AI 驱动的个人交易代理,自动化从投资假设、市场研究到策略回测和经纪商执行的全流程。
E2B
E2B 是一个开源基础设施,为运行 AI 生成的代码提供安全、隔离的云沙箱。
9router: 一款具备自动回退和 Token 压缩功能的智能 AI 路由工具,旨在降低成本并避免速率限制
一款智能 AI 路由和 Token 节省工具,通过在订阅、廉价和免费 AI 模型之间提供自动回退功能,来防止速率限制并降低成本。
llmfit
一个根据您的系统 RAM, CPU, 和 GPU 来匹配合适尺寸 LLM 模型的终端工具,帮助您找到哪些模型实际上可以在您的硬件上运行良好。
nanobot
一个超轻量级的个人 AI 智能体框架,允许用户拥有自己的智能体,具有多渠道聊天集成、长期目标跟踪和 MCP 支持。
JeecgBoot
一个企业级 AI 低代码平台,利用自然语言编程和 RAG 自动生成基于 Java 的业务系统、报告和 AI 应用。
chitu: 支持多种硬件和 CPU-GPU 混合部署的生产级大规模 LLM 推理引擎
一款生产级高性能 LLM 推理引擎,支持从 CPU 到大规模 GPU 集群的多种硬件,并优化了超大规模模型的部署。