sahibzada-allahyar/YC-Killer

一个开源、企业级AI代理库,为研究、金融、医疗和教育领域提供商用服务的免费替代方案。

gridaco/grida

由 Rust 和 Skia 驱动的开源画布编辑器和图形引擎,具备 Figma 互操作性和无头渲染能力。

twistedfall/opencv-rust

OpenCV 计算机视觉库的 Rust 绑定,使开发者能够在 Rust 中使用 OpenCV 的图像处理和 CV 工具。

chujianyun/skills

涵盖从提示优化、文档解读到系统操作和职业辅导的 AI Agent 可重用技能与工作流库。

sjjian/openhare

一款支持多种数据库并帮助用户编写和优化查询的 AI 驱动型跨平台桌面 SQL 客户端。

yaojingang/yao-geo-skills

Yao GEO Skills 是一个开源的可复用、可验证的「技能」包集合,可自动化完成从战略 GEO 审计、页面技术检查、内容创建到知识图谱构建和效果监控的完整生成式引擎优化流程。每个技能均包含清晰的入口点、模板和评估数据,可通过 CLI 或 API 运行,生成可直接发布的 HTML/Docx/PDF/Markdown 资产。

dbt-labs/dbt-agent-skills

一组使 AI 代理能够理解并执行 dbt 工作流的技能,涵盖分析工程、语义层管理及项目迁移。

mvanhorn/agentcookie

一个持续将 Chrome 浏览器会话从 Mac 同步到远程 Linux 服务器的工具,允许 AI 代理使用现有的认证会话而无需手动登录。

mistydew/tokenicode-deepseek-alpha

TOKENICODE 的修改版本,为 Claude Code 和 DeepSeek 提供桌面 GUI,具备增强的提供者映射、Claude Skills 管理面板和集成网页预览功能。

leeguooooo/claude-code-usage-bar

一个为 Claude Code 和 Claude macOS 桌面应用设计的实时状态栏,显示速率限制、上下文窗口使用情况和提示缓存的新鲜度。

chaiNNer-org/chaiNNer

用于程序化图像处理和 AI 放大的基于节点的 GUI,允许用户通过可视化界面构建可定制的处理流水线。

groupultra/telegram-search

一款利用向量搜索、语义图像检索和 AI 驱动的 RAG 技术,实现智能问答与摘要的 Telegram 聊天记录备份与搜索工具。

mindmuxai/brain.md

一个为代码代理(coding agents)设计的持久化、基于文件的内存层,将项目决策和约束存储为仓库中的纯 Markdown 文本。

0ca/BoxPwnr

一个实验性框架,通过让 LLM 和 AI 代理在多个平台上自主解决 CTF 挑战和安全实验室,来评估其性能。

DY-2026/GameDesignOS

一个适用于 AI 辅助游戏设计的本地优先操作层,能将碎片化的 AI 输出转化为结构化、带有证据链接的设计决策与项目记忆。

amirlehmam/wmux

一个适用于 Windows 上 AI 编码代理的可视层,提供集中式仪表板来监控、导航并与多个并行的代理会话进行交互。

microsoft/OmniParser

一种将 GUI 截图转换为结构化元素的屏幕解析工具,使视觉基础 AI 代理能够准确识别并操作界面组件。

microsoft/TypeChat

该库通过将提示工程(prompt engineering)替换为模式工程(schema engineering),确保 LLM 的响应是结构化的并经过定义的类型验证,从而使开发人员能够构建自然语言接口。

princeton-vl/infinigen

一个用于为计算机视觉和机器人仿真创建无限逼真 3D 世界、室内场景和关节式资产的程序化生成引擎。

iree-org/iree

IREE 是一个基于 MLIR 的编译器和运行时,可将机器学习模型降低为统一的 IR,以实现跨数据中心、移动设备和边缘设备的高效部署。

Farama-Foundation/HighwayEnv

用于自动驾驶和战术决策任务的 Gymnasium 兼容环境集合。

metorial/metorial

为 AI Agent 提供开源身份与访问层,在数千个外部系统集成中提供标准化的身份验证、权限和可观测性。

rupeshs/fastsdcpu

一个利用 OpenVINO 和潜在一致性模型优化的高性能 Stable Diffusion 实现,专为 CPU 设计,可实现近乎实时的图像生成。

MinishLab/model2vec

Model2Vec 是一个开源 Python 库,可将任意句子转换器压缩为 8–30MB 的小型静态嵌入模型,在 CPU 上运行速度最高可提升 500 倍。支持零数据蒸馏、可选分类微调,并与 Hugging Face、Sentence-Transformers 和 LangChain 集成。通过 `pip install model2vec` 安装,使用 `StaticModel.from_pretrained` 加载预构建模型,或在 CPU 上约 30 秒内蒸馏自定义模型。

aigc-apps/VideoX-Fun

支持 CogVideoX-Fun 和 Wan 2.1 模型的视频生成流水线,适用于文本、图像和视频到视频生成,具备高级结构和相机控制功能。

IPADS-SAI/MobiAgent

MobiAgent 是一个开源框架,可在 Android/HarmonyOS 设备上运行基于 LLM 的移动代理。它提供 MobiMind 模型系列、代理记录与重放系统(AgentRR)和 MobiFlow 基准测试。仓库包含设备端推理支持、多个内存模块(用户资料、经验、动作)、通过 ADB 控制手机的多任务运行器,以及可直接安装的 Android 应用。提供了详细的设置步骤、模型部署说明和引用信息。

microsoft/DiskANN

一个可组合的向量索引库,可在各种数据库存储后端上实现可扩展且成本效益高的最近邻搜索。

limecloud/lime

一个开源的全栈桌面 AI 代理,将编码、终端操作和多模态研究整合到一个可视化工作区中,以执行复杂任务。

groq/openbench

一个支持95+个评估套件的、提供标准化、可复现LLM基准测试的提供商无关评估基础设施

AlmanacCode/codealmanac

一个由 AI 编码代理维护的代码库动态维基,利用 AI 代理自动提取并维护仓库内 Markdown 文件中的架构上下文和系统知识。

trueai-org/midjourney-proxy

一个开源的 Midjourney API 代理,允许开发者通过可编程接口将 Midjourney 的图像生成和人脸交换功能集成到自己的应用中。

qwen-code-dev-bot/oh-my-cli

一个安全、自托管的代码代理 CLI,使用 OpenAI 兼容端点读取和编辑文件并运行 shell 命令,重点在于安全性和会话持久性。

scverse/anndata

一个用于在内存和磁盘上处理带注释数据矩阵的 Python 包,提供对稀疏数据和延迟操作的高效支持。

browser-use/desktop

通过移植 Cookie 到全新的 Chromium 实例来运行 AI 浏览器代理,从而保持用户会话的桌面应用程序。

FerroxLabs/wayland

一个本地优先的桌面 AI 代理命令中心,通过一个界面协调多个 AI CLI 和代理,并具备共享持久内存。

nicobailon/pi-interactive-shell

Pi 编码代理的扩展,使其能够在可观察的 TUI 叠加层中运行交互式 CLI 和子代理,支持实时监控和用户接管。

yejiming/MuseAI

一个本地 AI 伴侣和互动叙事应用程序,允许用户创建具有演进记忆和关系追踪功能的持久角色与世界。

VILA-Lab/FigMirror

FigMirror 是一个代理式工具,可自动将用户数据以指定参考科学图的风格生成 Matplotlib 代码。

MooreThreads/torch_musa

torch_musa 是一个 PyTorch 扩展,为 Moore Threads GPU 添加了 **MUSA** 后端。它镜像了标准 PyTorch API,因此您只需将 `cuda` 替换为 `musa`。该包包含构建 C/C++ 扩展的工具、通过 **mccl** 后端进行分布式训练的功能,以及用于快速设置的 Docker 镜像。它还提供 torchvision、torchaudio 以及一系列其他热门 PyTorch 库的 MUSA 兼容构建版本。可通过预构建的 wheel 安装,或在安装 MUSA SDK 后从源码构建。该项目采用 BSD 许可证。

nova452/Rebalance-Pack

一系列自定义 ComfyUI 节点,旨在简化图像生成和编辑,并提供对 Krea 2 和 Ideogram 4 模型的专门支持。

AeternaLabsHQ/pullmd

PullMD 是一个自托管服务,可将任何公开 URL(包括网页、Reddit/Hacker News 线程、PDF、Office 文档、图像、音频和 YouTube 视频)转换为干净的 Markdown。它提供 PWA UI、REST API 和 MCP 流式端点,支持可选的 JavaScript 渲染、OCR 和媒体字幕生成侧车。输出高度节省 Token:内容位于正文,所有元数据(源 URL、时间戳、OCR 模型、Token 使用量等)置于 YAML 前置元数据中。功能包括可共享的实时链接、SSRF 保护、覆盖率保护、可配置缓存保留和三种认证模式(开放、单管理员、多用户)。通过单个 Docker Compose 文件部署,支持可选 Traefik,适用于 LLM 代理、RAG 管道,以及任何需要隐私保护、无广告 Markdown 提取的用户。

ruvnet/open-claude-code

一个开源的 Claude Code CLI 洁净室实现,提供具有多提供商 LLM 支持和 MCP 集成的代理式编程界面。

microsoft/win-dev-skills

一套 AI 代理插件和技能集合,使 GitHub Copilot、Claude Code 及其他代理能够构建、测试和打包原生 WinUI 3 Windows 应用程序。

Optima-CityU/LLM4AD_Next

LLM4AD Next 是一个 Python 工具包,可将自然语言问题描述一键转换为完整、可运行的进化算法搜索项目。交互式 LLM 顾问生成代码骨架、配置和评估器,内置的进化方法(如 IslandGA、Diverse Island GA、EoH 等)自动演化生成的算法。还提供进化块建议、长期记忆支持、Docker 镜像和在线演示。

Gitlawb/zero

一个基于终端的 AI 编程代理,允许用户使用自己选择的 LLM 提供商编辑文件和运行命令,同时保持本地控制和安全性。

xeronsh/openOii

一个使用 LangGraph 协调从故事创意到最终视频合成的多代理流水线的 AI 漫画视频生成项目

nishuzumi/gemini-teacher

基于 Google Gemini 的 AI 驱动英语口语助手,提供实时发音反馈和语法修正。

autowarefoundation/AWSIM

专为 Autoware 设计的高保真数字孪生模拟器,提供 ROS2 原生环境和真实的传感器模拟,助力自动驾驶开发。