KohakuBlueleaf/LyCORIS
一个实现 LoHa 和 LoKr 等多种参数高效微调算法的库,使 Stable Diffusion 模型在极小存储和计算开销下实现高质量定制。
wooyeolbaek/attention-map-diffusers
attention‑map‑diffusers 是一个 Python 库,用于捕获和可视化 Hugging Face Diffusers 图像和视频生成管道中的注意力张量,让用户能够看到提示、图像块或视频帧如何相互影响。
mybigday/llama.rn
用户发布了一个关于 llama.rn 的长 README,涵盖了众多功能。助手表示可协助具体问题,并提供了关键使用要点的简洁 TL;DR。
Paritok-official/paritok-4b-v1
Paritok 是一个开源代理,位于代码代理(Claude Code、Cursor、Codex、OpenHands 等)与 LLM API 之间。它通过(1)过滤无关工具模式,(2)使用 4B 模型压缩文件读取/工具输出/历史记录,(3)总结旧轮次,来减少输入 token 使用量。网关是一个 Python 包(`paritok[proxy]`),可通过 Ollama 或 vLLM 本地运行,或通过托管 GPU 服务运行。报告的节省效果为首次轮次约 25%,长时间会话超过 60%,显著降低使用成本。项目采用 Apache-2.0 许可证,包含仪表板和 VS Code 扩展。
lhotse-speech/lhotse
一个用于灵活多模态数据准备的 Python 库,可优化机器学习训练中语音、音频、视频和图像数据的加载与操作。
NucleoidAI/Nucleoid
一种用于构建神经符号 AI 中世界模型的声明式逻辑编程语言和运行时,通过结构化推理减少 LLM 幻觉。
christopherkarani/Swarm
支持类型安全工具和本地设备 Apple Foundation Models 的 Swift 原生代理运行时
Project-MONAI/MONAILabel
一个用于 AI 辅助医学图像标注的智能开源生态系统,采用服务器-客户端架构,为放射学、病理学和内窥镜检查实现交互式和自动化的标注。
barun-saha/slide-deck-ai
一个利用各种 LLM 生成专业 PowerPoint 演示文稿的 AI 助手。
Deodat-Lawson/LaunchStack
LaunchStack 是一个 TypeScript 优先、基于端口的引擎,用于 AI 原生应用,提供文档摄取、OCR、RAG、LLM 聊天和后台任务基础设施。一个 Next.js 参考应用展示了如何将引擎连接到 PostgreSQL + pgvector, S3, Inngest 和 Google Gemini (或任何 OpenAI 兼容端点)。软件包目前尚未发布但已准备好发布;该仓库可以本地运行或通过 Docker 运行。
yuga-hashimoto/openclaw-assistant
用于 OpenClaw 和 Hermes Agent 的原生 Android 语音客户端,使自托管 AI 助手能够控制设备硬件和系统功能。
yihong1120/Construction-Hazard-Detection
一个利用YOLO从实时摄像头流中检测PPE违规和接近危险的AI驱动建筑工地安全监控系统。
zae-bayern/elpv-dataset
一个包含 2,624 张已标注电致发光图像的基准数据集,用于视觉识别降低功率效率的缺陷。
Climate-Vision/ClimateVision
一个开源机器学习平台,使用深度学习和卫星影像自动检测森林砍伐、北极冰层融化和洪水。
a-agmon/rs-graph-llm
Rust 中用于 AI 代理的状态化图工作流框架,提供一种类型安全的方式,构建复杂、可恢复且交互式的代理工作流。
ModelEngine-Group/unified-cache-management
一种用于 LLM 的缓存管理框架,通过持久化 KV 缓存并实现稀疏注意力检索与存储-计算分离,显著降低推理延迟和 GPU 内存使用量。
gobii-ai/gobii-platform
一个 AI 员工平台,用于运行持久、永远在线的自主代理,这些代理可通过电子邮件或短信联系,并执行生产环境的浏览器自动化。
av/harbor
Harbor 是一个 CLI 驱动的 Docker-Compose 编排器,让你通过一个 `harbor up` 命令即可启动一个完整的本地 LLM 技术栈——包括模型后端 (Ollama, llama.cpp, vLLM, MLX, etc.), 聊天前端 (Open WebUI, LibreChat, AnythingLLM, ...), 网页搜索, 语音, 图像生成, 和基于 Boost 的智能体工作流。
alondmnt/joplin-plugin-jarvis
一个为 Joplin 设计的 AI 笔记助理,能够与笔记聊天、语义搜索,并使用线上或离线 LLM 进行自动文献综述。
ChaitanyaEswarRajeshJakki/gemini-youtube-automation
使用 Gemini 2.5 Flash 的自主 AI 机器人,可在无人干预的情况下每日编写、生成并上传教育类 YouTube 视频和 Shorts。
bibinprathap/VeritasGraph
一个受控的本地 GraphRAG 和代理框架,结合层次树搜索与知识图谱推理,实现可验证的多跳 AI 检索。
marcoaapfortes/Mantic.sh
一个上下文感知的代码搜索引擎,优先考虑相关性而非原始速度,为 AI 代理和开发者提供精准的意图驱动文件检索。
RubixML/ML
一个为 PHP 提供的高级机器学习和深度学习库,支持整个 ML 生命周期的 40 多个算法和工具。
kronotop/kronotop
Kronotop 是一个基于 FoundationDB 的分布式、事务型文档数据库。它提供低成本、隔离的命名空间,支持 ACID 事务、JSON 文档模型(Bucket)、有序键值 API(ZMap)以及内置向量相似性搜索,所有功能均可通过熟悉的 Redis RESP 协议访问。
dongshuyan/compass-skills
一组可复用的 SKILL.md 工作流,为 AI 代理提供长期项目中的持久状态、任务追踪和自我进化能力。
TeleAI-UAGI/telemem
为 AI 代理提供长期、角色感知的文本与视频记忆的代理记忆管理层,是 Mem0 的高性能替代方案。
facebookresearch/fairseq2
一个用于训练自定义内容生成模型的序列建模工具包,具有模块化架构和对超过 70B 参数模型的可扩展训练能力。
amplifthq/opentag
一个自托管框架,可将 AI 编码代理转变为在用户控制的本地机器上执行任务的持久性 Slack 团队成员。
ClickHouse/agent-skills
一套领域特定指令,为 AI 编码代理提供 ClickHouse 与 chdb 的最佳实践、模式设计和查询优化专长。
justrach/codedb
codedb 是一个零依赖、基于 Zig 的服务器,它能为本地代码库构建丰富的索引(trigram, word, symbol, call-graph)并通过 Model Context Protocol (JSON-RPC over stdio) 暴露它们。AI 编程助手(Claude Code, Cursor, Gemini CLI, 等)可以实现亚毫秒级的延迟来查询文件树、轮廓、符号定义、调用者和全文检索,从而大幅度降低 token 使用量。它作为 MCP daemon (`codedb mcp`) 或 HTTP server 运行,通过文件监听器增量式地更新,并提供 macOS, Linux, 和 Windows 的已签名二进制文件。
MatthewZMD/aidermacs
Aider 的 Emacs 集成,为 Emacs 编辑器带来 AI 伙伴编程和自动代码编辑功能。
lofcz/LLMTornado
.NET 用的供应商无关 SDK,内置对 30 多个 API 供应商和向量数据库的连接器,可构建和编排 AI 代理与工作流。
sligter/LandPPT
一个 AI 驱动的平台,能够自动将文档和主题转换为专业的演示幻灯片,并配有 AI 生成的图像和演讲稿。
papercopilot/paperlists
一个全面的结构化 AI 会议论文记录库,以及用于分析主要会议(如 NeurIPS 和 ICLR)学术文献的本地搜索工具。
tinyhumansai/tiny.place
一个加密的代理对代理网络,为 AI 代理提供身份注册、发现、Signal 加密消息以及通过 Solana 的链上支付结算。
kiwifs/kiwifs
一个为 AI 代理和人类提供可写、可搜索、可版本化的 Markdown 文件系统,支持原生 MCP 和基于 Git 的审计功能。
christopherkarani/Wax
一种为 AI 代理和本地设备模型设计的本地优先共享内存系统,将可搜索的内存存储在单个磁盘文件中,无需托管向量数据库。
milisp/codexia
Codex CLI、Claude Code 和 ACP 兼容代理的轻量级代理工作站和命令中心,具备任务调度和统一项目工作区功能。
shobcoder/shob
Shob 是一个 AI 代理工作空间,允许开发者通过整合了 Git 和权限控制的单一环境,并行运行多个 AI 工作流。
pydantic/genai-prices
GenAI Prices 是一个支持多语言(Python、JS/TS、Go)的库,提供数百个 LLM 模型在数十家提供商中的最新价格数据和查询逻辑,支持历史价格、分层定价和每日价格变动。
leyten/shard
一种协议和引擎,通过汇集分布式 GPU 的 VRAM 和计算能力,在开放互联网上运行大规模 AI 模型。
spiceai/spiceai
用 Rust 编写的可移植、加速的 SQL 查询、搜索和 LLM 推理引擎,无需复杂的 ETL 管道即可实现实时、数据驱动的 AI 应用。
microsoft/World-R1
World-R1 是一个强化学习框架,通过在不改变基础模型架构的前提下,将生成的视频与 3D 约束对齐,提升文本生成视频的 3D 几何一致性。
Tencent-Hunyuan/HY-SOAR
HY-SOAR 是一种无奖励的后训练方法,用于纠正扩散模型的曝光偏差,通过让模型在生成过程中自行修正轨迹错误。
SalesforceAIResearch/DiffusionDPO
一个用于 Diffusion-DPO 的训练框架,通过直接偏好优化(Direct Preference Optimization)将 Stable Diffusion 等图像生成模型与人类偏好对齐。
sp-uhh/sgmse
一个基于 PyTorch 的扩散式生成模型实现,用于语音增强和去混响,从音频信号中去除噪声和混响。
rohitgandikota/sliders
一个用于创建 LoRA 适配器的框架,这些适配器充当滑块,可在 Stable Diffusion 与 FLUX 等扩散模型中精确控制特定视觉概念。
jonfairbanks/local-rag
一个离线、开源的 RAG 系统,允许你摄取本地文件、GitHub 仓库和网站,并使用本地 Ollama 模型与数据聊天。