hysts/anime-face-detector
一个基于 PyTorch 的工具,用于检测动漫人脸并使用预训练的 Faster R-CNN、YOLOv3 和 HRNetV2 模型估计 28 个面部关键点。
ksimback/looper
EmbeddedLLM/JamAIBase
一个开源的 RAG 后端平台,结合了嵌入式 SQLite 与 LanceDB 数据库,并搭配类试算表 UI,旨在简化 AI 增强型表格与聊天机器人的创建。
jahala/tilth
一种语法感知的代码导航工具,为人类和 AI 代理提供结构化洞察,减少探索代码库所需的工具调用次数。
mattt/emcee
一个将任何具有 OpenAPI 规范的 Web 应用程序转换为 Model Context Protocol (MCP) 服务器的工具,让 AI 模型能够将该 API 作为工具使用。
Snowflake-Labs/cocoplus
一个为 Snowflake Coco 构建的智能体操作系统,为数据工程项目带来结构化、多智能体工作流和具备治理意识的执行能力。
JuliusBrussee/cavemem
一种用于代码助手的跨代理持久记忆系统,利用压缩本地存储和MCP,使AI代理能够在会话间保持信息记忆。
thiswillbeyourgithub/wdoc
一个强大的 RAG 系统,可总结和查询多种文档类型,包括 PDF、音频、视频和 Anki 卡片,提供有出处的答案和详细的摘要。
google-research/morph-net
一个在训练期间学习深度网络结构的框架,通过资源受限正则化来降低 FLOPs、模型大小和延迟。
RaoFoundation/bittensor
一个用于为机器智能和其他数字商品建立竞争性市场的去中心化平台和 SDK,并通过区块链驱动的激励系统进行奖励。
Pipelex/pipelex
一个用于构建和运行可重用、类型化 AI 程序的框架,称为“方法”,使用声明式的 .mthds 文件格式来编排复杂的 AI 工作流程。
ThousandBirdsInc/chidori
一个可靠的智能体框架,通过基于 Rust 的运行时,使每个 AI 智能体默认具备可重放性和可恢复性,从而实现零成本调试和崩溃恢复。
ATH-MaaS/Ovis-Image
Ovis-Image 是一个 7B 参数的文本生成图像模型,针对高质量文字渲染和布局精度进行优化,旨在能够在普通可获取的硬件上高效运行。
luxonis/depthai-ros
Luxonis OAK 相机的 ROS 集成,使机器人系统能够使用硬件加速的 AI 与深度感知。
Zaki-1052/GPTPortal
一个自托管、以本地为先的网页界面,将多个 LLM 提供商和本地端点统一到单一聊天 UI,允许用户自行管理 API 密钥和费用。
JuliaGraphs/GraphNeuralNetworks.jl
一系列用於图结构深度学习的 Julia 库,为 Flux 和 Lux 框架提供图卷积层与数据结构。
mosecorg/mosec
一个高性能的模型服务框架,使用 Rust 核心和 Python 接口,将机器学习模型转化为高效、可在云端部署的微服务。
FluxML/model-zoo
Flux 机器学习库的参考实现和演示集合,提供视觉、文本和强化学习模型的起始示例。
FluxML/Metalhead.jl
Flux.jl 的标准机器学习视觉模型库,提供 ResNet、ViT 和 EfficientNet 等热门架构的实现。
ModelEngine-Group/DataMate
一个企业级数据处理平台,旨在简化数据收集、清洗和标注,以支持模型微调和 RAG 检索。
callstackincubator/cali
一个面向角色的 CLI,供 React Native 与 Expo 团队使用,通过 AI 代理自动化移动 QA、性能评审与功能实现。
Neargye/hello_tf_c_api
一组 C++ 示例和一个辅助库,用于在原生应用程序中通过 TensorFlow C API 运行机器学习模型。
rush-db/rushdb
一个为 AI 代理设计的记忆层,将键值、向量和图数据库合并为单一无模式 API,具备自动嵌入和关系推断功能。
LnYo-Cly/ai4j
ai4j 是一个以Java为首要目标的SDK(JDK 8+),统一了对多个LLM提供商的访问,并增加了代理功能(工具调用、多代理协调、A2A、RAG)。它包含核心库、代理运行时、代码助手CLI/TUI/IDE桥接器、Spring Boot启动器和插件系统。通过Maven/Gradle安装,配置提供商(如OpenAI),即可在几行代码中调用聊天/补全API,或在本地运行内置代码代理。
AutoTrustAI/PaperGuru-Benchmark
一种针对长时任务的 LLM 代理记忆架构,实现了生命周期感知记忆(LAM),用于处理版本控制、来源追溯以及研究密集任务中的复杂检索。
dreadnode/rigging
一个轻量级的 LLM 框架,通过提供统一的模型访问、结构化的 Pydantic 输出,以及类型安全的提示定义,简化了生产代码的集成。
duncatzat/vigils
AI 代理的本地优先安全控制平面,防止密钥泄露,防火墙化工具调用,并维护防篡改审计日志。
openonion/connectonion
用于构建和部署生产就绪 AI 代理的模板优先框架,提供内置工具、聊天界面和高级调试功能。
rockbenben/img-prompt
一款面向 AI 图像和视频模型的视觉化、多语言提示构建工具,通过一个包含 5000 多个双语标签的精选标签库和预览图像,帮助用户组装高质量的英文提示。
shibing624/agentica
Agentica 是一个开源、Apache-2.0 许可的框架,可让你在本地运行多个 LLM 驱动的代理。它提供统一的 CLI、Web UI 和桌面应用,共享相同的对话历史和配置。功能包括异步优先工具执行、多模型与多模态支持、持久记忆与上下文压缩、基于 Markdown 的自进化技能系统、安全防护机制,以及内置协作功能(对等消息、任务/子代理、委托流程)。Python 和 TypeScript SDK 可让你在代码中嵌入代理,Docker/uv-tool 安装器让设置变得简单。
trvon/yams
使用内容寻址存储和混合搜索的本地优先、持久内存系统,用于组织和检索代码与文档。
Ahmet-Dedeler/ai-llm-comparison
一个开源的 AI 模型比较工具,提供多个 LLM 提供商的实时价格与功能比较。
ZHangZHengEric/Sage
一个用于任务执行与自动化、整合了浏览器工作流并可通过多渠道即时通讯(IM)频道传递结果的生产级代理平台。
z-lab/paroquant
ParoQuant 是一个用于 LLM 的 INT4 量化框架,通过学习到的成对旋转来减少权重异常值,并在高效推理过程中保持高精度。
MoonshotAI/checkpoint-engine
一个用于 LLM 推理引擎的中间件,能够在大型 GPU 集群上快速、就地更新模型权重,对强化学习至关重要。
microsoft/MInference
MInference 通过利用动态稀疏注意力模式,在单个 A100 GPU 上实现高达 10 倍的加速,从而加速长文本 LLM 的预填充(pre-filling)阶段。
RealCorebb/bbTalkie
一个 DIY 便携、免持的对讲机,使用 ESP32‑S3 上的嵌入式神经网络自动检测语音并识别关键词。
csdcorp/speech_to_text
一个 Flutter 插件,让应用能够通过原生设备语音识别功能在 Android、iOS 和 web 上执行短语音指令与短语。
Picovoice/leopard
Leopard 是一款设备端语音转文字引擎,可在多个平台上提供私密、准确且计算效率高的转录服务。
Picovoice/cheetah
一款在设备上运行的流式语音转文字引擎,提供跨平台的私密实时音频转录。
jitsi/jiwer
一个用于通过 Word Error Rate (WER) 和 Character Error Rate (CER) 等指标评估自动语音识别系统的高速 Python 包。
innovatorved/whisper.api
一个由 whisper.cpp 提供驱动、高性能的语音转文字 API,且与 Deepgram 兼容,方便进行集成。
noahgsolomon/brainrot.js
一个使用 Groq、OpenAI 与 Speechify,自动生成包含名人声音克隆和生成内容的 AI 视频的工具。
THU-BPM/MarkDiffusion
一个开源的 Python 工具包,用于潜在扩散模型的生成水印,提供嵌入、检测和评估 AI 生成图像与视频水印的工具。
OpenImagingLab/AnyRecon
AnyRecon 是一个 3D 重建框架,利用视频扩散模型从一组捕获视图生成高质量、任意视角的场景重建。
nachifur/RDDM
一个用于高质量图像修复与生成的残差去噪扩散模型框架,支持去雨、去模糊等任务。
rohitgandikota/sliders
一个用于创建 LoRA 适配器的框架,这些适配器充当滑块,可在 Stable Diffusion 与 FLUX 等扩散模型中精确控制特定视觉概念。
helblazer811/Diffusion-Explorer
一个用于教育目的的互动式可视化工具,解释扩散模型与流式生成模型的几何直觉。