talesofai/neta-skills
为 Neta Art API 提供的 AI Agent 技能和 CLI 工具集,使 Agent 能够生成多媒体、管理角色并运行互动故事冒险。
facebookresearch/tuna-2
Tuna-2 是一种统一的多模态模型,通过使用直接的像素嵌入取代复杂的视觉编码器和 VAE,从而同时提升图像理解和生成能力。
aimclub/FEDOT
FEDOT 是一个开源的 Python AutoML 框架,它使用进化算法自动设计和优化机器学习流水线(包括预处理、特征工程和模型)。它支持分类、回归、聚类和时间序列预测,集成了流行的 ML 库,提供简单的 API,并提供可复现的流水线导出功能。
LucasAlegre/morl-baselines
MORL‑Baselines 是一个可靠的多目标强化学习算法(单策略与多策略,SER/ESR)的 PyTorch 库。它遵循 MO‑Gymnasium API,提供实用工具、自动 W&B 日志记录,并与 Open RL Benchmark 集成,支持可复现的实验。
zrt-ai-lab/ViNote
一个 AI 驱动的工具,可将 YouTube、Bilibili 和本地文件中的视频转换为结构化笔记、思维导图和可搜索的知识资产。
BlockRunAI/blockrun-mcp
BlockRun MCP 是一个开源 MCP 服务器,为 AI 代理(Claude、Codex 等)提供 19 个实时工具——市场数据、网络搜索、媒体生成、链上查询,以及在 Polymarket 上进行真实 USDC 下注的能力。代理可通过自托管 USDC 钱包(通过 x402 微支付协议)或预付 API 密钥按调用付费。服务器通过单个 `npx` 命令安装,兼容多种 MCP 客户端,并支持人工在环支出审批,是自主代理访问实时数据并执行真实操作的实用桥梁。
guochengqian/Magic123
一个通过结合 2D 与 3D 扩散先验,在粗到细的管线中,从单张 2D 图像生成高质量 3D 对象的系统。
pykale/pykale
基于 PyTorch 的多模态与迁移学习库,提供标准化、基于流水线的 API,以创建可持续、可复用的 AI 工作流。
rockbenben/img-prompt
一款面向 AI 图像和视频模型的视觉化、多语言提示构建工具,通过一个包含 5000 多个双语标签的精选标签库和预览图像,帮助用户组装高质量的英文提示。
huggingface/finetrainers
一个用于可及性训练和微调扩散模型的库,专注于内存高效的文本到视频和文本到图像生成。
laminlabs/lamindb
LaminDB 是一个开源、类 Git 的数据管理工具,专为 AI/ML 领域设计,尤其适用于多模态生命科学数据。它支持文件、表格和数组格式的版本控制,追踪代码与环境的来源信息,支持分支/合并,并将 ACID 安全的元数据存储在 SQLite/Postgres 中。与 Python/R 工具(Polars、DuckDB)、生物本体和工作流管理器集成,为科研与生物技术领域提供可追溯、符合 FAIR 原则的数据集。
Woolverine94/biniou
一个自托管的 Web 界面,可在最低仅 8GB RAM 的硬件上本地运行多种生成式 AI 模型,支持文本、图像、音频、视频和 3D 生成。
hoanganh8389/bizcity-twin-ai
Bizcity Twin AI 是一个开源 WordPress 插件,可将网站转变为企业的统一 AI「大脑」。它标准化来自多个渠道的消息,构建带有溯源的单一知识图谱(KG),并通过托管控制平面(MCP)向 LLM(Claude、ChatGPT)暴露数据。核心服务(身份、KG、推理、自动化、日志、权限)不可变;开发者通过轻量级插件(act、channel、view)添加领域特定功能。项目提供 CLI 脚手架工具、诊断功能和实时演示,采用 GPL-2.0-or-later 许可证发布。
Minidoracat/mcp-feedback-enhanced
MCP Feedback Enhanced 是一个安全强化的 MCP 服务器,为长时间 AI 任务添加基于 Web(可选 Tauri 桌面)的 UI,用于人类介入反馈。它可在本地、SSH 和 WSL 环境中运行,支持会话追踪、图像、Markdown 和多语言 UI,是原始 interactive-feedback-mcp 项目的维护分支。
cyx2333hhh/talk-type
一款结合实时语音识别、本地Whisper回退和AI驱动文本清理的macOS语音输入工具,实现跨应用的无缝双语输入。
Blacktrupersist/hailuo-ai-pulse
Hailuo AI Pulse 是一款专为 Windows 设计的简洁AI工作空间,提供内容生成、分析和创意自动化功能。
backblaze-labs/genblaze
一个用于编排生成式视频、音频和图像工作流程的 AI 流水线 SDK,内置哈希验证的来源清单。
AvalancheAlbatross/midjourney-lab
Midjourney Lab 是一个支持文本、图像、音频和视频多模态生成与处理的 Windows 基础机器学习平台。
matterantmill/kling-ai-pulse
一个用于内容生成、分析与创意自动化的轻量级 Windows AI 工作空间。
v-modal/vmodal_sdk_android
一款用于为视频和图像库添加多模态语义搜索的 Android SDK,允许用户通过含义查找特定时刻。
GangTailorUpgrade/undress-service
一个可自托管的 AI 时尚平台,能将您的衣橱数字化,并利用生成式 AI 根据天气、场合和风格推荐并可视化穿搭。
ling-kong-ran/pisper
Pisper 是一款跨平台的多智能体聊天和工作流工具,可让您分支、并行化和自动化 LLM 对话。它基于开源的 Pi Coding Agent 构建,提供桌面、终端和移动客户端,支持按需插件、安全的本地数据存储,以及可选的 LAN/P2P 远程连接。
AutoArk/TinyEngram
一个开放研究项目,探索基于 Engram 的记忆注入,用于 LLM 与 Stable Diffusion,以在不产生灾难性遗忘的情况下实现参数高效的知识更新。
AutoArk/EVA-OS
一款面向实时多模态应用和智能硬件的 AIOS,提供从 AI 原生编码到设备端推理的集成开发体验。
flatkey-ai/flatkey-cli
用于统一多模态 AI 生成的命令行界面,允许媒体团队和 AI Agent 通过单个 API 密钥和积分余额生成图像、视频、音频和文本。
hezo-ai/hezo
Hezo是一个开源服务器+Web UI,允许你在沙箱容器内构建和运行有组织的AI代理团队(CEO、队长、工程师、设计师等)。你提供自己的LLM提供商密钥,设置令牌和容器小时预算,平台处理秘密保护、Git集成和统一“元框架”,规范化不同的模型运行时。使用单个二进制文件安装,自托管或使用Hezo Cloud,并通过组织图风格UI管理项目。
dreamers-laboratory/image-to-3d-pipeline
一个将图像转换为3D网格的流程,允许用户运行并比较多个开源重建模型,以找到最佳输出。
AkshitIreddy/Interactive-LLM-Powered-NPCs
一个系统,能为任何现有开放世界游戏中的NPC加入动态、由LLM驱动的语音对话和同步面部动画,而无需修改游戏的源代码。
Hchen1218/heytea-style
通过提取视觉元素生成一致角色,将照片转化为手绘海报和交互式桌面宠物的创意工具包
chflame163/ComfyUI_LayerStyle_Advance
一套用于高质量图像标注、VLM 推理以及使用本地模型和外部 API 进行复杂图像合成的进阶 ComfyUI 节点集合。
dexhunter/seedance2-skill
一个与 Claude 兼容的“技能”,提供编写正确 Seedance 2.0 视频生成提示词(字节跳动的多模态模型)的 Markdown 指南。通过将 Markdown 复制到 ~/.claude/skills 或使用 npx skills add 进行安装。指南涵盖了限制、参考语法、镜头语言、提示词结构以及适用于广告、戏剧、MV、教育等领域的模板,内容源自字节跳动官方文档。采用 MIT 授权。
11273/mooc-work-answer
一个跨平台 Python 工具,可自动完成中国 MOOC 服务(智慧职教、AI 优课、资源库)中的学习进度追踪、讨论发帖及 AI 辅助作业提示。通过调用官方 API,并可选地调用 DeepSeek 生成参考答案(60–100% 相关性)。支持预构建可执行文件或源码运行,内置安全延迟以模拟人类操作。
taruma/SceneFlow
一款专为 AI 电影制作者设计的脚本到屏幕同步工具,用于分析提示遵守度,并评估 AI 视频模型如何将剧本指令可视化。
geometric-kernels/GeometricKernels
GeometricKernels 是一个 Python 库,为非欧几里得域(流形、图、网格)提供热核与 Matérn 核。它让高斯过程模型能在这些空间上运行,并提供 TensorFlow (GPflow)、PyTorch (GPyTorch) 与 JAX (GPJax) 的适配器。通过 `pip install geometric_kernels` 安装并添加所需的后端即可使用。仓库包含丰富的笔记本、JMLR 论文引用以及清晰的贡献流程。
JuliaDiff/ReverseDiff.jl
ReverseDiff.jl 是一个 Julia 库,用于快速、基于磁带的反向模式自动微分,能够计算原生 Julia 代码的梯度、雅可比矩阵、海森矩阵和高阶导数。它支持磁带重用、非分配式线性代数优化、与 ForwardDiff 的混合模式兼容,是需要高效梯度计算的机器学习或科学计算项目理想的后端选择。
mir-group/flare
FLARE(原子罕见事件的快速学习)是一个 Python 库,使用稀疏高斯过程回归和 ACE 类型描述符构建贝叶斯原子间力场。它提供不确定性感知分子动力学、实时主动学习以及 LAMMPS 对势实现,使材料和罕见事件的快速、高精度模拟成为可能。
BINE022/EEGPT
EEGPT 是一个使用双重自监督学习方法设计的预训练 Transformer 模型,旨在克服低信噪比问题,实现通用 EEG 特征提取。
IBM/materials
IBM/materials 是一套真正的开源大型基础模型套件,专为化学与材料科学设计。它提供预训练的单模态模型(SMILES、SELFIES、图、3D结构)和多模态融合工具,均可通过统一的Python包装器(FM4M‑Kit)或Hugging Face网页UI访问。仓库包含安装说明、示例笔记本以及Hugging Face上托管模型的链接。
hankcs/HanLP
HanLP 是一个开源的多语言 NLP 工具包(提供 Python 核心以及 Java/Go 客户端),为分词、词性标注、命名实体识别、句法分析、语义角色标注、AMR、摘要、情感分析、语言检测等任务提供生产级预训练模型。它提供两种 API:轻量级 RESTful 服务(无需 GPU)以及基于 PyTorch/TensorFlow 的原生 Python 库。模型涵盖 130 种语言,并提供兼顾速度的多任务联合模型与高精度的单任务模型。安装方式仅需 `pip install hanlp`(原生)或 `pip install hanlp_restful`(REST)。该库返回一致的 JSON 输出,并包含可视化工具、自定义词典支持及详尽的文档。
Dooy/chatgpt-web-midjourney-proxy
一个将 ChatGPT 与 Midjourney 以及数十种生成式 AI 后端(图像、视频、音乐、舞蹈、换脸)整合的网页 UI。可通过 Docker、Vercel 或预编译的二进制文件部署,并透过环境变量进行配置。支持语音输入、GPT-4-vision 图像上传、实时聊天,以及用于切换模型端点的“GPT-Store”。
Relaxed-System-Lab/Flash-Sparse-Attention
Flash‑Sparse‑Attention (FSA) 是一个基于 Triton 的 PyTorch 模块,为 Native Sparse Attention 提供了优化版本。通过重新排序循环并将工作拆分为三个专用核心,它减少了内存流量并消除了原子加法,在现代 NVIDIA GPU 上对长序列 LLM 的训练和推理速度提升了 2‑3 倍。它适用于 PyTorch ≥ 2.4、transformers ≥ 4.45,并在 Ampere/Hopper 硬件上支持 fp16/bf16。
fcakyon/phd-skills
一个零依赖的 Claude Code 插件,为机器学习研究人员添加研究防护机制、自动触发技能和后台代理,帮助避免在论文复现、实验调试和训练启动过程中因错误配置、未经验证的主张或破坏性命令而导致的高成本 AI 助手失误。
jmiao24/Paper2Agent
Paper2Agent 是一个多代理 Python 系统,可自动将研究论文(及其代码)转换为可运行的 MCP 服务器,将论文的方法公开为 AI 可调用的工具。用户将“paper2agent”技能安装到编程助手(Claude Code、Codex、Gemini CLI)中,然后提示助手将论文 URL“代理化”。该系统会生成专业子代理来解析论文、建立隔离环境、封装原始代码、执行验证测试,并将所有内容打包成包含使用说明的 ZIP 文件。生成的服务器可在本地运行或托管于 Hugging Face,随后可连接回编程助手进行交互式科学查询。
huggingface/meshgen
一个使用 AI 代理实现自然语言控制 3D 建模的 Blender 插件,支持本地与远程 LLM 后端。
marcellodebernardi/loss-landscapes
`loss‑landscapes` 是一个基于 PyTorch 的库,可在模型参数空间的低维切片上采样标量指标(损失、梯度范数、曲率、期望回报等),便于轻松创建损失面可视化图。它提供灵活的 `Metric` 抽象、子空间生成器(直线、平面等)以及 `ModelWrapper` 以兼容标准模型和强化学习智能体。原始 2019 年版本已损坏,正在重写中,因此 API 可能会变化。
20000419/fauxnix
fauxnix是一个基于npm的工具,可将精选的bash命令子集翻译为PowerShell,使LLM代理无需虚拟机即可在Windows上运行熟悉的Linux风格命令。它提供确定性翻译、MCP服务器集成、批量执行和广泛测试,旨在提升Windows环境中AI驱动代码助手的可靠性。
Aperivue/medsci-skills
MedSci Skills 是一个开源集合,包含 59 个 AI 代理“技能”,可自动化完整的临床研究流程——包括文献搜索、研究设计、数据清理、统计分析、论文撰写、合规性检查,以及针对 AI 研究的可重现模型架构与验证。它专为 Claude Code、Copilot、Cursor 等工具设计,可通过 npx、GitHub CLI 或 Claude 插件安装,并提供端到端的演示(如诊断准确性、荟萃分析、流行病学、CNN 分割、外部验证),能输出论文、图表及符合指南的审计报告。
mcneel/RhinoAI
一个MCP服务器,使AI代理能够直接在Rhino中创建和编辑3D几何