braindecode/braindecode
Braindecode 是一个 Python 工具箱,将深度学习模型应用于原始大脑信号数据(EEG/ECoG/MEG)。它提供了数据集加载器、预处理、几种现成的神经网络架构以及可视化工具,全部构建于 PyTorch 和 MNE-Python 之上。可通过 `pip install braindecode` 安装,主要目标用户为处理神经生理数据的神经科学家与机器学习研究人员。
GoogleCloudPlatform/vertex-ai-creative-studio
一个用于探索 Google Cloud 生成式媒体模型的 Web 应用程序,提供图像、视频、音乐和语音生成以及创意工作流的统一界面。
codestable/CodeStable
一套为 AI 编码设计的轻量级技能契约,确保长期项目边界、基于证据的结果以及集成的项目记忆。
clawkwork/clawk
一个为 AI 代码代理提供安全、可丢弃的 Linux 虚拟机的工具,使代理能够在与主机完全隔离的受保护环境中实现完全自主运行。
Azure-Samples/AI-Gateway
基于 Azure API Management 构建的企业级 AI 网关框架,为管理 AI 模型、工具和代理提供集中式安全、成本控制和可观测性。
kaito-project/kaito
一个自动化 LLM 推理、微调和 RAG 引擎部署、扩展和管理的 Kubernetes Operator 套件。
kunal12203/GrapeRoot
一个开源的 AI 编程助手启动器,通过构建代码库的本地语义图,将相关上下文预加载到提示中,从而减少 token 成本和响应时间。
kubeflow/community-distribution
一种用于在各种 Kubernetes 集群上安装 Kubeflow 平台的清单分发,提供完整的端到端机器学习环境。
OpenMined/TenSEAL
一个用于在张量上执行同态加密操作的库,可在不解密数据的情况下实现安全计算。
boogu-project/Boogu-Image
一个开源的统一图像生成与编辑模型家族,提供高质量的文本到图像生成和精确的图像编辑能力,具备强大的中英文双语文本渲染功能。
iMoonLab/DeepHypergraph
一个基于 PyTorch 的深度学习库,用于图与超图神经网络,支持高阶消息传递和 Auto-ML 调优。
lightonai/pylate
一个用于简化 ColBERT 后期交互模型的微调、推理和检索的库,提供高速索引和灵活的训练选项。
Yuliang-Liu/MultimodalOCR
一套用于评估大型多模态模型在多种语言和真实世界场景下OCR与文档解析能力的基准测试(MDPBench、OCRBench v2、OCRBench)集合。
facebookresearch/brain2qwerty
一种从非侵入性脑记录中解码自然句子的系统,可实现打字过程中脑活动到文本的重建。
cloudwego/eino-ext
Eino 框架的官方扩展集合,提供对 LLM 提供商、向量数据库和 DevOps 工具的预构建集成。
chirpz-ai/pandaprobe
一个用于协作追踪、评估、监控和调试 AI 代理的开源代理工程平台。
MiniAiLive/Android-FaceRecognition
用于安全和金融科技应用中防止欺骗的 Android SDK,支持面部识别与 3D 被动式活体检测。
raiyanyahya/recall
一个为 Claude Code 和 OpenCode 设计的完全本地会话记忆工具,可自动记录活动并创建紧凑摘要,以消除冷启动问题。
inworld-ai/tts
一个基于 SpeechLM 的文本转语音系统的训练和建模框架,支持在单 GPU 或多 GPU 集群上进行预训练、SFT 和 RLHF 对齐。
ByteVisionLab/DreamLite
DreamLite 是一个紧凑的 0.39B 参数统一扩散模型,可在设备端完全实现超快速的 1024x1024 图像生成与编辑。
computational-cell-analytics/micro-sam
micro_sam 是一个基于 napari 的库,将 Meta 的 Segment Anything 模型适配用于显微镜成像。它提供仅需几次点击即可完成的交互式 2D/3D 分割与追踪,包含显微镜专用微调的 SAM 权重,并提供可选的自动提示生成和轻量级微调工具。
ljquan/opentu
Opentu 是一个基于画布的 AI 应用平台,将多模型生成和工具管理整合到一个工作区中,实现持续的 AI 任务执行。
eat-pray-ai/yutu
一个 CLI、MCP 服务器和 AI 代理,可自动化 YouTube 频道管理,包括视频上传、SEO 优化和观众互动。
microsoft/RPG-ZeroRepo
一个使用 Repository Planning Graphs (RPG) 作为持久控制层的框架,用于防止 AI 编码代理的需求漂移,并管理复杂的多文件代码库生成与编辑。
thousandbrainsproject/tbp.monty
基于新皮层和皮层柱原理的开源传感器运动学习系统,实现快速、稳健的学习与推理。
FradSer/dotclaude
一套 22 个插件,专为 Claude Code 设计,为开发、研究和硬件设计提供专用智能体和自动化工具。
Realiserad/fish-ai
一个为 Fish shell 设计的 AI 插件,可将注释转换为命令,提供 AI 自动补全,并建议修复无法执行的 shell 命令。
PiSugar/whisplay-ai-chatbot
基于Raspberry Pi构建的口袋尺寸AI聊天机器人,支持语音对语音交互、图像生成和本地AI加速。
ultralytics/yolo-ios-app
一个基于 Swift 的 SDK 和演示应用,通过 Core ML 将实时 YOLO 物件检测与视觉任务带到 iOS 设备上。
motherduckdb/mcp-server-motherduck
一个 Model Context Protocol (MCP) 服务器,将 AI 助手连接至 DuckDB 和 MotherDuck,用于在本地、S3 和 MotherDuck 数据库上执行 SQL 分析和数据工程。
inclusionAI/LLaDA2.X
一系列扩展至 100B 参数的离散扩散大语言模型,为文本生成提供高速并行解码。
OpenDriveLab/WorldEngine
WorldEngine 是一个开源的自动驾驶训练后平台,能自动从真实日志中发现罕见且高安全风险的场景,使用逼真的三维高斯点云(3DGS)重建,并通过强化学习(RL)在生成的回放数据上微调驾驶模型。它包含 SimEngine(闭环仿真)和 AlgEngine(训练/评估)两个子系统,在罕见场景基准测试中表现大幅提升,并在真实世界部署中实现零脱手。
databrickslabs/dbldatagen
一个用于在 Databricks 中使用 Spark 生成可扩展合成数据的 Python 库,专为测试、基准测试和演示而设计。
peterdsharpe/NeuralFoil
一种基于物理信息的机器学习工具,用于快速翼型气动分析,相比 XFoil 在设计优化中显著更快且更稳健。
scaleapi/scale-agentex
一个可从简单聊天机器人扩展到完全自主系统的 AI 代理构建与部署框架,支持同步和异步工作流。
jkawamoto/mcp-youtube-transcript
一个支持分页处理长视频的 MCP 服务器,允许 AI 代理从 YouTube 视频中检索字幕和元数据
tiktoken-go/tokenizer
一个纯 Go 实现的 OpenAI 令牌化器,用于将文本编码和解码为与 OpenAI 模型兼容的标记。
gordonmurray/firnflow
一个以对象存储为主要后端,通过分层 RAM/NVMe 缓存实现低延迟检索的多租户向量和全文搜索引擎。
SoarGroup/Soar
Soar 是一种用于开发表现出智能行为系统的认知架构,提供推理和问题解决的框架。
pykt-team/pykt-toolkit
一个基于 PyTorch 的库,用于通过标准化的数据预处理和多种模型实现来训练和基准测试深度学习知识追踪模型。
pipecat-ai/voice-ui-kit
一个基于 React 的 UI 工具包,提供组件和模板,可快速构建和部署 Pipecat AI 语音应用的用户界面。
pzqpzq/LSF_MDia
MDia 是一个 Python 库,将 LLM 的中间推理形式化为可重用的“方言卡”(LSF),并提供一个确定性的八阶段流水线(collect → create → evolve → profile → select → run → validate-rules → report),用于在异构模型间生成、演化、分析、路由和审计这些协议。它支持黑盒 LLM API,提供多种路由计划,包含 100 条规则库,并通过在测试评估前冻结决策来保证可复现性。该仓库包含一个无需任何 API 密钥的玩具离线演示、详尽的文档、MIT 许可证,以及对 ICML 2026 海报和 arXiv 论文的引用。
clearbluejar/pyghidra-mcp
一个将 Ghidra 逆向工程套件与 LLM 代理集成的 MCP 服务器,支持自动化反编译、语义代码搜索和二进制分析。
yehonathanlitman/Lift4D
Lift4D 通过将每帧的 3D 估计融合到一个可变形模型中,从单视角的「野外」视频中重建出时间一致的 4D 资产。
agent-network-protocol/anp
Agent Network Protocol (ANP) 的多语言 SDK 和参考实现,使 AI 代理能够通过标准化接口实现发现、认证和安全通信。
martin-rizzo/ComfyUI-ZImagePowerNodes
一组专为 Z-Image Turbo 模型优化的 ComfyUI 自定义节点,提供增强的风格控制、低步数一致性以及构图多样性。
Quantatirsk/qwen3-asr
Qwen3‑ASR 是一个自托管语音转文本服务器,封装了 Qwen3‑ASR 模型(0.6 B 与 1.7 B)。它自动选择 GPU‑vLLM 后端或 CPU‑Rust 后端,提供 OpenAI 与阿里云兼容的 HTTP/WebSocket API,支持说话人分离、基于 VAD 的分段、批量推理,并可通过 Docker、自定义 GPU 镜像或离线 tarball 部署。MIT 许可证。
aws/mcp-proxy-for-aws
一个使 AI 应用和代理能够连接到 AWS 托管的 MCP 服务器的桥梁,可自动处理 AWS IAM(SigV4)认证。