K-Dense-AI/science-superpowers

一种为AI代理强制执行预注册和可复现性的计算科学方法论,以防止p-hacking并确保研究结果可验证。

johnbean393/KeyType

一个开源、本地运行的 macOS 系统级 tab 自动补全工具,使用本地 LLM 提供幽灵文本预测。

NVlabs/SOMA-X

SOMA‑X 是一个 Python 库,提供参数化人体和手部的统一可微分表示,支持多种身份模型(MHR、SMPL‑X、MANO 等),并通过 NVIDIA Warp 提供快速蒙皮。它包含用于不同细节级别全身和手部网格的 `SOMALayer` 和 `SOMAHandLayer`,以及姿态逆解、绑定控制和数据 I/O 工具,使其适用于动画、姿态估计拟合和合成数据生成。

hoolulu/deep-research

一个自动化的多智能体系统,通过四阶段的搜索与验证流程,以 19 种语言生成机构级且可引用的研究报告。

leopard627/fire-your-seo-agency

一个Claude Code技能,可自动化网站优化,适用于传统搜索引擎和AI答案引擎(AEO、GEO、LLMO),以提升引用率和可见性。

b-nnett/grok-bot-0.18-reconstructed

一个面向源码的 Grok Bot 0.18.0 macOS 重构版本,增加了多 AI 服务提供商的推理路由功能和本地 Docker 沙箱。

bupticybee/TexasSolver

一个高效的 C++ 求解器,用于计算德州扑克和短牌扑克中的最优游戏策略。

theJayTea/WritingTools

Writing Tools 是一款免费开源的桌面应用,支持 Windows、Linux 和 macOS,可通过快捷键在计算机任意位置调用 LLM。它可进行校对、重写、改变语气、翻译、总结网页或 YouTube 字幕,甚至与模型聊天。支持使用云 API(Gemini、OpenAI、Anthropic 等)或通过 Ollama、llama.cpp、Apple-silicon MLX 运行本地模型。该应用注重隐私(无遥测、API 密钥本地存储),并采用 GPL-v3 许可证。

SunOner/sunone_aimbot_2

一个基于C++的AI瞄准助手,利用计算机视觉模型检测目标并自动化游戏中的鼠标移动。

zju3dv/InfiniSplat

InfiniSplat 是一种用于大基线单目视图合成的系统,能够从单张 RGB 图像或 RGB-深度对中重建 3D 高斯点云场景。

Slicer/Slicer

3D Slicer 是一个用于可视化和分析 3D 医学影像数据的免费开源软件包。

chrxh/alien

ALIEN 是一个基于 CUDA 的 2D 人工生命模拟器,粒子可形成由神经网络控制的软体生物。它提供实时 GPU 物理、可视化编辑器、基于基因组的进化、用于共享模拟的网络功能,以及用于无头运行的命令行模式。使用 CMake/Ninja 构建,可在 NVIDIA GPU(或通过 ROCm 支持 AMD GPU)上运行,采用 BSD-3 许可证。

xnx3/translate

一个用于自动 HTML 页面翻译的 JavaScript 库,无需语言文件或 API 密钥即可实现多语言支持,并支持 AI 驱动的翻译和私有化部署。

lopopolo/harness-engineering

一种通过围绕AI代理塑造环境、上下文和工具,而非修改模型本身,来提升AI代理输出的框架。

NVIDIA/dcgm-exporter

NVIDIA DCGM‑Exporter 是一个基于 Go 的服务,从 NVIDIA 的 DCGM 读取 GPU 传感器数据,并将其作为 Prometheus 指标暴露。它可作为 Docker 容器、systemd 服务或 Helm 部署的 Pod 运行,支持 TLS/身份验证、自定义指标集、IPv6、远程 hostengine 连接,以及可选的 HPC 作业或容器标签。适用于 AI/ML 平台监控、Kubernetes GPU 集群和 HPC 环境。

Skyvern-AI/rustwright

Playwright 的原生 Rust 重写,为 Chromium 提供更快、内存占用更低的浏览器自动化引擎,并内置 AI Agent 工具。

bquenin/interpreter

一款用于日本复古游戏的离线屏幕翻译器,利用 OCR 和本地 LLM 通过浮动覆盖层提供实时英文字幕。

huifer/WellAlly-health

一种本地优先、AI驱动的个人健康记录系统,可将医疗文档转化为您自己机器上的私有、可搜索知识库。

stackblitz/bolt-slides

一个将演示文稿制作为交互式 Web 应用的框架,使 AI 智能体能够通过单个提示词生成包含 3D 和实时数据的实时响应式幻灯片。

centerforaisafety/hle

Humanity's Last Exam (HLE) 是一个由专家开发的多模态基准,包含2,500个跨多个学术领域的高质量问题,旨在测试AI知识的极限。

fossasia/voxbento

一个为现场活动设计的实时口译平台,允许口译员通过基于浏览器的低延迟流将翻译后的音频广播给与会者。

sleepinginsummer/agent-browser-cli

一个 CLI 工具,将 AI Agent 与真实 Chrome 浏览器会话连接,使其能够复用登录状态并执行精确的页面控制与感知。

Radiant303/SpringNote

一款由 AI 驱动的笔记与日记应用,能自动将零散思绪整理为结构化报告,并支持与过去记忆对话。

ROCm/rocm-systems

用于简化PyTorch构建所需库和工具的开发、CI及集成的ROCm系统项目整合超级仓库

weirdmachine64/GhidraGPT

一个将LLM集成到反编译工作流中,用于解释、重命名和审计反编译C函数的Ghidra扩展。

spring-ai-community/spring-ai-agent-utils

一个重构 Claude Code 启发式工具与技能的 Spring AI 库,使 Java 开发者能够构建具备文件系统访问、shell 执行和长期记忆能力的代理。

linkedin/Liger-Kernel

通过内核融合和分块技术,该高效 Triton 内核集合可将 LLM 训练吞吐量提升 20%,内存使用量降低 60%。

vercel-labs/zerolang

一种实验性的图原生编程语言,允许 AI 代理编辑语义程序数据库而非源文本,以减少猜测和错误。

breaking-brake/cc-wf-studio

一个用于 AI 代理的可视化工作流设计器,允许用户在画布上创建编排,并导出为 Claude Code 和 Cursor 等工具可用的 Markdown 技能。

huggingface/text-embeddings-inference

用于以低延迟部署和提供开源文本嵌入及序列分类模型服务的高性能推理工具包。

amap-cvlab/ABot-World

ABot-World 是一个实时交互世界模拟器,可在单个桌面 GPU 上实现无限、行动条件化的视频生成。

githubnext/agentics

一组可重用的智能工作流集合,用于自动化 GitHub 仓库的维护、代码审查、故障分析和文档更新。

NVIDIA/cudnn-frontend

NVIDIA 的 cuDNN Frontend 是一个开源的纯头文件 C++ API 加上 Python 绑定,简化了在 Hopper 和 Blackwell GPU 上构建高性能深度学习内核(注意力机制、GEMM、融合操作)的过程。它提供了现成的 JIT 编译内核,包括 Flash-Attention、混合专家 GEMM 融合、稀疏/线性注意力等,均可通过统一的 Graph API 和 PyTorch 兼容操作访问。

the-database/mpv-AnimeJaNai

一个定制的 mpv 视频播放器构建版本及一套 Real-ESRGAN 模型,能够使用 TensorRT 或 DirectML 实现动漫内容的实时 4K 放大。

a2aproject/a2a-go

一个 Go SDK,用于构建和与遵循 Agent2Agent (A2A) 协议的代理应用程序进行交互,实现标准化通信。

dacnay816y62-hub/photo-revival

一套 AI 技能指令,能将普通照片转化为极简、充满诗意的手绘插画,并带有大量留白与微小的手写字幕。

Finrandojin/alexandria-audiobook

Alexandria 是一个本地运行的网页应用,可将文本文件(txt/md/epub)转换为完整的有声书。它使用 LLM 为书籍添加说话人标签和 TTS 指令,然后使用内置的 Qwen-3 TTS 引擎合成每行内容。用户可从九种预设声音中选择,从短样本克隆声音,使用 LoRA 微调声音,或通过文本描述生成新声音。UI 支持编辑脚本、批量生成音频(GPU 加速),并可导出为 MP3、M4B 或 Audacity 用的每角色 WAV 轨道。

devnen/Chatterbox-TTS-Server

为 Resemble AI 的 Chatterbox TTS 系列提供的自托管服务器,具备 Web UI 和兼容 OpenAI 的 API,支持语音克隆、多语言支持及有声书生成。

rediumvex/ai-video-generator-claude

为 Higgsfield 上的 Seedance 2.0 生成专业、电影级视频提示词的 Claude 提示词工程技能集。

Robbyant/lingbot-video

一个专为具身智能设计的开源 MoE 视频生成模型,旨在为机器人学和物理世界理解合成在物理上合理的视频。

bytedance/Bernini

Bernini 是一个统一的视频生成与编辑框架,结合了基于 MLLM 的语义规划器与基于 DiT 的渲染器,以提升指令遵循能力与复杂视频编辑效果。

sii-research/tau-0-vla

一种面向长时程操作的分层机器人基础模型,利用世界模型引导的高层策略进行规划,以及通用的低层策略进行执行。

NVIDIA/flashdreams

一个用于交互式自回归视频与世界模型的高性能推理与服务库,针对机器人与自动驾驶车辆的实时应用进行了优化。

kubeshark/kubeshark

一款用于 Kubernetes 的网络观测工具,利用 eBPF 对流量进行索引,并通过 MCP 集成提供 AI 驱动的故障排除功能。

gemini-cli-extensions/conductor

一个为 AI 编码代理程序(AI coding agents)设计的插件,强制执行“规格驱动开发”(Spec-Driven Development)工作流,要求代理程序在实现代码之前先定义项目上下文、规格和计划。

runvendo/vendo

一个面向 B2B SaaS 的开源定制层,通过嵌入式代理与产品 API 交互,让用户能够构建自己的功能和微应用。

tastyeffectco/sandboxd

一个开源、自托管的 AI 应用构建引擎,使用代码代理在您自己的服务器上隔离的 Docker 沙箱中创建和托管真实应用程序。

autowarefoundation/vision_pilot

一种开源的 L2 ADAS 软件栈,通过混合 AI 架构和单个单目摄像头,无需 HD 地图即可实现自动巡航控制和车道保持。