bacalhau-project/bacalhau

Bacalhau 是一个分布式计算编排框架,支持「数据上计算」,允许用户在大型数据集存储位置直接运行任务,从而降低延迟和成本。

stan-dev/math

一个用于构建和执行需要导数的算法的 C++ 逆模式自动微分库。

ShichenXie/scorecardpy

一个用于开发传统信用风险评分卡模型的 Python 库,提供变量选择、WoE 分箱和性能评估的工具。

KhronosGroup/OpenCL-Headers

OpenCL API 的官方 C 语言头文件,为在异构计算平台(如 CPU、GPU 和加速器)上开发高性能应用程序提供标准化接口。

BUAA-BDA/OpenHuFu

一个使用安全多方计算(SMC)防止原始数据共享的开源数据联邦系统,用于高效且安全的查询处理。

chainbase-labs/manuscript-core

一种简化多源跨链数据访问与处理的协议和框架,使开发者能够将多个区块链的数据统一整合到一个数据管道中。

Project-Platypus/Platypus

一个专注于多目标进化算法(MOEAs)的 Python 框架,用于解决具有多个目标的复杂优化问题。

BingZi-233/check-cx

一个通过真实请求与随机挑战来探测 AI 模型 API,以检测服务中断与伪造转发的监控工具,并提供可分享的状态看板。

github-copilot-resources/copilot-metrics-viewer

一个为 GitHub 组织和企业管理员设计的仪表板,用于可视化 Copilot 使用指标、跟踪采用情况,并监控 AI 信用账单成本。

joaoh82/rustunnel

用 Rust 编写的开源隧道工具,通过加密 WebSocket 连接安全地将本地服务暴露到公共互联网。

jupyter-server/jupyter_server

一个为 JupyterLab 和 Jupyter Notebook 等 Jupyter web 应用程序提供核心服务和 REST API 的后端服务器。

pulp-platform/ara

Ara 是一个开源的 RISC-V 向量处理器,专为 CVA6 核心设计为协处理器,以高效处理数据并行工作负载。

giovtorres/slurm-docker-cluster

通过 Docker Compose 部署的多容器 Slurm 集群,用于快速开发、测试和轻量级 HPC 作业调度。

rnd-team-dev/plotoptix

基于 NVIDIA OptiX 的 Python 3D 光线追踪包,可实现大规模数据集的逼真、高性能可视化。

aristoteleo/dynamo-release

Dynamo 是一个用于在单细胞 RNA-seq 数据中绘制转录组向量场的分析框架,可预测细胞命运转变和调控机制。

NVIDIA/go-nvml

NVIDIA 的 NVML 库的 Go 绑定,使 Linux 上的 Go 程序可通过驱动 C API 的轻量级、自动生成 + 手写包装器,查询和控制 GPU。

Valdecy/pyMetaheuristic

一个提供400多个元启发式优化算法的Python库,支持协同多岛搜索、约束优化和科学基准测试工具。

stan-dev/pystan

PyStan 是 Stan 的 Python 接口,使科学和商业数据分析中的高性能贝叶斯推断和统计建模成为可能。

eggzec/pyswarm

一个用于Python的无梯度进化优化库,通过实现粒子群优化来解决梯度信息不可用的问题。

immunomind/immunarch

一个用于多模态免疫谱分析的R包,可从大规模AIRR数据集中实现生物标志物发现和机器学习就绪特征生成。

DynamicTimeWarping/dtw-python

用于最优对齐和比较时间序列数据的全面Python实现的动态时间规整(DTW)算法。

KhronosGroup/OpenCL-ICD-Loader

官方 Khronos OpenCL ICD 加载器允许应用程序在不链接特定厂商驱动程序的情况下,与多个 OpenCL 硬件实现进行交互。

wzn1118/AsteriaAnalyst

一个本地数据分板工作台,通过结合 AI 规划与确定性统计执行,将业务电子表格转化为可追溯的管理报告。

alibaba/GraphScope

阿里巴巴开发的统一分布式图计算平台,通过 Python 接口支持在大规模图上进行交互式查询、图分析和 GNN 训练。

hosseinmoein/DataFrame

一个用于内存中表格数据的高性能 C++ 库,为大规模统计和机器学习数据集提供比 Pandas 和 Polars 更快的替代方案。

NebulaiNetwork/OpenCompute

一个去中心化的计算网络,通过浏览器工作节点系统和 Python SDK 为用户提供弹性、分布式处理能力。

timeplus-io/proton

用于实时流处理和分析的高性能 C++ SQL 流水线引擎,是 Apache Flink 和 ksqlDB 的轻量级替代方案。

aws/aws-toolkit-vscode

一个 VS Code 扩展,可将您的 IDE 与 AWS 资源连接起来,使开发者能够无需离开编辑器即可管理基础设施、调试器服务器端功能 (serverless functions) 并浏览日志 (logs) 。

m4rs-mt/ILGPU

用 C# 编写的高性能 GPU 编程 JIT 编译器,使 .NET 开发者无需原生依赖即可编写 GPU 内核。

abinthomasonline/repo2txt

一个浏览器端工具,可将 GitHub、GitLab、Azure DevOps 或本地文件中的代码仓库转换为纯文本,用于 LLM 提示。

chrismattmann/tika-python

一个 Apache Tika 的 Python 版本,通过 REST 服务器实现从各种文件格式中提取文本和元数据、检测 MIME 类型以及识别语言。

sourcey/sourcey

一个将 OpenAPI、MCP 和源代码文档(Go、Rust、C++)整合为单一统一 HTML 网站的静态网站生成器。

austin-weeks/miasma

一个高性能的 Rust 服务器,可将 AI 网络爬虫困在污染训练数据的无限循环中,防止其窃取网站内容。

huaweicloud/ModelArts-Lab

华为云ModelArts平台的示例代码和数据集合集,支持无代码自动化学习和全周期AI模型开发。

cabloy/cabloy

一个用于 AI 氛围编程的 Node.js 全栈框架,使用双向类型同步和 AI 规格驱动开发,实现可追溯、基于证据的交付。

wenet-e2e/WeTextProcessing

面向语音相关AI应用的生产就绪文本处理工具包,支持文本正则化与逆文本正则化,多语言支持。

taybenlor/runno

一组使用 WebAssembly 和 WASI 在浏览器或 Node.js 中安全、隔离地运行多种语言代码的 JavaScript 包。

daft-dev/daft

Daft 是一个使用 matplotlib 渲染出版级概率图模型的 Python 包,允许用户通过可脚本化的语法创建有向图和无向图。

quantumlib/qsim

利用硬件加速和门融合技术,对量子电路的状态向量演化进行高性能模拟的工具。

onmax/nuxt-skills

一组专业知识点模块(技能),用于提升 AI 编码助手在 Vue、Nuxt 和 NuxtHub 生态系统中的熟练度。

scikit-tda/kepler-mapper

用于可视化高维数据拓扑结构的 TDA Mapper 算法的 Python 实现。

fatiando/verde

一个使用类似 scikit-learn 的机器学习启发式接口来处理和网格化空间数据的 Python 库。

PiLastDigit/TRIP-workflow

一种结构化、最小化的 AI 编码代理开发工作流,使用中心架构文件(ARCHI.md)来维持长期记忆并减少幻觉。

openxlings/xlings

一个通用的多平台包管理器,为开发者和AI代理提供多版本共存和类OS隔离(SubOS)功能。

amazon-braket/amazon-braket-examples

Amazon Braket 的教程和示例集合,使用户能够在模拟器和量子硬件上构建、测试和运行量子电路。

CerebriumAI/examples

Cerebrium 平台的即用型部署示例集合,涵盖 LLM、语音代理、图像生成和推理优化。

Nanako0129/coralline

一款受 Powerlevel10k 启发的 Claude Code 状态栏,可显示令牌使用量、速率限制和成本等实时会话指标。

wcipriano/pretty-print-confusion-matrix

一个使用 seaborn 和 matplotlib 绘制视觉上吸引人的混淆矩阵的 Python 库,支持从 NumPy 矩阵或预测向量输入。