bacalhau-project/bacalhau
Bacalhau 是一个分布式计算编排框架,支持「数据上计算」,允许用户在大型数据集存储位置直接运行任务,从而降低延迟和成本。
stan-dev/math
一个用于构建和执行需要导数的算法的 C++ 逆模式自动微分库。
ShichenXie/scorecardpy
一个用于开发传统信用风险评分卡模型的 Python 库,提供变量选择、WoE 分箱和性能评估的工具。
KhronosGroup/OpenCL-Headers
OpenCL API 的官方 C 语言头文件,为在异构计算平台(如 CPU、GPU 和加速器)上开发高性能应用程序提供标准化接口。
BUAA-BDA/OpenHuFu
一个使用安全多方计算(SMC)防止原始数据共享的开源数据联邦系统,用于高效且安全的查询处理。
chainbase-labs/manuscript-core
一种简化多源跨链数据访问与处理的协议和框架,使开发者能够将多个区块链的数据统一整合到一个数据管道中。
Project-Platypus/Platypus
一个专注于多目标进化算法(MOEAs)的 Python 框架,用于解决具有多个目标的复杂优化问题。
BingZi-233/check-cx
一个通过真实请求与随机挑战来探测 AI 模型 API,以检测服务中断与伪造转发的监控工具,并提供可分享的状态看板。
github-copilot-resources/copilot-metrics-viewer
一个为 GitHub 组织和企业管理员设计的仪表板,用于可视化 Copilot 使用指标、跟踪采用情况,并监控 AI 信用账单成本。
joaoh82/rustunnel
用 Rust 编写的开源隧道工具,通过加密 WebSocket 连接安全地将本地服务暴露到公共互联网。
jupyter-server/jupyter_server
一个为 JupyterLab 和 Jupyter Notebook 等 Jupyter web 应用程序提供核心服务和 REST API 的后端服务器。
pulp-platform/ara
Ara 是一个开源的 RISC-V 向量处理器,专为 CVA6 核心设计为协处理器,以高效处理数据并行工作负载。
giovtorres/slurm-docker-cluster
通过 Docker Compose 部署的多容器 Slurm 集群,用于快速开发、测试和轻量级 HPC 作业调度。
rnd-team-dev/plotoptix
基于 NVIDIA OptiX 的 Python 3D 光线追踪包,可实现大规模数据集的逼真、高性能可视化。
aristoteleo/dynamo-release
Dynamo 是一个用于在单细胞 RNA-seq 数据中绘制转录组向量场的分析框架,可预测细胞命运转变和调控机制。
NVIDIA/go-nvml
NVIDIA 的 NVML 库的 Go 绑定,使 Linux 上的 Go 程序可通过驱动 C API 的轻量级、自动生成 + 手写包装器,查询和控制 GPU。
Valdecy/pyMetaheuristic
一个提供400多个元启发式优化算法的Python库,支持协同多岛搜索、约束优化和科学基准测试工具。
stan-dev/pystan
PyStan 是 Stan 的 Python 接口,使科学和商业数据分析中的高性能贝叶斯推断和统计建模成为可能。
eggzec/pyswarm
一个用于Python的无梯度进化优化库,通过实现粒子群优化来解决梯度信息不可用的问题。
immunomind/immunarch
一个用于多模态免疫谱分析的R包,可从大规模AIRR数据集中实现生物标志物发现和机器学习就绪特征生成。
DynamicTimeWarping/dtw-python
用于最优对齐和比较时间序列数据的全面Python实现的动态时间规整(DTW)算法。
KhronosGroup/OpenCL-ICD-Loader
官方 Khronos OpenCL ICD 加载器允许应用程序在不链接特定厂商驱动程序的情况下,与多个 OpenCL 硬件实现进行交互。
wzn1118/AsteriaAnalyst
一个本地数据分板工作台,通过结合 AI 规划与确定性统计执行,将业务电子表格转化为可追溯的管理报告。
alibaba/GraphScope
阿里巴巴开发的统一分布式图计算平台,通过 Python 接口支持在大规模图上进行交互式查询、图分析和 GNN 训练。
hosseinmoein/DataFrame
一个用于内存中表格数据的高性能 C++ 库,为大规模统计和机器学习数据集提供比 Pandas 和 Polars 更快的替代方案。
NebulaiNetwork/OpenCompute
一个去中心化的计算网络,通过浏览器工作节点系统和 Python SDK 为用户提供弹性、分布式处理能力。
timeplus-io/proton
用于实时流处理和分析的高性能 C++ SQL 流水线引擎,是 Apache Flink 和 ksqlDB 的轻量级替代方案。
aws/aws-toolkit-vscode
一个 VS Code 扩展,可将您的 IDE 与 AWS 资源连接起来,使开发者能够无需离开编辑器即可管理基础设施、调试器服务器端功能 (serverless functions) 并浏览日志 (logs) 。
m4rs-mt/ILGPU
用 C# 编写的高性能 GPU 编程 JIT 编译器,使 .NET 开发者无需原生依赖即可编写 GPU 内核。
abinthomasonline/repo2txt
一个浏览器端工具,可将 GitHub、GitLab、Azure DevOps 或本地文件中的代码仓库转换为纯文本,用于 LLM 提示。
chrismattmann/tika-python
一个 Apache Tika 的 Python 版本,通过 REST 服务器实现从各种文件格式中提取文本和元数据、检测 MIME 类型以及识别语言。
sourcey/sourcey
一个将 OpenAPI、MCP 和源代码文档(Go、Rust、C++)整合为单一统一 HTML 网站的静态网站生成器。
austin-weeks/miasma
一个高性能的 Rust 服务器,可将 AI 网络爬虫困在污染训练数据的无限循环中,防止其窃取网站内容。
huaweicloud/ModelArts-Lab
华为云ModelArts平台的示例代码和数据集合集,支持无代码自动化学习和全周期AI模型开发。
cabloy/cabloy
一个用于 AI 氛围编程的 Node.js 全栈框架,使用双向类型同步和 AI 规格驱动开发,实现可追溯、基于证据的交付。
wenet-e2e/WeTextProcessing
面向语音相关AI应用的生产就绪文本处理工具包,支持文本正则化与逆文本正则化,多语言支持。
taybenlor/runno
一组使用 WebAssembly 和 WASI 在浏览器或 Node.js 中安全、隔离地运行多种语言代码的 JavaScript 包。
daft-dev/daft
Daft 是一个使用 matplotlib 渲染出版级概率图模型的 Python 包,允许用户通过可脚本化的语法创建有向图和无向图。
quantumlib/qsim
利用硬件加速和门融合技术,对量子电路的状态向量演化进行高性能模拟的工具。
onmax/nuxt-skills
一组专业知识点模块(技能),用于提升 AI 编码助手在 Vue、Nuxt 和 NuxtHub 生态系统中的熟练度。
scikit-tda/kepler-mapper
用于可视化高维数据拓扑结构的 TDA Mapper 算法的 Python 实现。
fatiando/verde
一个使用类似 scikit-learn 的机器学习启发式接口来处理和网格化空间数据的 Python 库。
PiLastDigit/TRIP-workflow
一种结构化、最小化的 AI 编码代理开发工作流,使用中心架构文件(ARCHI.md)来维持长期记忆并减少幻觉。
openxlings/xlings
一个通用的多平台包管理器,为开发者和AI代理提供多版本共存和类OS隔离(SubOS)功能。
amazon-braket/amazon-braket-examples
Amazon Braket 的教程和示例集合,使用户能够在模拟器和量子硬件上构建、测试和运行量子电路。
CerebriumAI/examples
Cerebrium 平台的即用型部署示例集合,涵盖 LLM、语音代理、图像生成和推理优化。
Nanako0129/coralline
一款受 Powerlevel10k 启发的 Claude Code 状态栏,可显示令牌使用量、速率限制和成本等实时会话指标。
wcipriano/pretty-print-confusion-matrix
一个使用 seaborn 和 matplotlib 绘制视觉上吸引人的混淆矩阵的 Python 库,支持从 NumPy 矩阵或预测向量输入。