pnnx/pnnx

pnnx 是一個開源工具,可優化 PyTorch 模型並導出為輕量、無依賴的格式(PNNX)以及 ncnn/ONNX-zero 檔案,使邊緣裝置上的快速推論成為可能。

aryn-ai/sycamore

一個用於 ETL 和 RAG 的 AI 驅動文件處理引擎,可將非結構化文件轉換為高品質的資料區塊,供向量資料庫使用。

Lightning-AI/litData

LitData 是 Lightning AI 的一個庫,透過提供快速、雲原生的資料管道來加速 PyTorch 訓練。它提供兩種主要模式:(1) `StreamingRawDataset` 可直接從 S3/GCS/Azure/HF Hub 串流傳輸原始檔案,支援非同步、批次下載;(2) `ld.optimize` 可將資料集轉換為 LitData 自有的分塊二進位格式,實現高達 20 倍的串流傳輸、洗牌與可恢復 epoch 速度提升。該庫還包含用於預處理(如影像縮放、嵌入生成)的並行 `map` 原語,以及對影像、音訊、影片、張量、圖等多種模態的完整支援。與 PyTorch Lightning、Hugging Face datasets 和 Lightning Cloud 的整合,使其成為 I/O 成為瓶頸的大規模 ML 專案的實用工具。

QJHWC/PaperForge

PaperForge Research OS v3 是一款基於 Python 的工具,整合了 AI 輔助論文寫作、實驗編排、產出物追蹤及可驗證的出版流程。它將每個主張與證據的連結儲存在 SQLite「科學記憶庫」中,強制執行三種執行設定檔(僅寫作、研究、完整),並支援本地、Docker、SSH、Slurm、Kubernetes 及雲端運算後端。透過 CLI (`paperforge …`) 與本地網頁 UI,使用者可執行工作流程、批准提案、使用內建模板(generic、CVPR、IEEE、Elsevier)編譯 LaTeX,並在進行密鑰掃描後發布確定性的原始碼包。專為可重現的學術研究設計,以非商業授權開源。

facebookresearch/mvdust3r

一種單階段 3D 場景重建工具,只需約 2 秒即可從稀疏 RGB 視圖中建立 3D 點雲與相機姿態,無需預先知道相機姿態。

scikit-tda/scikit-tda

一組專為非拓撲學專家設計的拓撲資料分析(TDA)Python 套件,旨在讓拓撲資料工具更易於使用。

EnzymeAD/Enzyme.jl

Enzyme 的 Julia 綁定,這是一個在 LLVM 上運行的、可為優化後的代碼提供高效梯度計算的高性能自動微分工具。

PrimeIntellect-ai/OpenDiloco

透過分散式權重平均化減少通訊開銷的大型模型全球分散式訓練開源框架。

PacificAI/langtest

用於測試 NLP 與 LLM 模型穩健性、偏差、公平性與安全性的綜合性評估工具。

SII-Holos/synergy

一個開源的AI代理工作區,提供持久、可恢復的會話以及軟體與知識工作的統一執行環境。

e-sensing/sits

SITS 是一個開源 R 套件(附帶 Python 包裝器),用於建構、正則化與分類衛星影像時序資料立方體。它可連接多個公開地球觀測資料集,提供一系列 ML/DL 模型(包括 GPU 加速的 CNN 與注意力編碼器),並提供從訓練、分類、平滑、不確定性估計到主動學習的端對端工具。

irockel/tda

一個提供 GUI 和 MCP 伺服器的 Java 線程轉儲與堆分析工具,用於診斷死結、效能問題和虛擬線程釘住。

zsylvester/segmenteverygrain

一個用於透過混合 U-Net 與 SAM 2.1 方法檢測與分割影像中顆粒的 Python 套件,專為地貌學與沉積地質學研究設計。

rodmarkun/SmolML

一個完全從零開始構建的純 Python 機器學習庫,專為教育目的設計,提供核心 ML 算法的透明實作與自動微分引擎。

nschaetti/EchoTorch

一個以研究為導向的 PyTorch 模組,用於實現與測試回聲狀態網絡與水庫計算,設計用於整合至深度架構中。

visionworkbench/visionworkbench

由 NASA 開發的 C++ 函式庫,用於通用型影像處理與電腦視覺,提供相機模型、地圖投影與馬賽克合成工具。

camel-ai/loong

透過合成數據生成與自動驗證的自我改進循環來擴展具備推理能力的模型的框架。

RosettaCommons/rosetta

用於蛋白質結構、酵素與生物大分子的計算分析與設計的生物分子建模庫。

radareorg/r2ai

一組用於 radare2 的外掛程式,整合 LLM 以協助逆向工程任務,例如函數解釋、漏洞發現與增強式反組譯。

uncomplicate/deep-diamond

一個利用優化原生程式庫實現 CPU 與 GPU 加速的高性能張量與神經網路計算 Clojure 套件。

receptron/mulmocast-cli

一個使用 JSON 基礎中間語言 MulmoScript 生成影片、播客與簡報等多模態內容的 AI 原生簡報平台。

microsoft/onnxruntime-extensions

一個 C/C++ 函式庫,透過自定義算子擴展 ONNX Runtime,以便在 ONNX 圖中處理視覺、文本和 NLP 模型的預處理與後處理。

Seeed-Studio/ModelAssistant

一個用於在低成本嵌入式裝置與微控制器上部署優化AI演算法的工具鏈,支援電腦視覺、異常偵測與情境特定任務。

axclogo/AxcAgentEngine

一個將簡單 ReAct 迴圈取代為計畫-觀察-重計畫(POR)系統的代理執行引擎,用於更可靠地執行複雜任務。

facebookresearch/vizseq

VizSeq 是一個 Python 工具包,用於對文字生成輸出(MT、摘要、描述、語音/影片翻譯等)進行視覺化、互動式分析。它並行計算許多標準和基於嵌入的指標,並在 Jupyter 筆記本或內建 Web 應用程式中顯示結果,可選 Fairseq 整合。

NVlabs/nvdiffrecmc

使用蒙特卡洛渲染與去噪技術,基於多視角影像聯合重建3D拓撲、材質與光照的PyTorch實作。

mcpdotdirect/evm-mcp-server

一個MCP伺服器,讓AI代理能與60多個EVM相容區塊鏈互動,提供代幣轉帳、智慧合約互動(自動ABI取得)、ENS解析等功能。

ml-struct-bio/cryodrgn

一種基於神經網路的演算法,用於對異質性冷凍電鏡與冷凍電鏡斷層成像中的連續3D結構分佈進行建模。

blueqat/blueqatSDK

基於 PyTorch 的量子計算 SDK,可在模擬器或真實硬體上模擬、最佳化與執行量子電路,具備可微分執行與專用自旋量子位元支援。

WP-Autoplugin/wp-autoplugin

一個用於 WordPress 的代理式編碼工具,允許使用者透過 LLM 在管理後台直接規劃、產生與審查插件與主題程式碼。

yihaosun1124/OfflineRL-Kit

一個用於離線強化學習的 PyTorch 函式庫,提供最先進的無模型 (model-free) 與基於模型 (model-based) 演算法的標準化框架與實作。

JamesShi96/project-butler

一種為 AI 編程助手設計的持久記憶系統,使用結構化 Markdown 基礎的記憶堆疊,在會話間維持專案上下文、規則與進度。

adalca/neurite

用於醫學影像分析的神經網路工具箱,提供專用張量運算、預建架構與空間資料繪圖工具。

ahmadvh/octochains

一種輕量級 Python 框架,用於並行、隔離的多智能體推理與共識,防止高風險決策中的智能體偏見與群體思維。

Talmaj/onnx2pytorch

一個將 ONNX 模型轉換為 PyTorch 模型的程式庫,使使用者能利用 PyTorch 的後端與神經網路操作工具。

linus-sch/Mind-Map-Wizard

一個利用 LLM 和自訂 SVG 渲染引擎,將主題或檔案轉換為互動式視覺思維導圖的 AI 工具。

timwuhaotian/the-pair

一個開源 AI 配對程式設計應用,使用 Mentor 代理進行審查,Executor 代理撰寫程式碼,透過交叉驗證減少幻覺

langchain-ai/langconnect

一個使用 FastAPI 和 LangChain 建構的 RAG 服務,透過 PostgreSQL 和 pgvector 提供用於管理文件集合和執行語意搜尋的 REST API。

SomeB1oody/RustyML

一個完全以 Rust 實作的機器學習與深度學習函式庫,不需 C/C++ 依賴,提供從資料預處理到模型評估的完整工作流程。

SciML/SciMLBenchmarks.jl

一個用於科學機器學習和方程式求解器的綜合基準測試套件,可衡量各種數值方法的工作精度效率。

Weistrass/DyRef

一個兩階段訓練框架,使用動態獎勵最佳化使影像生成模型能夠準確結合多張不同類型的參考影像。

ussoewwin/ComfyUI-QwenImageLoraLoader

一組 ComfyUI 自訂節點,可載入並堆疊 Nunchaku Qwen‑Image、Z‑Image‑Turbo 與 Krea2 ControlNet 模型的 LoRA 權重,支援 UI 控制、實驗性 AWQ 調製支援與 DiffSynth ControlNet 集成。

ascorbic/am-i-vibing

一個適用於 Node.js 應用程式的函式庫與 CLI 工具,用於偵測它們是否正由 AI 代理程式或 AI 驅動的編碼環境執行,以調整其輸出。

tianclll/Ace-Translate

一款專注於隱私的離線文件翻譯工具,使用本地 LLM 和 OCR 翻譯多種檔案格式,同時保留原始版面配置。

jiaxiaogang/HE

he4o 是一個基於 Helix 熵減理論的 AGI 系統,結合預先設計的規則與動態學習,實現具身智能與終身學習。

SciML/DiffEqGPU.jl

一個用於微分方程求解器的 GPU 加速函式庫,能夠跨多個參數和初始條件進行平行求解。

scottvr/wtffmpeg

一個命令列工具,使用 LLM 將影片與音訊任務的自然語言描述轉換為可執行的 ffmpeg 命令。

stereolabs/zed-ros2-wrapper

Stereolabs ZED 深度相機的官方 ROS 2 包裝器,支援影像、深度、點雲、SLAM、物件檢測、人體追蹤、GNSS 融合及模擬。可在 Ubuntu 上安裝 ZED SDK 與 CUDA,透過 `ros2 launch zed_wrapper zed_camera.launch.py` 啟動。