jax-ml/ml_dtypes

一個獨立的 NumPy dtype 擴充實作,支援機器學習中的 bfloat16、8 位浮點數與窄整數等低精度格式。

AllenInstitute/bmtk

Brain Modeling Toolkit (BMTK) 是一個開源軟體套件,可用於在多個解析度層級上建立、模擬和分析大規模腦網絡。

bamsumit/slayerPytorch

一個 PyTorch 實作,用於透過反向傳播學習突觸權重與軸突延遲,以訓練多層脈衝神經網路。

ViciousSquid/Dosidicus

一個透明的認知沙盒和數位寵物模擬,允許用戶透過飼養一個可以實時觀察和追蹤的神經網絡來學習神經科學。

cazala/synaptic

一個用於 Node.js 和瀏覽器的 JavaScript 神經網路函式庫,允許建立與訓練靈活且無架構限制的神經網路。

common-voice/common-voice

一個用於收集語音捐贈的 Web 應用程式,旨在建立用於訓練語音辨識相關工具的公共領域數據集。

VRSEN/OpenSwarm

一個協調專業 AI 代理的多代理系統,僅需一個終端提示即可生成簡報投影片、研究報告與影片等專業交付物。

onnx/tensorflow-onnx

一個將 TensorFlow、Keras、TensorFlow.js 與 TFLite 模型轉換為 ONNX 格式,以實現跨平台相容性與部署的工具。

facebookresearch/fvcore

為 FAIR 開發的電腦視覺框架提供核心共享功能與工具的輕量級核心函式庫。

flexflow/flexflow-train

透過自動搜尋最高效的平行化策略,加速分散式 DNN 訓練的深度學習框架。

aeonfun/opendia

一個開源的 MCP 伺服器與瀏覽器擴充功能,讓 AI 模型可以使用您現有的登入帳戶與會話資料來控制您的瀏覽器。

JuliaAI/MLJ.jl

MLJ 是 Julia 的機器學習工具箱,提供統一介面與元演算法,用於選擇、調校與比較超過 200 個機器學習模型。

Vchitect/Latte

一種用於高品質影片生成的潛在擴散 Transformer,支援文字到影片與文字到影像任務。

Lightning-AI/lightning-thunder

一個為 PyTorch 設計的源到源編譯器,透過 Python 風格的中間表示與可擴展的轉換外掛,優化模型在訓練與推論中的效能。

pnnl/neuromancer

一個結合機器學習與科學計算,用於求解參數化約束最佳化與物理資訊導向系統識別的可微分程式設計套件。

tensorflow/text

一組用於 TensorFlow 的文字處理類別與運算,可在訓練與推論的 TensorFlow 圖中實現一致的預處理。

yym68686/uni-api

uni‑api 是一個僅透過設定運作的伺服器,提供單一 OpenAI 相容 API,同時將請求路由至多個 LLM 提供商(OpenAI、Anthropic、Gemini、Vertex、Azure、AWS 等)。支援加權與輪詢負載平衡、自動重試、每模型超時、速率限制、工具呼叫透傳、內容審核以及細粒度請求覆蓋——所有設定皆透過 `api.yaml` 檔案或 `CONFIG_URL` 定義。可作為 Docker 容器部署(提供一鍵 Fugue 按鈕)

flutter-ml/google_ml_kit_flutter

一組 Flutter 外掛程式,讓行動應用能使用 Google 的獨立 ML Kit 實現裝置端的視覺、自然語言與生成式 AI 功能。

yongliang-wu/DFT

透過基於預測機率動態重新縮放 Token 損失,在監督式微調(SFT)期間提高 LLM 的泛化能力,對推理任務特別有效。

ikawaha/kagome

一個純 Go 實作的日本語形態分析器,可將文字分詞並分析詞性,詞典內嵌,部署輕鬆。

BabitMF/bmf

由 ByteDance 開發的跨平台多媒體處理框架,支援高性能量影片轉碼、編輯與 AI 推論,並具備強大的 GPU 加速能力。

AndersonBY/vector-vein

VectorVein 是一個跨平台、無程式碼的桌面應用,用於建立 AI 驅動的自動化工作流程。它讓使用者可視覺化連接 LLM 呼叫、嵌入、語音轉文字等節點,支援任何 OpenAI 相容端點(OpenAI、Ollama、LM‑Studio 等),提供本地 FastAPI REST API 供程式化執行,並以 pywebview 建構的單一可執行檔形式發行。

fal-ai/fal

一個無需管理基礎設施即可在雲端部署和擴展機器學習模型與流程的無伺服器 Python 執行環境與客戶端程式庫。

SegmentationBLWX/sssegmentation

一個基於 PyTorch 的監督式語義分割工具箱,提供統一框架與廣泛模型倉庫,用於訓練與測試分割演算法。

thekevinscott/UpscalerJS

一個可在瀏覽器或 Node.js 中使用 AI 實現影像解析度提升、去噪和去模糊的 JavaScript 套件。

huggingface/dataset-viewer

Hugging Face 資料集檢視器的後端 API,讓使用者能透過預先計算的資料,瀏覽、過濾並檢視 Hub 上的資料集。

kendryte/nncase

一個用於 AI 加速器的神經網路編譯器,可將 TFLite、Caffe 和 ONNX 格式的模型優化並部署到 K210、K510 和 K230 等專用硬體上。

scribeocr/scribeocr

一個瀏覽器端的網路應用程式,用於從影像中辨識文字,以高精度校對OCR資料,並建立完全數位化、ebook風格的文件。

omnimind-ai/OmniInfer

一個高效能、跨平台的推論引擎,用於在桌面、行動和邊緣裝置上本地執行 LLM 和 VLM。

Restream/reindexer

一個以 C++ 和 Go 寫成的可嵌入式記憶體文件資料庫,提供高性能的 Elasticsearch 替代方案,支援向量搜尋與全文搜尋。

RichmondAlake/memorizz

一個用於建構記憶優先 AI 代理的 Python 框架,這些代理使用持久的情節記憶、語意記憶與程序記憶來回憶經驗並隨著時間學習新技能。

mandiant/stringsifter

一種自動對二進位檔中提取的字串進行排序的機器學習工具,協助惡意軟體分析人員快速識別最相關的資訊。

mistralai/client-python

Mistral AI 的雲端 API(聊天、嵌入、音訊、檔案、代理等)官方 Python SDK。透過 pip/uv/poetry 安裝,設定 `MISTRAL_API_KEY`,即可同步或使用 `asyncio` 呼叫 `client.chat.complete(...)`。包含 Azure 與 GCP 封裝,支援串流、分頁、重試等。

RPG-fan/Cline-Recursive-Chain-of-Thought-System-CRCT-

Cline VS Code 擴展的框架,透過遞迴式檔案追蹤系統與本地 LLM 協助分析,管理大型專案的上下文與相依性。

iot-salzburg/gpu-jupyter

GPU‑Jupyter 提供基於 Docker 的 GPU 支援 JupyterLab 環境,預安裝 Python、PyTorch、TensorFlow、Julia 和 R。支援版本映像、易於自訂與 Docker‑Compose,可在任何配備 NVIDIA GPU 的機器上實現可重現的深度學習實驗。

microsoft/TypeAgent

TypeAgent 是微軟開源的一個範例,展示如何使用大型語言模型、結構化提示和一種新穎的「結構化 RAG」記憶系統,建構單一的個人 AI 助理。它包含一個 Electron 外殼、一個將自然語言請求路由至類型化代理的調度器、一個將對話事實儲存為邏輯實體的記憶層,以及一個減少 LLM 呼叫的快取。該倉儲提供許多範例代理(日曆、郵件、瀏覽器等)和一個用於新增自訂代理的 SDK。這是一個早期階段的範例程式碼,僅在 Azure OpenAI 上以英文測試過,未經進一步驗證前不適合用於生產環境。

texttron/tevatron

一個使用 LLM 在不同語言和模態下訓練與部署十億級神經檢索器的統一工具包。

MarioSieg/magnetron

一個基於 C 語言的緊湊型機器學習執行環境,配備 Python API,可對張量執行與記憶體進行完全控制,適用於研究與低階最佳化。

kubeflow/kale

透過對單元格進行標記,將 Jupyter Notebook 轉換為生產就緒的 Kubeflow Pipelines,從而無需使用 KFP SDK 重寫程式碼的工具。

pnnx/pnnx

pnnx 是一個開源工具,可優化 PyTorch 模型並導出為輕量、無依賴的格式(PNNX)以及 ncnn/ONNX-zero 檔案,使邊緣裝置上的快速推論成為可能。

aryn-ai/sycamore

一個用於 ETL 和 RAG 的 AI 驅動文件處理引擎,可將非結構化文件轉換為高品質的資料區塊,供向量資料庫使用。

Lightning-AI/litData

LitData 是 Lightning AI 的一個庫,透過提供快速、雲原生的資料管道來加速 PyTorch 訓練。它提供兩種主要模式:(1) `StreamingRawDataset` 可直接從 S3/GCS/Azure/HF Hub 串流傳輸原始檔案,支援非同步、批次下載;(2) `ld.optimize` 可將資料集轉換為 LitData 自有的分塊二進位格式,實現高達 20 倍的串流傳輸、洗牌與可恢復 epoch 速度提升。該庫還包含用於預處理(如影像縮放、嵌入生成)的並行 `map` 原語,以及對影像、音訊、影片、張量、圖等多種模態的完整支援。與 PyTorch Lightning、Hugging Face datasets 和 Lightning Cloud 的整合,使其成為 I/O 成為瓶頸的大規模 ML 專案的實用工具。

QJHWC/PaperForge

PaperForge Research OS v3 是一款基於 Python 的工具,整合了 AI 輔助論文寫作、實驗編排、產出物追蹤及可驗證的出版流程。它將每個主張與證據的連結儲存在 SQLite「科學記憶庫」中,強制執行三種執行設定檔(僅寫作、研究、完整),並支援本地、Docker、SSH、Slurm、Kubernetes 及雲端運算後端。透過 CLI (`paperforge …`) 與本地網頁 UI,使用者可執行工作流程、批准提案、使用內建模板(generic、CVPR、IEEE、Elsevier)編譯 LaTeX,並在進行密鑰掃描後發布確定性的原始碼包。專為可重現的學術研究設計,以非商業授權開源。

facebookresearch/mvdust3r

一種單階段 3D 場景重建工具,只需約 2 秒即可從稀疏 RGB 視圖中建立 3D 點雲與相機姿態,無需預先知道相機姿態。

scikit-tda/scikit-tda

一組專為非拓撲學專家設計的拓撲資料分析(TDA)Python 套件,旨在讓拓撲資料工具更易於使用。

EnzymeAD/Enzyme.jl

Enzyme 的 Julia 綁定,這是一個在 LLVM 上運行的、可為優化後的代碼提供高效梯度計算的高性能自動微分工具。

PrimeIntellect-ai/OpenDiloco

透過分散式權重平均化減少通訊開銷的大型模型全球分散式訓練開源框架。

PacificAI/langtest

用於測試 NLP 與 LLM 模型穩健性、偏差、公平性與安全性的綜合性評估工具。