ibm-granite/granite-tsfm

一套用於處理 IBM 的 Granite 時間序列基礎模型進行預測的實用工具、筆記本與部署元件集合。

isaac-sim/IsaacLab-Arena

Isaac Lab‑Arena 是 NVIDIA Isaac Lab 的一個 Alpha 階段開源擴充,允許透過混合可重用的 *場景*、*實體* 和 *任務* 原語來建立機器人模擬環境。它在執行時組裝這些元件,支援順序任務鏈、自然語言物件放置與大規模平行評估,使基準測試或訓練通用機器人策略變得更容易。安裝可透過 `uv` Python 管理器或提供的 Docker 鏡像完成;該程式庫僅支援 Linux,需 NVIDIA GPU 與 Isaac Sim。專案採用 Apache 2.0 許可(包含專有的 Isaac Sim 元件),旨在用於研究而非生產。

microsoft/SwiftStreamingMarkdown

專為 LLM 串流傳輸優化之 iOS 與 macOS Markdown 渲染器,提供流暢轉換、LaTeX 支援與內嵌引用 UI。

mavlink/mavlink

輕量級、僅頭文件的消息序列化庫,用於無人機與地面控制站之間的高效通訊。

cvg/GeoCalib

GeoCalib 是一個研究級 Python 庫,透過深度網路結合幾何最佳化,從單張影像預測相機內參與場景重力方向。支援多種鏡頭模型、部分先驗、批次與多相機陣列校準,並附帶易安裝的推理程式碼、Gradio 網頁示範、Colab 記事本與即時網路攝影機示範。預訓練模型在 OpenPano 資料集(約 37k 個來自 HDR 全景圖的透視裁剪影像)上訓練,已在 LaMAR、MegaDepth、TartanAir 與 Stanford2D3D 等基準上達成最尖端成果。

prathoshap/vagdhenu

一種生產級的梵文吟誦文本轉語音系統,能夠生成傳統的旋律吟誦,而非平淡的朗讀語音。

qodo-ai/qodo-cover

一款透過 AI 驅動的工具,可自動生成單元測試以提高代碼覆蓋率,支援多種程式語言及多種 LLM 提供商。

GetStream/Vision-Agents

一個用於構建低延遲、多模態 AI 代理的框架,將即時視訊串流與大型語言模型(LLM)以及電腦視覺模型結合,提供互動式視覺體驗。

NativeSensors/EyeGestures

一個開源眼動追蹤程式庫,可使用標準網路攝影機與手機相機,而非昂貴的專用硬體,實現眼控介面。

steineggerlab/foldseek

一款支援 GPU 加速的快速且敏感的工具,用於比較與聚類大型蛋白質結構集,支援單體與多聚體搜尋。

GPTomics/bioSkills

bioSkills 是一個包含即用型程式碼範本(「技能」)的函式庫,可教導LLM編碼代理執行生物資訊學分析——從序列輸入輸出到單細胞、變異檢測、結構生物學、化學資訊學及工作流程管理。可透過 Claude Code、Codex、Gemini/Antigravity、OpenCode 和 OpenClaw 的輕量腳本安裝,提供最佳實踐命令列旗標、範例程式碼與使用指南,提升AI生成的生物資訊學程式碼的準確性。

meta-pytorch/botorch

BoTorch 是一個基於 PyTorch 的庫,提供模組化框架,用於組合機率模型與獲取函數。

google-ai-edge/litert-torch

一個將 PyTorch 模型轉換為 .tflite 格式的 Python 套件,可在 Android、iOS 與 IoT 裝置上實現高效率的本地執行。

NVIDIA-NeMo/Skills

一組用於 LLM 開發的流程集合,可簡化本地工作站與大型 GPU 叢集上的合成資料生成、訓練與評估流程。

samvallad33/vestige

Vestige 是一個開源、本地執行的 LLM 編碼代理記憶層。它將決策記錄為「記憶」,合併重複項,標記矛盾,並能從錯誤回溯到導致問題的早期決策(回填)。所有資料均保留在開發者機器上(SQLite),可選透過付費 Pro 版本實現加密同步。安裝僅需一條 npm 命令;工具以 25MB 的 Rust 二進位檔形式提供,僅需一次性下載嵌入器與重排序器,之後即可離線運行。基準測試顯示,Vestige 使代理比普通向量搜尋 RAG 更可靠地收斂到正確修復。採用 AGPL-3.0 許可證。

bybren-llc/safe-agentic-workflow

一個經過生產環境測試的 AI Agent 框架,透過實現 SAFe 方法論來協調跨 Claude 與 Gemini 等多種 AI 提供商的多智能體團隊。

maxritter/pilot-shell

一個包覆 Claude Code 與 Codex 的專業上下文與工程封裝系統,為生產級軟體提供持久上下文、品質門禁與執行時驗證。

om-ai-lab/VLM-R1

VLM-R1 是一個使用 GRPO 訓練 R1 風格大型視覺語言模型的框架,旨在提升在視覺定位、數學與目標偵測等任務中的推理與泛化能力。

johannesjo/parallel-code

一個用於並行分派多個 AI 編碼代理的 GUI,使用 git worktree 將每個任務隔離至獨立的分支與目錄中,實現並行開發。

lmstudio-ai/lmstudio-js

The official JavaScript/TypeScript SDK for LM Studio, enabling developers to integrate local LLMs into applications with advanced memory and hardware controls.

kha-white/manga-ocr

一款專為日式漫畫優化的 OCR 工具,能辨識多行文字、振假名,以及垂直與水平排版。

OpenVGLab/OmniLottie

OmniLottie 是一個多模態 AI 生成器,使用預訓練的視覺‑語言模型,從文字、圖像或影片輸入產生複雜的向量 Lottie 動畫。

pyro-ppl/pyro

一個建構於 PyTorch 上的深度機率程式庫,讓使用者能為大型資料集建立與擴展通用機率模型。

DannyMac180/skills

一組公開的 AI 智能體技能,透過動態工作流、Claude Code 外掛程式開發和個人化學習的工具來擴展智能體能力。

vercel-labs/workflow-builder-template

一個用於構建 AI 驅動的工作流自動化平台模板,具備可生成可執行 TypeScript 代碼的可視化拖放式構建器。

pycaret/pycaret

一個開源的自託管機器學習平台,結合了 AutoML 引擎、用於實驗管理的控制平面以及用於完整訓練到部署工作流的 Web UI。

landing-ai/ade-cli

一種用於代理文件提取的命令列工具,可將複雜文件轉換為具備可驗證證據(頁面與框座標)的結構化 Markdown 與資料。

pocketpaw/pocketpaw

一款在您機器上本地運行的自架設 AI 代理,提供原生桌面應用,並與 Discord 和 Slack 等多個訊息平台整合。

m1ckc3s/claude-status-bar

一個 macOS 菜單列應用,即時顯示 Claude Code 的 AI 狀態,包括是否正在工作、思考或等待使用者授權。

openxla/stablehlo

為 ML 模型提供的可移植層與操作集,實現不同 ML 框架與 ML 編譯器之間的互操作性。

drawthingsai/draw-things-community

一個社群倉庫,提供 Draw Things 應用的核心影像生成、取樣與訓練程式碼,包含可自托管的 gRPC 伺服器以支援遠端推論。

MoonInTheRiver/DiffSinger

一個基於擴散模型的框架,可從歌詞、MIDI 和音高數據生成高品質的歌聲合成與文字轉語音生成。

FalkorDB/GraphRAG-SDK

GraphRAG‑SDK 是一個 Python SDK,從您的文件建立 FalkorDB 中的知識圖譜,然後透過遍歷該圖譜回答問題。它加入出處邊、多跳檢索與可選拒答功能,大幅減少 LLM 幻覺,並附帶基準測試顯示其優於標準向量 RAG。透過 pip 安裝,執行 FalkorDB 容器,攝入文字(或 PDF/markdown),呼叫 `finalize()`,再使用 `completion()` 進行查詢。該套件支援模式、增量更新、自訂提供者,採用 Apache‑2.0 許可。

Phyzicalorg/Phyzical_org

一個基於瀏覽器的機器人遠端操作平台,用於眾包人類示範資料,以訓練視覺-語言-動作(VLA)模型與模仿學習策略。

jdevalk/specification.website

一個將碎片化 Web 標準整合為單一參考的平台無關網站規範,包含使網站對 AI 代理更易讀的工具。

alan345/AI-Fullstack-SaaS-Boilerplate

使用 Fastify、React 和 tRPC 的全端 SaaS 原型,提供預設設定的基礎架構,用於建構整合 OpenAI 的 AI 驅動 Web 應用程式。

KINGSTON-115/llm-pid-tuner

一種基於 LLM 的 PID 調諧輔助工具,透過分析硬體或模擬中的系統回應,自動建議並套用最佳控制參數。

RUC-NLPIR/FlashRAG

FlashRAG 是一個 Python 庫,提供模組化框架、基準資料集以及 23 種 SOTA 檢索增強生成(RAG)方法的實作(包含推理基礎與多模態方法)。支援密集、稀疏與神經稀疏檢索,透過 vLLM 實現快速 LLM 推理,並提供 Web UI 以實現輕鬆設定與評估。

woheller69/whisperIME

基於 Whisper 引擎的 Android 離線語音辨識輸入法,提供注重隱私的語音轉文字與翻譯功能。

PaddlePaddle/PaddleX

基於PaddlePaddle的低程式碼AI開發工具,提供預訓練模型產線,支援在多種硬體上快速完成訓練、推論與部署。

huggingface/optimum

Hugging Face 生態系統的擴充套件,提供最佳化工具,使 AI 模型在目標硬體加速器上以最高效率進行訓練與執行。

microsoft/magentic-ui

MagenticLite 是 Microsoft AI Frontiers 的一款代理式應用程式,使用高效且小規模的 AI 模型自動化瀏覽器與本機檔案系統任務。

FrigadeHQ/yap

一款輕量級、在設備上運作的 macOS 語音輸入工具,利用 Apple 原生語音 API 將轉錄文字私密地貼上至任何活躍應用中。

ML-GSAI/LLaDA

LLaDA 是一種大規模掩碼擴散語言模型,它挑戰了自回歸架構的主導地位,實現了與 LLaMA3 8B 相當的性能。

drhelius/Gearboy

以 C++ 編寫的高精度 Game Boy 模擬器,內建 MCP 伺服器,支援 AI 輔助除錯與 ROM 破解。

dongsheng123132/u-claw

一個將 OpenClaw 框架打包至 USB 隨身碟上的可攜式 AI 工作區,讓使用者能將自己的 AI 設定與記憶帶到任何電腦上。

google-ai-edge/model-explorer

Model Explorer 是 Google‑AI‑Edge 的開源視覺化工具,可將 TensorFlow、TFLite、TF‑JS、MLIR 和 PyTorch ExportedProgram 模型渲染為互動式階層圖。它提供 GPU 加速渲染、可搜尋節點、I/O 高亮、元資料覆疊以及可擴充的適配器系統以支援更多格式。

robusta-dev/robusta

一個與 Prometheus 集成,為警報提供診斷數據和自動修復功能的 Kubernetes 警報增強引擎。