ibm-granite/granite-tsfm
一套用於處理 IBM 的 Granite 時間序列基礎模型進行預測的實用工具、筆記本與部署元件集合。
isaac-sim/IsaacLab-Arena
Isaac Lab‑Arena 是 NVIDIA Isaac Lab 的一個 Alpha 階段開源擴充,允許透過混合可重用的 *場景*、*實體* 和 *任務* 原語來建立機器人模擬環境。它在執行時組裝這些元件,支援順序任務鏈、自然語言物件放置與大規模平行評估,使基準測試或訓練通用機器人策略變得更容易。安裝可透過 `uv` Python 管理器或提供的 Docker 鏡像完成;該程式庫僅支援 Linux,需 NVIDIA GPU 與 Isaac Sim。專案採用 Apache 2.0 許可(包含專有的 Isaac Sim 元件),旨在用於研究而非生產。
microsoft/SwiftStreamingMarkdown
專為 LLM 串流傳輸優化之 iOS 與 macOS Markdown 渲染器,提供流暢轉換、LaTeX 支援與內嵌引用 UI。
mavlink/mavlink
輕量級、僅頭文件的消息序列化庫,用於無人機與地面控制站之間的高效通訊。
cvg/GeoCalib
GeoCalib 是一個研究級 Python 庫,透過深度網路結合幾何最佳化,從單張影像預測相機內參與場景重力方向。支援多種鏡頭模型、部分先驗、批次與多相機陣列校準,並附帶易安裝的推理程式碼、Gradio 網頁示範、Colab 記事本與即時網路攝影機示範。預訓練模型在 OpenPano 資料集(約 37k 個來自 HDR 全景圖的透視裁剪影像)上訓練,已在 LaMAR、MegaDepth、TartanAir 與 Stanford2D3D 等基準上達成最尖端成果。
prathoshap/vagdhenu
一種生產級的梵文吟誦文本轉語音系統,能夠生成傳統的旋律吟誦,而非平淡的朗讀語音。
qodo-ai/qodo-cover
一款透過 AI 驅動的工具,可自動生成單元測試以提高代碼覆蓋率,支援多種程式語言及多種 LLM 提供商。
GetStream/Vision-Agents
一個用於構建低延遲、多模態 AI 代理的框架,將即時視訊串流與大型語言模型(LLM)以及電腦視覺模型結合,提供互動式視覺體驗。
NativeSensors/EyeGestures
一個開源眼動追蹤程式庫,可使用標準網路攝影機與手機相機,而非昂貴的專用硬體,實現眼控介面。
steineggerlab/foldseek
一款支援 GPU 加速的快速且敏感的工具,用於比較與聚類大型蛋白質結構集,支援單體與多聚體搜尋。
GPTomics/bioSkills
bioSkills 是一個包含即用型程式碼範本(「技能」)的函式庫,可教導LLM編碼代理執行生物資訊學分析——從序列輸入輸出到單細胞、變異檢測、結構生物學、化學資訊學及工作流程管理。可透過 Claude Code、Codex、Gemini/Antigravity、OpenCode 和 OpenClaw 的輕量腳本安裝,提供最佳實踐命令列旗標、範例程式碼與使用指南,提升AI生成的生物資訊學程式碼的準確性。
meta-pytorch/botorch
BoTorch 是一個基於 PyTorch 的庫,提供模組化框架,用於組合機率模型與獲取函數。
google-ai-edge/litert-torch
一個將 PyTorch 模型轉換為 .tflite 格式的 Python 套件,可在 Android、iOS 與 IoT 裝置上實現高效率的本地執行。
NVIDIA-NeMo/Skills
一組用於 LLM 開發的流程集合,可簡化本地工作站與大型 GPU 叢集上的合成資料生成、訓練與評估流程。
samvallad33/vestige
Vestige 是一個開源、本地執行的 LLM 編碼代理記憶層。它將決策記錄為「記憶」,合併重複項,標記矛盾,並能從錯誤回溯到導致問題的早期決策(回填)。所有資料均保留在開發者機器上(SQLite),可選透過付費 Pro 版本實現加密同步。安裝僅需一條 npm 命令;工具以 25MB 的 Rust 二進位檔形式提供,僅需一次性下載嵌入器與重排序器,之後即可離線運行。基準測試顯示,Vestige 使代理比普通向量搜尋 RAG 更可靠地收斂到正確修復。採用 AGPL-3.0 許可證。
bybren-llc/safe-agentic-workflow
一個經過生產環境測試的 AI Agent 框架,透過實現 SAFe 方法論來協調跨 Claude 與 Gemini 等多種 AI 提供商的多智能體團隊。
maxritter/pilot-shell
一個包覆 Claude Code 與 Codex 的專業上下文與工程封裝系統,為生產級軟體提供持久上下文、品質門禁與執行時驗證。
om-ai-lab/VLM-R1
VLM-R1 是一個使用 GRPO 訓練 R1 風格大型視覺語言模型的框架,旨在提升在視覺定位、數學與目標偵測等任務中的推理與泛化能力。
johannesjo/parallel-code
一個用於並行分派多個 AI 編碼代理的 GUI,使用 git worktree 將每個任務隔離至獨立的分支與目錄中,實現並行開發。
lmstudio-ai/lmstudio-js
The official JavaScript/TypeScript SDK for LM Studio, enabling developers to integrate local LLMs into applications with advanced memory and hardware controls.
kha-white/manga-ocr
一款專為日式漫畫優化的 OCR 工具,能辨識多行文字、振假名,以及垂直與水平排版。
OpenVGLab/OmniLottie
OmniLottie 是一個多模態 AI 生成器,使用預訓練的視覺‑語言模型,從文字、圖像或影片輸入產生複雜的向量 Lottie 動畫。
pyro-ppl/pyro
一個建構於 PyTorch 上的深度機率程式庫,讓使用者能為大型資料集建立與擴展通用機率模型。
DannyMac180/skills
一組公開的 AI 智能體技能,透過動態工作流、Claude Code 外掛程式開發和個人化學習的工具來擴展智能體能力。
vercel-labs/workflow-builder-template
一個用於構建 AI 驅動的工作流自動化平台模板,具備可生成可執行 TypeScript 代碼的可視化拖放式構建器。
pycaret/pycaret
一個開源的自託管機器學習平台,結合了 AutoML 引擎、用於實驗管理的控制平面以及用於完整訓練到部署工作流的 Web UI。
landing-ai/ade-cli
一種用於代理文件提取的命令列工具,可將複雜文件轉換為具備可驗證證據(頁面與框座標)的結構化 Markdown 與資料。
pocketpaw/pocketpaw
一款在您機器上本地運行的自架設 AI 代理,提供原生桌面應用,並與 Discord 和 Slack 等多個訊息平台整合。
m1ckc3s/claude-status-bar
一個 macOS 菜單列應用,即時顯示 Claude Code 的 AI 狀態,包括是否正在工作、思考或等待使用者授權。
openxla/stablehlo
為 ML 模型提供的可移植層與操作集,實現不同 ML 框架與 ML 編譯器之間的互操作性。
drawthingsai/draw-things-community
一個社群倉庫,提供 Draw Things 應用的核心影像生成、取樣與訓練程式碼,包含可自托管的 gRPC 伺服器以支援遠端推論。
MoonInTheRiver/DiffSinger
一個基於擴散模型的框架,可從歌詞、MIDI 和音高數據生成高品質的歌聲合成與文字轉語音生成。
FalkorDB/GraphRAG-SDK
GraphRAG‑SDK 是一個 Python SDK,從您的文件建立 FalkorDB 中的知識圖譜,然後透過遍歷該圖譜回答問題。它加入出處邊、多跳檢索與可選拒答功能,大幅減少 LLM 幻覺,並附帶基準測試顯示其優於標準向量 RAG。透過 pip 安裝,執行 FalkorDB 容器,攝入文字(或 PDF/markdown),呼叫 `finalize()`,再使用 `completion()` 進行查詢。該套件支援模式、增量更新、自訂提供者,採用 Apache‑2.0 許可。
Phyzicalorg/Phyzical_org
一個基於瀏覽器的機器人遠端操作平台,用於眾包人類示範資料,以訓練視覺-語言-動作(VLA)模型與模仿學習策略。
jdevalk/specification.website
一個將碎片化 Web 標準整合為單一參考的平台無關網站規範,包含使網站對 AI 代理更易讀的工具。
alan345/AI-Fullstack-SaaS-Boilerplate
使用 Fastify、React 和 tRPC 的全端 SaaS 原型,提供預設設定的基礎架構,用於建構整合 OpenAI 的 AI 驅動 Web 應用程式。
KINGSTON-115/llm-pid-tuner
一種基於 LLM 的 PID 調諧輔助工具,透過分析硬體或模擬中的系統回應,自動建議並套用最佳控制參數。
RUC-NLPIR/FlashRAG
FlashRAG 是一個 Python 庫,提供模組化框架、基準資料集以及 23 種 SOTA 檢索增強生成(RAG)方法的實作(包含推理基礎與多模態方法)。支援密集、稀疏與神經稀疏檢索,透過 vLLM 實現快速 LLM 推理,並提供 Web UI 以實現輕鬆設定與評估。
woheller69/whisperIME
基於 Whisper 引擎的 Android 離線語音辨識輸入法,提供注重隱私的語音轉文字與翻譯功能。
PaddlePaddle/PaddleX
基於PaddlePaddle的低程式碼AI開發工具,提供預訓練模型產線,支援在多種硬體上快速完成訓練、推論與部署。
huggingface/optimum
Hugging Face 生態系統的擴充套件,提供最佳化工具,使 AI 模型在目標硬體加速器上以最高效率進行訓練與執行。
microsoft/magentic-ui
MagenticLite 是 Microsoft AI Frontiers 的一款代理式應用程式,使用高效且小規模的 AI 模型自動化瀏覽器與本機檔案系統任務。
FrigadeHQ/yap
一款輕量級、在設備上運作的 macOS 語音輸入工具,利用 Apple 原生語音 API 將轉錄文字私密地貼上至任何活躍應用中。
ML-GSAI/LLaDA
LLaDA 是一種大規模掩碼擴散語言模型,它挑戰了自回歸架構的主導地位,實現了與 LLaMA3 8B 相當的性能。
drhelius/Gearboy
以 C++ 編寫的高精度 Game Boy 模擬器,內建 MCP 伺服器,支援 AI 輔助除錯與 ROM 破解。
dongsheng123132/u-claw
一個將 OpenClaw 框架打包至 USB 隨身碟上的可攜式 AI 工作區,讓使用者能將自己的 AI 設定與記憶帶到任何電腦上。
google-ai-edge/model-explorer
Model Explorer 是 Google‑AI‑Edge 的開源視覺化工具,可將 TensorFlow、TFLite、TF‑JS、MLIR 和 PyTorch ExportedProgram 模型渲染為互動式階層圖。它提供 GPU 加速渲染、可搜尋節點、I/O 高亮、元資料覆疊以及可擴充的適配器系統以支援更多格式。
robusta-dev/robusta
一個與 Prometheus 集成,為警報提供診斷數據和自動修復功能的 Kubernetes 警報增強引擎。