v0lta/PyTorch-Wavelet-Toolbox
一個為信號與影像處理設計的 PyTorch 原生離散與連續小波轉換工具箱,支援 GPU 加速與梯度計算。
tensorflow/tflite-support
一個用於在行動裝置上開發與部署 TFLite 模型的工具包,提供元資料管理、自動 API 產生與優化之任務程式庫。
infinitered/react-native-mlkit
一組包裝 Google 的 MLKit 原生程式庫的 Expo 模組,讓 Expo 應用能實現人臉與物件檢測等設備端機器學習功能。
Stability-AI/stable-codec
一種高品質、低比特率的語音編碼器,可將音訊壓縮為離散標記,專為語音合成等下游任務優化。
chr15m/runprompt
一個用於執行.prompt 檔案的命令列工具,允許使用者將 LLM 提示詞視為可版本化的產物,並透過 Shell 自動化 AI 工作流。
PersiaML/PERSIA
一個基於 PyTorch 的並行訓練系統,旨在利用一般硬體將深度學習推薦模型擴展至 100 兆參數。
AIGeeksGroup/3D-R1
3D-R1 是一種通用 3D 視覺-語言模型,透過合成 CoT 資料與強化學習提升空間推理與場景理解能力。
qdrant/rust-client
一個原生 Rust 客戶端,可在 Rust 應用程式中實現高效能向量搜尋與資料庫管理。
FujitsuResearch/OneCompression
一個使用 QEP 與 AutoBit 等先進量化技術來減少模型大小與 VRAM 使用的 Python 套件。
hujiecpp/PE3R
PE3R 是一種感知高效的 3D 重構系統,利用零樣本泛化將 2D 圖像轉換為語義理解的 3D 場景。
kermitt2/delft
一個基於 Keras 與 TensorFlow 的文字處理框架,支援序列標記與文字分類,並原生支援結構化文件(如 PDF 或 HTML)中的富文字版面資訊。
deepqmc/deepqmc
用於模擬電子基態與激發態的開源軟體套件,支援深度學習分子波函數的變分優化。
Deep-unlearning/smol-audio
一系列實用的筆記本,用於在Hugging Face生態系中對ASR與音訊字幕等任務的音訊AI模型進行微調與優化。
dluvizon/deephar
一個用於即時 2D 與 3D 人體姿態估計及動作辨識的多任務深度學習框架。
kozistr/pytorch_optimizer
一個與 PyTorch 相容的函式庫,透過單一且一致的 API,整合了 100 多種研究型優化器、多種學習率調度器(LR schedulers)與損失函數,並提供低精度訓練的選用整合功能。
atomicstrata/atomicmemory
一個可檢視且具修正意識的 AI 代理記憶系統,可在會話間提供持久的上下文,且不與特定模型或框架綁定。
asagi4/comfyui-prompt-control
這是一個 ComfyUI 擴充功能,讓您能透過簡單的文字提示詞來控制複雜的 AI 圖像生成工作流(例如 LoRA 載入、提示詞排程與區域提示詞),而無需手動連接數十個節點。
syne-tune/syne-tune
一個支援分散式執行與先進調優方法的大規模、可重現超參數最佳化(HPO)庫。
aparsoft/yolo-streamlit-detection-tracking
基於Streamlit的視覺工作室,使用YOLO26與YOLO World v2實現實時物件檢測、分割、姿態估計與追蹤。
OmniCustom-project/OmniCustom
OmniCustom 是一個聯合音訊影像生成框架,根據參考輸入與文字提示生成保持特定視覺身份與聲音音色的同步影片。
EvoScientist/EvoSkills
一個可安裝的知識套件庫,為 AI 代理擴展結構化、領域特定的專業知識,以自動化從構思到發表的完整學術研究生命週期。
lingyuanli/MultiGen
採用 Planner+ReAct 架構並具備用於安全工具執行的隔離 Docker 沙箱,專為私有本地部署設計的通用 AI Agent 平台。
tongjingqi/AI-Can-Learn-Scientific-Taste
一個利用社群回饋強化學習 (RLCF) 來訓練 AI 判斷科學論文潛在影響並提出高影響力研究想法的框架。
LanceMoe/openai-translator
一個使用 OpenAI 相容聊天模型的漸進式網頁應用(PWA),可在行動與桌面端提供彈性翻譯服務
prov-gigatime/GigaTIME
一個從常規 H&E 病理切片生成腫瘤微環境建模用虛擬空間蛋白質體(mIF)特徵的多模態 AI 專案。
Kocoro-lab/Kocoro
Kocoro 是一個開源的 macOS AI 代理守護程序(`shan`),讓語言模型代理能讀取/寫入檔案、控制應用程式、執行 shell 命令、自動化瀏覽器,並整合 Slack/Telegram。提供 CLI/TUI、HTTP API、MCP 流式傳輸,以及即時語音前腦。可透過 npm、腳本或 Go 建置安裝;設定 Shannon Cloud 或自架設網關以取得 LLM 完成。守護程序處理權限、代理記憶體、排程與可擴充工具,而獨立的閉源 GUI(Kocoro Desktop)提供精緻介面。採用 MIT 授權。
stevibe/BenchLocal
一個以本地為先的桌面應用程式,用於在各種基準測試集(稱為 Bench Packs)上執行與比較本地或遠端模型的 LLM 性能。
operatorai/modelstore
一個開源模型註冊表庫,允許使用者在無需追蹤伺服器的情況下,跨多個雲端儲存供應商和本地檔案系統對機器學習模型進行版本化、儲存與下載。
sdl60660/letterboxd_recommendations
一個基於協同過濾和 SVD 的電影推薦系統,根據 Letterboxd 使用者的評分模式為使用者推薦電影。
irthomasthomas/llm-consortium
`llm` 套件的外掛程式,透過結構化對話、評估與迭代優化,協調多個多樣化的 LLM 共同解決複雜問題的模型共識系統。
lightdock/lightdock
基於螢火蟲群優化演算法的蛋白質、勝肽與DNA相互作用預測對接框架。
burugo/one-mcp
一個集中式的代理與管理平台,用於 Model Context Protocol (MCP) 服務,讓使用者能透過單一介面發現、安裝與監控服務。
AnswerDotAI/shell_sage
一個與 tmux 集成的 AI 驅動命令列助手,可即時提供情境化協助、除錯腳本並分析終端輸出。
breadboard-ai/breadboard
一個用於生成式 AI 應用程式的原型設計庫,允許使用者透過視覺化方式連接模組化組件,從而進行 AI 工作流的實驗與分享。
AI4EPS/PhaseNet
一種基於深度神經網路的方法,可從原始地震資料中自動拾取地震到時(P波與S波)
SciML/Surrogates.jl
一個用於建立模擬昂貴計算過程的近似模型 Julia 函式庫,實現高效的函數優化與分析。
amanchadha/iSeeBetter
一個時空視頻超解析度專案,使用循環生成式後向投影網路與 GAN,在保持時間一致性與細緻細節的同時,對低解析度視頻進行上採樣。
koide3/gtsam_points
專為基於距離的 SLAM 與 3D 點雲配準設計的 GTSAM 因子與最佳化器集合。
yanokusnir-ai/one-node-flux-2-klein
一個 ComfyUI 自訂節點,將完整的 FLUX.2 [klein] 工作流程封裝為單一、自給自足的 UI 小工具,消除複雜的節點圖。
TorchSpatiotemporal/tsl
一個基於 PyTorch 的神經時空預測工具庫,提供統一框架用於資料前處理、模型原型設計與圖神經網路實作。
ml-struct-bio/cryodrgn
一種基於神經網路的演算法,用於對異質性冷凍電鏡與冷凍電鏡斷層成像中的連續3D結構分佈進行建模。
kyegomez/ScreenAI
一個專為理解使用者介面與資訊圖表而設計的 ScreenAI 視覺-語言模型實作。
microsoft/superbenchmark
SuperBench 是一款專為提升雲端 AI 環境可靠性而設計的 AI 基礎設施驗證與效能分析工具。
Cerlancism/chatgpt-subtitle-translator
一個使用 OpenAI ChatGPT API(或相容服務)的 Node.js CLI/Web UI,可逐行翻譯 SRT 字幕檔案,保留時間戳。支援批次處理、結構化 JSON 輸出、提示快取、可選審核,以及用於更豐富翻譯的高階多輪「代理」模式。
OmicsML/dance
一個用於單細胞基因表現分析的深度學習工具包,提供實驗重現的基準平台與自動化預處理建議功能。
HUANGLIZI/LViT
LViT 是一個結合語言與視覺變換器的多模態框架,旨在提升 CT 掃描及其他醫學影像中醫學影像分割的準確性。
scverse/rapids-singlecell
一個以 AnnData 為優先 API、並與 Scanpy 生態系統相容的 GPU 加速單細胞分析套件
hustcer/deepseek-review
一個使用 DeepSeek 模型透過 GitHub Actions 或本地 CLI 自動化 PR 審查的 AI 驅動程式碼審查工具。