NaomiProject/Naomi
Naomi 是一個開源、持續在線的語音助理平台(Python,Linux/Raspberry Pi),可讓你控制家庭裝置、查詢資訊,並透過簡單的 Python 模組新增自訂「技能」。
xorbitsai/xagent
一個代理平台,用動態執行時規劃取代靜態工作流建構器,以處理個人、團隊和企業面臨的複雜且模糊的知識工作。
tidyverts/fable
一個提供時間序列預測模型集合的 R 套件,包含 ARIMA 與指數平滑法,並與 tidyverse 工作流程整合。
noCaptchaAi/NoCaptcha-Ai-Browser-Extension
一個使用 API 金鑰在背景中自動偵測並解決各種類型 CAPTCHA 的瀏覽器擴充套件。
polm/cutlet
支援多種羅馬化系統和 URL 別名生成的日語文字轉羅馬字工具。
NeuralEnsemble/PyNN
一種與模擬器無關的 Python 語言,用於構建可在多個模擬器和神經形態硬體上無需修改即可運行的神經元網路模型。
apple-aiml-research/ml-hierarchical-confusion-matrix
Neo 是一個開源 JavaScript 庫(npm 套件 `@apple/hierarchical-confusion-matrix`),提供支援階層式與多輸出類別標籤的互動式混淆矩陣視覺化。透過 npm 安裝,傳入一個規格與 `{actual, observed, count}` 記錄陣列,即可將矩陣嵌入任何網頁。支援平面、階層式(`:`)、多輸出(`,`)以及組合標籤結構,並附帶即時示範、單元測試與完整的 TypeScript 原始碼樹。
arrayfire/arrayfire
一個通用張量函式庫,為 CPU、GPU 及其他硬體加速器上的平行運算提供高階抽象。
YeeZTech/YeeZ-Privacy-Computing
Fidelius 是一種基於 Intel SGX 的隱私運算中介軟體,透過確保原始資料可供計算但對參與各方不可見,實現安全的資料協作。
xianyu110/clawbot
Clawdbot 是一個開源、本地執行的 AI 助手,可透過可設定的 API 代理端點連接 Claude、GPT、Gemini 等 LLM。它提供 Web 與終端機 UI、Telegram/Discord/WhatsApp 機器人,並將所有資料儲存在主機上。README 包含安裝說明(Node 22+、npm 或腳本)、模型與頻道設定的引導向導、多模型代理的詳細 JSON 設定、常見陷阱(Node 版本、環境變數誤用、遺漏欄位),以及用於管理網關、日誌與診斷的完整 CLI 命令集。
hildensia/bayesian_changepoint_detection
基於 PyTorch 的時序資料貝葉斯變更點檢測工具,支援線上與離線方法,並具備 GPU 加速功能。
esrrhs/majiang_algorithm
一個高效能的麻將演算法函式庫,利用預先計算的查表法進行毫秒級的胡牌檢測與 AI 驅動的捨牌決策。
RobotWebTools/web_video_server
一個將 ROS 影像主題串流至網頁瀏覽器並支援多種格式的 HTTP 伺服器,讓遠端監控機器人攝影機畫面變得更加容易。
L-a-r-t/chatgpt-to-notion
一個瀏覽器擴充套件,允許使用者將 ChatGPT、Claude 和 Mistral 等多個 LLM 的提示與回應直接儲存至 Notion 資料庫。
93won/lightweight_vio
一個輕量級的立體視覺慣性里程計系統,使用統計不確定性學習和滑動窗口優化進行即時機器人狀態估計。
microsoft/Cognitive-Samples-VideoFrameAnalysis
一個用於使用 Microsoft Cognitive Services Vision API 以近即時方式分析網路攝影機視頻幀的 C# 函式庫和範例應用程式。
apache/singa
Apache SINGA 是一個分散式深度學習系統,能夠在多台機器上進行大規模神經網路的訓練。
zhanghang1989/PyTorch-Encoding
一個提供用於影像分類與語義分割的高階編碼模組與模型庫的 PyTorch 函式庫。
CCNYRoboticsLab/imu_tools
一組基於 ROS 的 IMU 過濾器與視覺化工具,將角速度、加速度與磁力讀數融合為穩定的姿態估計。
ddemidov/vexcl
一個用於 OpenCL 與 CUDA 的 C++ 向量表示式模板函式庫,可減少 GPGPU 開發的重複程式碼。
Farama-Foundation/SuperSuit
一組用於 Gymnasium 與 PettingZoo 的強化學習環境預處理的微包裝器集合。
ML-KULeuven/problog
一個結合邏輯程式與機率事實以處理不確定性並執行複雜推論任務的概率邏輯程式設計工具箱。
herin7/gitforme
一個由 AI 驅動的程式碼探索平台,透過互動式儀表板與具備程式碼庫感知能力的 AI 聊天助理,協助開發者理解 GitHub 倉庫。
joeylitalien/noise2noise-pytorch
Noise2Noise 論文的非官方 PyTorch 實現,提供腳本以使用高斯、泊松、文字疊加或蒙特卡洛渲染噪聲,在僅含噪數據上訓練和測試 U‑Net 去噪器。
Datayoo/HuggingFists
一款低程式碼資料流工具,允許使用者無需大量編碼即可使用 LLM 和 Hugging Face 模型視覺化地建構和排程工作流程。
GaoQ1/rasa_nlu_gq
一個為 Rasa NLU 添加進階中文 NLP 能力的擴展,包括基於 BERT 的意圖分類和 BiLSTM+CRF 實體抽取。
Jazee6/cloudflare-ai-web
一個基於 Web 的 AI 平台介面,允許使用者透過 Cloudflare Workers AI 和 AI Gateway 快速部署多模型聊天 UI。
SaiAkhil066/CORTEX-AI-SUPER-RAG
一個本地、代理型 RAG 引擎,採用 9 層管道,包含 GraphRAG 與神經重排序,無需雲端依賴即可實現高準確度文件問答。
apple-aiml-research/ml-aim
一組為多模態理解與影像辨識提供高性能量的大型自回歸視覺編碼器。
Spr-Aachen/Easy-Voice-Toolkit
Easy Voice Toolkit 將開源語音模型(Whisper、GPT-SoVITS)整合到 GUI/Colab 工作流程中,用於清理音訊、轉錄、建立語音轉換資料集、訓練自訂語音模型,以及生成轉換後的語音。它提供即開即用的 Windows 可攜式套件和 Colab 筆記本,並附有開發者友善的安裝指南。此專案僅供學術使用,並計劃未來整合 LLM 聊天機器人和 Linux 支援。
yzhao062/combo
combo 是一個用於組合機器學習模型與得分的 Python 工具箱。它提供統一的 API,支援堆疊、動態分類器/集成選擇、異常檢測器融合等集成技術,支援 scikit-learn、XGBoost、LightGBM 與 pyod 提供的模型,適用於分類、聚類與異常檢測任務。
djcopley/ShellOracle
一個終端工具,可從自然語言描述生成 shell 命令,並透過各種 LLM 提供商直接插入提示符中。
apple-aiml-research/ml-gmpi
一種具備 3D 感知能力的生成模型,可將 2D GANs 轉換為多平面影像 (Multiplane Images),以實現 3D 視角合成與網格提取。
hzxie/GaussianCity
GaussianCity 是一個生成式 3D 城市合成工具,利用高斯潑濺技術創建無邊界的大規模城市環境。
DaoyuanLi2816/mini-verl
一種透過分階段排程模型角色,從而在單塊 NVIDIA GPU 上執行 verl RLHF 實驗(如 PPO 和 GRPO)的工具。
daodao97/chatmcp
一個與 Model Context Protocol (MCP) 集成的跨平台 AI 聊天客戶端,可將 LLM 與外部資料來源和工具連接。
JingyunLiang/VRT
VRT 是影片修復Transformer(VRT)的PyTorch實作,一種基於Transformer的模型,可處理影片超解析度、去模糊、去雜訊、幀插值與時空超解析度。它採用時間互相關自注意力與平行變形機制,捕捉長程時間依賴性,在九個基準測試中實現最頂尖PSNR提升。倉儲包含預訓練權重、測試腳本、Colab示範以及標準影片資料集的訓練說明。
lxtGH/OMG-Seg
一個將圖像、影片和像素級分割整合進單一模型的視覺感知與推理統一框架,減少了對專門化模型的需求。
ARM-software/armnn
一個在 Arm Cortex-A CPU 和 Arm Mali GPU 上加速 TensorFlow Lite 和 ONNX 模型的高性能 ML 推論引擎。
stotko/stdgpu
一個輕量級C++17函式庫,提供GPU上的STL風格通用資料結構,以在自訂內核中實現彈性且可靠的資料管理。
HarborYuan/ovsam
一個擴展了 Segment Anything Model (SAM) 的開放式詞彙模型,能夠同時進行互動式分割與數千種物體類別的識別
google/jax-cfd
JAX‑CFD 是一個基於 JAX 的研究級可微分 CFD 函式庫。它提供有限體積法和偽譜法求解器、可選的 ML 增強模型以及數據工具,讓使用者能夠在湍流模擬上進行基於梯度的實驗。該套件可透過 pip 安裝,附帶 Colab 演示,但目前已停止維護,建議使用更新的替代方案。
hzxie/CityDreamer
CityDreamer 是一個研究級的 PyTorch 框架,透過結合佈局生成器、背景填充生成器與建築實例生成器,可生成無限且逼真的 3D 城市景觀。包含在大型 OSM/GoogleEarth 資料集上訓練的程式碼、預訓練檢查點、Web 示範與 CLI 影片渲染功能。
cvg/DeepLSD
DeepLSD 是一種高精度線段檢測器,結合深度學習與影像梯度,從真實世界影像中提取並精煉線段。
mlwithme/BertWithPretrained
一個 PyTorch 實作的 BERT,允許使用者從零建構模型,並應用於分類、問答與命名實體辨識等各種 NLP 任務。
VCIP-RGBD/DFormer
DFormer 是一個用於 RGB‑D 語意分割的研究程式碼庫,實作 DFormer、DFormerv2(幾何引導注意力)與 DFormer++(高效高準確度變體)。包含預訓練腳本、資料集助手、訓練/評估流程,以及 NYU‑Depth v2 與 SUN‑RGBD 的預訓練權重。此倉儲為真實的 AI/ML 專案。
baxtree/subaligner
Subaligner 是一個開源的 Python/CLI 工具,可將字幕與影片/音訊同步,支援透過 Whisper 進行語音轉錄、使用 HuggingFace 模型進行字幕翻譯,甚至訓練自訂對齊模型。支援多種字幕與媒體格式,提供快速全域偏移(`single`)與高精度雙階段(`dual`)對齊,並支援 Docker、pip 及 LLM 增強功能的可選擴充。
ria-com/nomeroff-net
一個使用 YOLOv8 和基於 RNN 的 OCR 的開源 Python 框架,可跨多國自動檢測與讀取車牌。