ria-com/nomeroff-net
一個使用 YOLOv8 和基於 RNN 的 OCR 的開源 Python 框架,可跨多國自動檢測與讀取車牌。
hplt-project/sacremoses
一個文字預處理函式庫,為 NLP 資料集提供分詞、去分詞、正規化和真實大小寫還原工具。
NVIDIA/cuQuantum
NVIDIA 提供的高性能 SDK,專為加速量子科學模擬而設計,內含專用程式庫,支援狀態向量與張量網路運算。
microsoft/TransformerCompression
一種訓練後壓縮工具,透過正交變換切掉不重要的權重矩陣元件,使變換器網路更小更快。
chi2liu/ABC-GRPO
一種非對稱且自適應的 GRPO 強化學習演算法改進,使用四個獨立剪裁邊界防止 LLM 推理任務中的熵崩潰並提升泛化能力。
femto/minion-agent
一個強大的代理框架,可在多個代理後端中整合瀏覽器自動化、程式碼執行與MCP工具支援。
Softlandia-Ltd/vision-is-all-you-need
一種視覺 RAG(V-RAG)示範,使用 VLM 將 PDF 頁面作為影像嵌入,以消除文件檢索過程中的文字分塊需求。
yzhao062/SUOD
針對異質模型集合的訓練與預測進行最佳化的大型非監督異常檢測加速框架。
NVIDIA/logits-processor-zoo
一組用於LLM的logits處理器,讓開發者能控制輸出行為,例如強制特定短語、管理回應長度,以及減輕幻覺。
aniketkarne/ClaudeNightsWatch
一個面向 Claude CLI 的自動化任務執行系統,監控使用視窗並自動從 Markdown 檔案執行預先定義的任務。
marciopuga/cog
一個集中式、純文字的記憶層,讓 AI 代理能透過 Markdown 檔案在不同工具與專案間共享上下文與持久知識。
Azure-Samples/ai-rag-chat-evaluator
一個用於評估 RAG 聊天應用程式的工具包,透過使用基於 GPT 和基於程式碼的指標,將生成的答案與真實數據進行基準測試。
wangle201210/go-rag
一個基於 Go 的 RAG 系統,允許用戶從文件和網頁創建知識庫,具備多路召回和管理 GUI。
Kabanosk/whisper-website
一個使用 OpenAI 的 Whisper 在本地將音訊轉錄為文字或各種格式字幕的自托管 Web 應用程式。
py-why/pywhyllm
一個將大型語言模型(LLM)整合到因果分析過程中的庫,用於建議混淆變數、因果關係和驗證策略。
jdtoscano94/NABLA-SciML
一個用於科學機器學習 (SciML) 的統一框架,提供 PINNs、DeepONets 和 KANs 的實作,用於研究複雜的物理系統。
openaiotlab/CUHK-X
用於人類行為識別與推理的大規模多模態資料集與基準,整合七種同步感測器模態,以實現複雜動作理解。
apple-aiml-research/ml-diffucoder
DiffuCoder是一種用於程式碼生成的遮罩擴散模型,引入了Coupled-GRPO以提高後訓練效率和所有token的學習訊號。
apple-aiml-research/ml-mdm
一個用於套娃擴散模型的端到端框架,能夠高效訓練最高1024x1024像素的高解析度文字到圖像合成模型。
BenyRonald77/uajy-academic-rag-chatbot
基於RAG的聊天機器人,利用Google Gemini與FAISS,根據雅加達阿特馬賈亞大學官方學術手冊,為學術問題提供無幻覺的答案。
aws/sagemaker-training-toolkit
一個讓自訂 Docker 容器與 Amazon SageMaker 相容的函式庫,簡化了在隔離環境中訓練機器學習模型的過程。
TheDesignFounder/DreamLayer-Eval
一個用於影像與影片擴散模型的開源基準測試平台,可自動執行提示詞掃描、指標計算與可重現的執行日誌記錄。
jonathan-laurent/AlphaZero.jl
一個快速且通用的 Julia 實作的 AlphaZero 演算法,能夠在標準桌面硬體上透過自我對弈訓練組合遊戲的 AI 智慧體。
cha0upup/LeoAI
LeoAI 是一個開源、AI 增強的紅隊平台,結合網頁儀表板、雙執行時(Java/PHP)Puppet 用於遠端主機控制,以及由 LangChain4j 驅動的 LLM 代理,可自動化後滲透任務、產生報告並管理團隊,可透過 JAR 或 Docker 部署。
OpenBMB/DeepThinkVLA
DeepThinkVLA 是一個視覺-語言-行動模型,在生成機器人動作前插入一個顯式的鏈式思考推理步驟。使用混合解碼器(自回歸推理 → 雙向平行動作生成),作者在新整理的具身CoT資料集上訓練,再以成果導向的強化學習進行優化。該模型在 LIBERO 基準上達成 97 % 的平均成功率,推理延遲僅為純自回歸基線的 0.175×,並能零樣本遷移到更新的 LIBERO Plus 套件。
aidatatools/ollama-benchmark
一個跨平台 CLI 工具,根據使用者可用的系統 RAM,測量透過 Ollama 執行的本地 LLM 的每秒令牌吞吐量。
teticio/audio-diffusion
一個透過將擴散模型應用於 mel spectrograms 以合成音樂與音訊迴圈的框架,支援潛在擴散與條件生成。
guidone/node-red-contrib-chatbot
一個 Node-RED 函式庫,讓使用者能以視覺化方式為 Telegram、Facebook Messenger、WhatsApp、Viber 和 Slack 構建並部署聊天機器人,且幾乎無需編寫程式碼。
ReinerBRO/grok-register
使用暫時郵件和瀏覽器補丁繞過 Cloudflare Turnstile 的 Grok (x.ai) 自動化帳戶註冊工具。
khaled-alshamaa/ar-php
一個開源 PHP 庫,提供專業阿拉伯語語言處理工具,包括情感分析、拼字檢查和希吉拉曆日期管理。
Xueyang-Song/paper-pilot
Paper Pilot 是一個桌面(Electron + React)研究助理,可爬取 8+ 個學術資料庫,下載 PDF,使用 SQLite + FTS5 + 向量搜尋進行索引,並允許你向本地或主機的 LLM 提出基於證據的答案。所有資料均保留在你的機器上;該應用提供可審計的引用追蹤與可重現的文獻回顧工作流程。
melody0709/zencrop
一款獨立的 Windows 工具,可從任何應用程式中裁剪並固定互動式子視窗,具備高階 OCR、翻譯與截圖工具。
honojs/cli
一個為 Hono 開發者與 AI 代理設計的命令列介面,整合文件搜尋、伺服器管理與套件最佳化功能。
fengbingchun/NN_Test
包含 YOLO 與 Ollama 等現代 AI 框架的深度學習基礎、機器學習演算法,以及 C++ 與 Python 實作的全面集合。
NVIDIA/nvtrust
用於在 NVIDIA 可信運算與機密運算環境中實作與驗證證明的一系列工具與 SDK。
Deep-ai-inc/ch.at
ch.at 是一個單一二進位檔案的 Go 伺服器,讓您透過 HTTP、SSH、DNS 或 API 與 LLM(預設為 GPT-4o)進行對話,無需 JavaScript,無需帳號,且所有狀態皆保留在 RAM 中。它專注於隱私,易於自行託管,並包含一個用於透過相同輕量級協定發布訊息的公共看板。
breezewish/CodexPotter
一種基於再整合的編碼代理,透過使用新上下文和檔案系統記憶體,迭代地將程式碼庫與指定目標對齊,防止上下文腐化。
realopslabs/kubeledger
一個追蹤 CPU、記憶體與 GPU 資源的 Kubernetes 使用量會計工具,揭示隱藏的系統開銷,實現每個命名空間的精確成本分配。
google-ar/arcore-unity-extensions
一套為 Unity AR Foundation 提供 Google ARCore 增強現實功能的原生 API 存取擴充功能。
QuinnDamerell/OctoPrint-OctoEverywhere
一款為3D列印機提供遠端存取與監控服務的系統,包含AI驅動的列印失敗偵測功能,可自動停止失敗的列印。
PallasBot/Pallas-Bot
一個結合群組語料學習重複與 LLM 功能的社交聊天機器人,能模擬其社群的特定語言風格。
MAIF/melusine
整合深度學習與決定性規則的綜合性郵件處理工具,用於自動化郵件路由、優先排序與分段。
Snaplii-Inc/agent-to-merchant-payments
一個透過預付款餘額和範圍受限API金鑰,使AI代理能夠安全購買禮品卡和支付帳單的令牌化支付層。
evelyyyyynnnnn/4.0-Decision-Intelligence-Framework
整合作業研究與AI的決策智能框架,為醫療與金融等高風險領域提供穩健、可審計的最佳化方案。
gfo-project/Gradient-Free-Optimizers
一個用於混合搜尋空間黑盒最佳化的 Python 函式庫,為超參數調整與工程設計提供了一個統一的介面,可存取 23 種無梯度演算法。
EliaAlberti/cpr-compress-preserve-resume
一組透過結構化記錄與上下文保留,在會話間提供持久記憶的 Claude Code 自訂技能,可降低會話重啟時的權杖成本。
shift-labs-ai/napkin
一個本地優先、基於檔案的知識系統,使 AI 代理能透過漸進式揭露檢索資訊,以管理上下文視窗限制。
half-potato/radiance_meshes
一個用於 Radiance Meshes 的訓練框架,可從影像資料集實現 3D 場景的體積重建,並提供針對行動網頁檢視優化模型的選項。