BentoML:一個統一的模型服務框架,用於構建與部署可投入生產的 AI 推論 API
一個用於構建與部署高效能模型推論 API 以及多模型服務系統的 Python 框架,適用於任何 AI/ML 模型。
agentset
Agentset 是一個開源平台,用於建構、評估與發布可投入生產環境的 RAG 與代理應用,提供從資料匯入到託管的端到端工具。
llm-for-zotero
一套為 Zotero 設計的研究代理系統,讓使用者能與 PDF 對話、摘要論文,並透過具引用來源的 LLM 來管理圖書館。
nestia
一套用於 NestJS 的輔助函式庫,提供高效能驗證、自動化 SDK 產生,以及 AI 驅動的開發工具,適用於型別化 API 伺服器。
kernel-memory
Kernel Memory 是一個多模態 AI 服務,用於高效的資料集索引與 Retrieval Augmented Generation(RAG),提供資料攝取管線工具與具引用的自然語言查詢功能。
vearch
Vearch 是一個雲原生的分散式向量資料庫,能為 AI 應用提供高效的嵌入向量相似度搜尋。
hamilton
一個輕量級的 Python 函式庫,用於建立可移植且具表達力的資料轉換 DAG,適用於構建機器學習工作流、ETL 管線與 RAG 系統。
seekdb
一個相容 MySQL 的 AI 代理狀態存儲,提供高效能串流寫入、混合向量/全文搜尋,以及寫時複製 sandbox 以安全探索。
autoflow
AutoFlow 是一款開源的 Graph RAG 知識庫工具,讓使用者透過內建網站爬蟲與 TiDB Vector,打造對話式搜尋體驗。
swirl-search
一個開源的聯邦式元搜尋與 RAG 平台,能在不搬移或索引資料的情況下,實現企業資料來源的統一搜尋與 AI 摘要。
rag-web-ui
一個智慧對話系統,讓使用者透過檢索增強生成(RAG)將自有文件知識庫與 LLM 結合,打造客製化的問答服務。
fastembed
一個輕量且快速的 Python 函式庫,使用 ONNX Runtime 產生文字、影像與多模態嵌入,避免繁重的 PyTorch 依賴。
EvoAgentX
EvoAgentX 是一個開源框架,用於建構與自動演化基於 LLM 的代理與工作流程,具備內建評估機制與豐富工具庫。
AnyCrawl
AnyCrawl 是一套高效能的網路爬取與抓取工具組,能利用 LLM 從網站抽取結構化的 JSON 資料,讓網頁內容具備 LLM 可用性。
SimpleMem
一套為 LLM 代理設計的統一記憶堆疊,透過語意無損壓縮,能高效儲存與檢索文字與多模態記憶。
GenerativeAIExamples
一系列參考實作與教學,說明如何使用 NVIDIA 軟體生態系統與 NIM 微服務,構建生成式 AI 系統、RAG 流程與代理式工作流。
Lealone
Lealone 是一個高效能、自我演化的通用代理,透過自然語言與類 SQL 指令,實現全端應用程式與企業 AI 服務的開發。
holmesgpt
一個開源的 AI 代理,為 SRE 提供自動化的生產事故調查與根因分析,支援任何基礎設施堆疊。
ai
一個類型安全、與供應商無關的 TypeScript SDK,用於在多個 JS 框架中構建串流聊天、工具呼叫代理與多模態 AI 應用。
AdalFlow
AdalFlow 是一個類 PyTorch 的函式庫,用於構建與自動優化 LLM 工作流程,包括聊天機器人、RAG 與代理,透過自動化的文字梯度下降取代手動提示。
chonkie
一個輕量且高效能的文字切塊函式庫,專為 RAG 管線設計,提供多樣化的切分策略,並能無縫整合向量資料庫與嵌入提供者。
OpenMemory
一個為 AI 代理設計的認知記憶引擎,提供長期、多領域記憶與時間推理,超越單純向量式 RAG 的限制。
llm-graph-builder
一個使用 LLM 與 LangChain,將來自各種來源的非結構化資料轉換為儲存在 Neo4j 中的結構化知識圖譜的工具。
LLM-Engineers-Handbook
一套可直接投入生產的框架與程式碼庫,用於構建端到端的 LLM 系統,涵蓋訓練、RAG 與在 AWS 上的部署。
openagent
OpenAgent 是一個開源的個人 AI 助手平台,將 LLM、RAG 與自主代理迴圈結合於單一可自行託管的二進位檔,支援瀏覽器、Shell 與 Office 自動化。
ComfyUI-Copilot
一個為 ComfyUI 設計的智慧助理,能自動化工作流程產生、除錯與參數調校,簡化 AI 圖像生成開發流程。
MineContext
MineContext 是一個主動式、具備上下文感知能力的 AI 夥伴,透過擷取螢幕活動與數位內容,自動生成摘要、待辦事項清單與洞察。
PixelRAG
PixelRAG 是一套視覺 RAG 系統,將文件渲染為螢幕截圖而非文字切割,使 AI 能檢索與推理表格、圖表等視覺元素。
helix-db
HelixDB 是一個使用 Rust 構建的圖形-向量資料庫,它將圖形、向量、關聯式和文件數據整合到一個單一平台中,用於 AI 記憶和知識圖譜。
honcho
Honcho 是為有狀態的 AI agent 提供的記憶基礎設施,透過背景推理和以 peer 為中心的表示形式,讓它們能夠對人與專案保持持久且不斷演進的理解。
UltraRAG
一個基於 Model Context Protocol(MCP)的輕量級 RAG 開發框架,支援以低程式碼方式編排複雜工作流程,並透過視覺化 IDE 快速原型開發。
trafilatura
一個用於發現與抽取網路上乾淨、結構化文字與中繼資料的 Python 套件與命令列工具,能去除 HTML 噪音,打造高品質資料集。
airweave
一個開源的上下文檢索層,供 AI 代理與 RAG 系統使用,將 50+ 整合的資料同步至統一、LLM 友好的搜尋介面。
vespa
Vespa 是一個高效能平台,用於搜尋、推薦與個人化,能在大規模下即時進行推論與資料組織,支援向量、張量與文字等多種資料類型。
Upsonic
一個用於構建自主與傳統 AI 代理的 Python 框架,具備安全的工作區執行、客製化工具整合以及統一的 OCR 管線。
paper-qa
PaperQA2 是一個針對科學文獻的具代理性 RAG 系統,能從 PDF 與其他文件格式提供高精度、具根據且含文內引用的答案。
garden-skills
為 AI 編碼代理(Claude Code、Cursor、Codex)精選的一系列可直接用於生產環境的技能,用於在網頁設計、影片製作和圖像生成方面執行專業任務。
claude-context
一個 MCP 插件,為 AI 編碼代理增加語義程式碼搜尋功能,使其能夠利用向量資料庫從大型程式碼庫中高效地檢索相關的程式碼片段。
turbovec
一個基於 Rust、提供 Python 綁定的向量索引,實作 Google 的 TurboQuant 演算法,為 RAG 應用提供極致記憶體壓縮與快速 SIMD 加速的向量搜尋。
zvec
Zvec 是一個開源的進程內向量資料庫,直接嵌入應用程式中,提供低延遲的相似度搜尋與混合檢索功能。
coze-studio
Coze Studio 是一個開源、低程式碼的視覺開發平台,用於創建、除錯與部署 AI 代理、工作流程與 AI 應用。
DeepTutor
DeepTutor 是一個以代理為核心的個人化輔導工作空間,它將輔導、研究和精通練習整合到一個具有共享記憶和多引擎 RAG 的單一系統中。
kotaemon
一個開源、可客製化的 RAG UI,用於與文件對話,具備混合檢索、多模態解析與進階引用功能。
claude-mem
一套為 Claude Code 與其他 AI CLI 設計的永久記憶壓縮系統,能在會話間保留專案上下文與工具觀察。
opendataloader-pdf
一款開源的 PDF 解析器和無障礙工具,可為 AI 流水線提取結構化數據 (Markdown, JSON),並自動化創建符合無障礙合規性的 Tagged PDFs。
ragflow
RAGFlow 是一款開源的 RAG 引擎,它將深度文件理解與代理能力結合起來,從複雜的非結構化數據中創建基於事實、生產級的 AI 系統。
PaddleOCR
全球領先的 OCR 工具包和文檔 AI 引擎,可將 PDF 和圖像轉換為結構化的 JSON 或 Markdown 數據,以供 LLM-ready 應用程序使用。
superglue
一款由 AI 驅動的工具建置器,允許使用者使用自然語言來建立生產等級的整合與工具,並具備針對 API 變更的自我修復能力。
agents-best-practices
一個與供應商無關的 Agent Skill,提供設計嚴謹且生產環境安全的 agent harness 的藍圖和最佳實踐,以管理工具執行、權限和可觀察性。
llama_deploy
LlamaDeploy 是一個用於部署與提供 AI 工作流程的工具,但已改以 llama‑agents 為主而被棄用。