deepseek-ai/DeepSelect

一個高效率的 TopK 內核實作,為 DeepSeek 稀疏注意力與 LLM 採樣提供比 `torch.topk` 快 2x 到 20x 的速度提升。

numpy/numpy

NumPy 是使用 Python 進行科學計算的基礎套件,提供了 N 維陣列物件以及線性代數和傅立葉轉換的工具。

charliedream1/ai_quant_trade

一個一站式 AI 量化交易平台,提供從學習、模擬到跨資產類別實盤部署的所有工具與策略。

facebookresearch/faiss

一個利用 CPU 與 GPU 加速處理百億規模資料集的高效密集向量相似性搜尋與聚類庫。

deepseek-ai/FlashMLA

FlashMLA 是 DeepSeek 的 CUDA 函式庫,包含密集與 token 級稀疏注意力內核(支援 FP8 KV 快取),專為 NVIDIA SM90/SM100 GPU 優化。驅動 DeepSeek-V3/V3.2/V4 模型,可在 H800 GPU 上達成最高 660 TFLOPs 的效能,並提供融合 Q-歸一化、RoPE、注意力與 FP8 轉換的內核。安裝方式為標準 pip 建構,使用簡單的 Python API(如 `flash_mla_with_kvcache`、`flash_mla_sparse_fwd` 等)即可調用。

deepspeedai/DeepSpeed

一個深度學習優化函式庫,透過在分散式系統上優化記憶體與運算效率,使得能訓練擁有兆級參數的模型。

chroma-core/chroma

Chroma 是一個為 AI 設計的開源向量資料庫,簡化了用於相似度搜尋的嵌入向量(embeddings)的儲存、檢索與索引。

mozilla-ai/llamafile

一個將 LLM 與語音轉文字工具打包為單一檔案可執行檔的框架,實現零安裝、跨平台本機執行。

onlook-dev/onlook

一個專為 Next.js 和 TailwindCSS 設計的開源視覺優先代碼編輯器,允許用戶在瀏覽器中以視覺化方式設計 UI,並透過 AI 直接將更改同步到代碼庫中。

Unstructured-IO/unstructured

一個開源套件,用於從超過 60 種檔案類型中攝取與預處理非結構化資料,轉換為適合 LLM 與向量資料庫的結構化格式。

kvcache-ai/AgentENV

一個使用 Firecracker microVM 運行 AI 代理環境的可擴展平台,具備快速的快照啟動與高密度資源管理功能。

MiaAI-Lab/sparkDash

適用於 NVIDIA DGX Spark 和 NVIDIA GPU Linux 主機的即時監控儀表板,可追蹤硬體指標和 LLM 推論效能。

openags/paper-search-mcp

專為LLM增強的研究工作流程設計,支援從多個開放取用與公共來源搜尋與下載學術論文的MCP伺服器。

Dailin521/codex-provider-sync

一個用於在切換 AI 提供者後,對齊 Codex 中的會話文件和 SQLite 索引,確保舊的聊天會話仍可使用的工具。

Lyellr88/marm-memory

一個使用 Model Context Protocol (MCP) 的 AI 代理程式持久化本地記憶體伺服器,跨對話提供共享上下文、程式碼圖譜與概念圖譜。

paradedb/paradedb

ParadeDB 是一個 Postgres 擴充功能,可直接在資料庫中整合全文搜尋與向量搜尋,無需使用獨立的搜尋引擎。

nrwl/nx

Nx 是一個智慧的單體倉庫工具,適用於 TypeScript 與多語言程式碼庫,透過增量建構與 AI 驅動的 CI 自愈功能,加速開發週期。

huggingface/peft

一個參數效率微調(PEFT)函式庫,允許使用者僅訓練大型預訓練模型的一小部分參數,即可調整模型,降低計算與儲存成本。

run-llama/liteparse

LiteParse 是一個快速、本地、開源的 PDF 解析工具,無需雲端依賴即可將空間文字與結構提取為 Markdown 或 JSON。

helicalinsight/helicalinsight

一個開源、企業就緒的嵌入式 BI 平台,整合了互動式儀表板、分頁報表與 AI 驅動的自然語言分析。

SWE-bench/SWE-bench

一個用於評估大語言模型在解決真實世界 GitHub 軟體問題時生成功能代碼修補程式能力的基準。

microsoft/agent-governance-toolkit

一種面向自主 AI 代理的治理框架,提供確定性策略執行、身分管理和稽核日誌,以防止未經授權的操作。

vllm-project/vllm-ascend

一個硬體插件,讓 vLLM 推理引擎能在華為 Ascend NPUs 上運行,支援多種開源 LLM 與多模態模型。

benchflow-ai/skillsbench

一個用於評估 AI 代理如何利用和組合模組化技能(指令、腳本與資源)來執行專業工作流程的基準測試。

LykosAI/StabilityMatrix

一個為 Stable Diffusion 設計的多平台套件管理器與推論介面,為各種 Web UI 提供一鍵安裝與共享模型管理功能。

Observal/Observal

一個為內部 AI 組件提供集中式註冊表的控制平面與記錄系統,支援在多個 AI 編程環境之間發現與部署 Agent。

hatchet-dev/hatchet

Hatchet 是一個開源的編排引擎,可讓您可靠地執行背景任務、AI代理流程與持久工作流。它將所有狀態儲存在 PostgreSQL 中,提供重試、排程、DAG、速率限制、優先權佇列與即時 UI,並提供 Python、TypeScript、Go 和 Ruby 的 SDK。您可以作為托管雲服務使用,或透過 Docker 自架設。

adbar/trafilatura

一個 Python 套件與命令列工具,用於網路爬取與文字擷取,透過去除雜訊與模板程式碼,將原始 HTML 轉換為結構化資料。

mcp-use/mcp-use

一個用於構建與發佈 MCP 伺服器以及具有原生 React 視圖和內建除錯工具的互動式 AI 應用程式的 TypeScript 框架。

kucherenko/jscpd

支援 224+ 種語言的高效能原始碼複製貼上檢測工具,協助開發者與 AI 代理識別程式碼重複並進行重構。

airbytehq/airbyte

一個開源的資料移動平台,提供 600 多個連接器,可將 API 和資料庫中的資料即時同步至資料倉儲、資料湖,或直接作為即時工具輸入 AI 代理。

dolthub/dolt

一款相容 MySQL 的 SQL 資料庫,內建 Git 式版本控制,允許使用者對資料表進行分支、合併與提交變更。

DevnorsAI/devnors-data-mcp

一個將 AI 助手連接至 Devnors Data API 的 MCP 伺服器,使其能直接搜尋法律、企業及學術資料。

jprx/darwin-vm

一個基於 Qemu 的模擬器,可啟動 iOS 與 macOS 到一個極簡的根 shell,用於核心調試與底層 Darwin 系統分析。

google-ai-edge/LiteRT-LM

一個基於 LiteRT 的生產就緒編排層,可在行動、Web 與 IoT 平台上的設備端實現高效能 LLM 執行。

msitarzewski/agency-agents-app

一個用於AI代理角色的原生桌面安裝程式和管理器,可在Cursor和Claude Code等各種AI編碼工具之間同步專業角色。

hetpatel-11/Adobe_Premiere_Pro_MCP

一個 MCP 橋接器,讓 AI 代理能控制 Adobe Premiere Pro,提供超過 280 個工具,用於自動化影片編輯、專案管理與時間軸操作。

nhovongoc0-max/meme-radar

使用 GMGN、GoPlus 和 DexScreener 掃描潛在候選者,過濾高風險代幣並提供人工驗證證據的多鏈迷因幣雷達。

trymirai/uzu

一個高性能推論引擎,讓開發者能在應用程式中本地部署 AI 模型,以消除延遲、成本與隱私問題。

zml/zml

一個生產環境推論堆疊,將 AI 工作負載與專有硬體解耦,使單一程式碼庫能在 NVIDIA、AMD、Intel 與 TPU/Trainium 加速器上執行模型。

apache/ossie

Apache Ossie 是一種與供應商無關的語意模型規範,可標準化 AI 代理、BI 平台與資料分析工具之間的資料定義,消除不一致性。

deer-flow/llm-space

一款面向代理構建者的桌面應用程式,透過本地優先的數據管理來實現代理的原型設計、追蹤、除錯與評估。

ZingerLittleBee/Heeler

herdr 代理優先型終端執行環境的原生 iOS 配套應用,允許使用者透過行動代理控制台監控和操控遠端程式碼代理。

567-labs/instructor

一個透過 Pydantic 進行驗證、類型安全與自動重試,確保 LLM 回傳可靠、結構化 JSON 的函式庫。

jame581/GodotPrompter

一個為 Godot 4.x 提供 AI 編碼代理領域專業知識與最佳實務的代理技能框架,適用於 GDScript 與 C# 遊戲開發。

DLR-RM/stable-baselines3

一組為研究與產業界設計的、可靠的強化學習演算法PyTorch實作,旨在提供穩定的基線。

gpustack/gpustack

一個開源 GPU 集群管理器,用於協調推論引擎並為可擴展的 AI 模型服務提供 GPU 實例。

InsForge/InsForge

一個開源後端平台,專為 AI 編碼代理設計,提供資料庫、驗證與運算基礎設施。