ooples/token-optimizer-mcp

Token Optimizer MCP 是一個 MIT 授權的 Node.js 庫與本地伺服器,攔截 LLM 代理的工具呼叫,將冗餘讀取替換為差分,建構專案級知識圖譜,並衡量每個令牌的實際貨幣影響。基準測試顯示多個工作負載最高減少 98%,20 回合會話成本為 0.915×。它提供零遙測儀表板,支援 16 個客戶端(Claude Code、Gemini、Codex 等),僅需本地安裝即可使用。

lucienhuangfu/eLLM

針對 CPU 伺服器的 LLM 推論框架,透過優化記憶體使用,在長時程、多輪推論與超長上下文任務中實現超越 GPU 的效能。

judge0/judge0

Judge0 是一個強大且具沙盒功能的線上程式碼執行系統,讓開發者能將超過 90 種語言的安全程式碼編譯與執行功能整合至其應用程式中。

berylliumsec/nebula

一個 AI 驅動的滲透測試工作台,將安全工具、AI 輔助與隔離執行環境整合到一個可審計的工作空間中。

h2oai/h2o-3

H2O 是一個記憶體內的分散式、可擴展機器學習平台,提供廣泛的演算法以及 AutoML 功能,可自動建構模型。

antoinezambelli/forge

一個為自託管 LLM 工具呼叫設計的可靠性層,透過防護規則、救援解析與重試機制,顯著提升本地模型使用工具的可靠性。

niaka3dayo/agent-skills-vrc-udon

一套知識庫,包含技能、規則與驗證鉤子,教導 AI 程式碼代理產生正確且可編譯的 UdonSharp 程式碼,適用於 VRChat 世界開發。

DeHor-Labs/mcp-fiscal-brasil

一個 MCP server,將 AI 助手連接至巴西的財政生態系統,提供 CNPJ/CPF 驗證、NF-e 解析與稅務合規性分析工具。

arogozhnikov/einops

一個使用受愛因斯坦啟發的記法實現靈活且強大張量操作的庫,使深度學習程式碼更易讀且與框架無關。

sirius-db/sirius

一個 GPU 原生 SQL 引擎,透過將查詢執行卸載至 NVIDIA GPU 而無需重寫查詢,從而加速 DuckDB 等資料庫。

amantus-ai/vibetunnel

一個將您的 Mac 或 Linux 終端機代理至網頁瀏覽器的工具,無需複雜的 SSH 設定即可遠端存取命令列工具與 AI 代理。

oxylabs/chatgpt-scraper

一個基於 API 的抓取工具,可自動收集 ChatGPT 的結構化回應與元資料,適用於 SEO 監控、AI 訓練與品牌分析。

mantoni/beads-ui

用於 bd CLI 的本地圖形使用者介面,讓開發者在與程式設計代理協作時能夠直觀地管理 Issue 與 Epic。

ombulabs/claude-code_rails-upgrade-skill

一個用於透過順序雙啟動遷移策略,將 Ruby on Rails 應用從 2.3 升級至 8.1 的 Claude Code 技能。

neiii/bridle

一個統一的設定管理器,允許使用者透過單一介面管理 AI 程式助手的設定檔,並在多個工具中安裝技能或 MCP。

metorial/metorial

為 AI Agent 提供開源身份與存取層,在數千個外部系統整合中提供標準化的身分驗證、權限與可觀測性。

ndif-team/nnsight

nnsight 是一個 Python 庫,可讓您在不撰寫鈎子的情況下,追蹤、讀取和修改任何 PyTorch 模型(包括 Hugging Face、Diffusers 和 vLLM 模型)的任意中間張量。您在 `with model.trace(...):` 區塊內撰寫一般 Python 程式碼;該庫會在前向傳播期間注入您的程式碼,允許您儲存值、計算梯度、逐步生成文字、批量處理提示,或在 NDIF 托管的大模型上遠端執行相同追蹤。透過 `pip install nnsight` 安裝,並使用 `TransformersModel` 等封裝開始探測或編輯模型內部。

gemini-cli-extensions/conductor

一個為 AI 編碼代理程式(AI coding agents)設計的插件,強制執行「規格驅動開發」(Spec-Driven Development)工作流,要求代理程式在實作代碼之前先定義專案上下文、規格與計畫。

johannesjo/parallel-code

一個用於並行分派多個 AI 編碼代理的 GUI,使用 git worktree 將每個任務隔離至獨立的分支與目錄中,實現並行開發。

guanyang/open-agent-hub

一個輕量級的 CLI 工具,用於管理和啟用模組化技能、專家代理角色以及斜線指令,適用於 Claude Code 和 Cursor 等 AI 編碼助手。

kitops-ml/kitops

CNCF 開源工具,透過符合 OCI 的工件(稱為 ModelKits)對 AI/ML 專案進行打包、版本化與安全共享。

PaddlePaddle/PaddleX

基於PaddlePaddle的低程式碼AI開發工具,提供預訓練模型產線,支援在多種硬體上快速完成訓練、推論與部署。

utkuozdemir/nvidia_gpu_exporter

一個使用 nvidia-smi 或 NVML 收集 NVIDIA GPU 指標的 Prometheus 匯出器,支援 Linux、Windows 和 macOS。

SalesforceAIResearch/uni2ts

一個基於 PyTorch 的函式庫,用於 Universal Time Series Transformers 的預訓練、微調與評估,實現跨多樣化資料集的零樣本預測。

controlplaneio-fluxcd/flux-operator

一個自動化 Flux CD 生命週期管理並支援 AI 輔助 GitOps 的 Kubernetes operator

MinaSaad1/pbi-cli

專為與 Claude Code 等 AI 代理整合而設計的命令列介面,可實現 Power BI 語意模型與報表的自動化

Laliet/cc-switch-web

適用於 Claude Code 與 Gemini CLI 等 AI CLI 工具的跨平台設定管理器,支援一鍵切換提供者與統一管理 MCP 伺服器。

tumaer/JAXFLUIDS

一個用於 3D 可壓縮流體的完全可微 CFD 解算器,透過自動微分實現機器學習與數值流體力學的整合。

mock-server/mockserver-monorepo

用於測試的 HTTP(S) 模擬伺服器與代理,可模擬 API 依賴項、記錄流量,並為 AI/LLM 聊天補全 API 提供專門的模擬功能。

sqliteai/sqlite-sync

基於 CRDT 的離線優先同步擴展,使 SQLite 能夠在裝置與 AI 代理之間實現無衝突的資料複製。

BradGroux/veritas-kanban

一個以本地為先的 Kanban 看板,整合 AI 代理編排與治理,允許使用者在 Git 原生工作流程中生成與管理自主編碼代理。

NVIDIA/libnvidia-container

一個庫和 CLI 工具,可自動配置 GNU/Linux 容器以利用 NVIDIA GPU 硬體,無論使用何種容器執行時。

SciSharp/LLamaSharp

基於 llama.cpp 的跨平台 C# 庫,讓開發者能透過高階 API 在 CPU 和 GPU 上本地執行 LLaMA 及其他 LLM。

qibin0506/Cortex

一個開源專案,提供從零開始建構輕量級 0.1B MoE 大型語言模型的完整生命週期訓練管道,包含預訓練、SFT 和 RLHF。

Dao-AILab/causal-conv1d

支援多種精度與卷積核大小的高效率CUDA實作,用於PyTorch中的因果深度可分1D卷積。

niieani/gpt-tokenizer

適用於 OpenAI 模型的高性能 TypeScript 字節對編碼器/解碼器,可在 JavaScript 環境中準確計算 token 數量並估算 API 成本。

materialyzeai/matgl

一個為材料科學設計的圖深度學習庫,提供多種 GNN 架構,用於預測材料性質並模擬勢能面。

xai-org/xai-sdk-python

xAI API 的官方 Python SDK,讓開發者能將文字、影像和影片生成與理解功能整合至其應用程式中。

keras-team/keras

一個多後端深度學習框架,允許使用者使用高階 API 建構與訓練模型,該 API 可在 JAX、TensorFlow 或 PyTorch 上執行。

vdaas/vald

Vald 是一款雲原生、分散式快速近似最近鄰 (ANN) 搜尋引擎,旨在處理數十億個密集特徵向量的搜尋。

HumanSignal/label-studio-ml-backend

一個 SDK,用於將機器學習模型包裝為 Web 伺服器,連接 Label Studio,透過預標註與互動式預測自動化資料標註。

SHI-Labs/NATTEN

一個用於多維稀疏注意力機制的高性能基礎設施,透過實施鄰域注意力(Neighborhood Attention)來降低 2D 和 3D 數據的自注意力計算成本。

cloudwego/eino-ext

Eino 框架的官方擴展集合,提供對 LLM 提供者、向量資料庫與 DevOps 工具的預建整合。

thomaspinder/GPJax

一個基於 JAX 構建的低層高斯過程框架,為研究人員提供了緊跟數學符號進行 GP 模型實現和擴展的靈活性。

agentclientprotocol/python-sdk

一個為建構標準化 AI 代理與客戶端而設計的 Python SDK,提供類型化模式模型與 asyncio 傳輸

prajwalshettydev/UnrealGenAISupport

一個為 Unreal Engine 簡化 LLM 與生成式 AI 整合的插件,支援多種 AI API 並提供 Model Control Protocol 以實現 AI 驅動的編輯器控制。

NotPunchnox/rkllama

專為 Rockchip RK3588/3576 平台優化之 LLM 伺服器與客戶端,使 AI 模型可在 NPU 上實現加速的本地推理。

thomasahle/sunfish

一個簡單、緊湊的 Python 基礎國際象棋引擎,專為實驗搜尋演算法與神經網絡評估而設計。