firstintent/ccteam
ccteam 是一個編排層,將獨立的 AI 編碼 CLI 轉變為協調的團隊,允許代理從統一控制台跨不同供應商和機器運行。
NVIDIA-NeMo/Guardrails
NeMo Guardrails 是 NVIDIA 推出的開源 Python 工具包,讓開發人員能為基於 LLM 的聊天應用程式新增可程式化的安全與控制規則(防護欄)。它支援輸入、對話、檢索、執行和輸出防護欄,使用名為 Colang 的簡單 DSL 來定義流程,可搭配多種 LLM 供應商,提供具 OpenAI 相容 API 的 CLI/伺服器,並包含評估工具。此程式庫旨在建置值得信賴、安全的對話式 AI。
deepcoldy/botmux
一個可讓你透過 Lark/飛書遠端控制 AI 程式設計 CLI 的橋接器,將終端輸出以互動式卡片形式即時流式傳輸,並提供 Web 終端以支援行動與桌面存取。
MORTEN-BUUR/nordef-matrix-open-control
一種與模型無關的AI代理安全控制平面,透過在語言模型外部強制執行決定性策略和加密人類批准來保障安全。
kagent-dev/kagent
一個 Kubernetes 原生框架,用於以宣告式自訂資源方式建置、部署與管理 AI 代理。
langwatch/langwatch
一個用於 AI 生產環境的開源平台,允許公司追蹤、測試、路由和管理所有 LLM 調用和編碼代理 (coding agents) 的使用。
microsoft/apm
一個開源的 AI 代理相依性管理器,允許開發者透過可移植的清單檔宣告與分享代理設定、技能與外掛程式。
ProxyShard/ShardBrowser
一個開源的反偵測瀏覽器啟動器,使用修補過的 Chromium 引擎,為網頁爬蟲和多帳號管理提供隔離且偽裝的瀏覽器身份。
deeplethe/forkd
用於 AI Agent 扇出(fan-out)的 microVM 沙箱執行期,利用 snapshot copy-on-write 技術在毫秒內生成數百個隔離的預熱執行期。
git-ai-project/git-ai
一個開源的 git 擴展,為 AI 生成的程式碼提供行級歸屬,將每一行連結到生成它的代理、模型和提示。
chen-006/meow-llm-detector
透過比較回應分佈與已知模型基準,偵測 API 背後的 LLM 是哪一個。
jlrouzies-fr/DLSS5-Feeder
透過將 ReShade 資料橋接到 DLSS 呼叫,使沒有原生 DLSS 支援的遊戲也能實現 DLSS 5 神經渲染的工具。
SaladDay/cc-switch-cli
一個用於管理多個 AI 編碼助手(如 Claude Code、Codex 和 Gemini)的 API 提供者、帳戶和系統提示詞的 CLI 與 TUI 切換板。
zhukunpenglinyutong/desktop-cc-gui
一個將 Claude Code 與 DeepSeek Harness 等命令列 AI 編碼執行環境整合至單一圖形介面的多引擎 AI 編碼桌面客戶端。
streamlit/streamlit
一個 Python 框架,能將腳本轉換為互動式網頁應用,讓資料科學家在無需前端經驗的情況下,構建並分享儀表板和 AI 聊天應用。
lancedb/lancedb
基於 Lance columnar 格式構建的多模態 AI 資料湖倉與向量資料庫,可針對 PB 級向量與多模態數據實現快速、可擴展的搜尋。
vllm-project/production-stack
Kubernetes 上用於生產級 vLLM 部署的參考實作,提供可擴展的推理堆疊,支援請求路由與可觀測性。
AtomicBot-ai/Atomic-Chat
一個本地 AI 應用與推理引擎,讓使用者能在自己的裝置上私密執行開源權重的大規模語言模型(LLM),同時為其他代理提供 OpenAI 相容 API。
dagucloud/dagu
無需外部資料庫,將現有腳本與容器透過宣告式 YAML 轉換為生產級 DAG 的本地優先、自托管工作流引擎。
furkankly/zoetrope
一個用於 Claude Code 和 Codex 會話的視覺化工具,將文字轉錄轉換為互動式、即時的流程圖,以監控和審查代理工作流程。
fastai/fastai
一個基於 PyTorch 的深度學習函式庫,提供高階元件以提升開發效率,並提供低階元件以支援研究彈性。
MrLesk/Backlog.md
一款 Markdown 原生的任務管理器和看板視覺化工具,圍繞規範和計畫審查建構 AI 代理工作流程,以防止程式碼膨脹和審查疲勞。
TIGER-AI-Lab/ClawBench
一個用於評估 AI 瀏覽器代理在即時網站上執行日常線上任務的開源基準測試,具有 5 層記錄管線和智能體評估功能。
sting8k/pi-vcc
一個針對 Pi AI 代理的演算法式對話壓縮工具,透過確定性提取取代 LLM 摘要,有效減少 token 使用量並防止歷史記錄遺失。
tw93/Waza
一個結構化工程技能的函式庫,供 AI 代理使用,以系統化除錯和設計壓力測試等嚴謹習慣取代通用的 AI 輸出。
flashinfer-ai/flashinfer
FlashInfer 是一個 Python 庫,為 LLM 推論提供超高速、硬體感知的 CUDA 內核——涵蓋注意力、GEMM、MoE、取樣及相關運算。它能自動選擇最佳後端(FlashAttention-2/3、cuDNN、CUTLASS、TensorRT-LLM),支援低精度 FP8/FP4,相容所有現代 NVIDIA GPU,且已被 vLLM 和 TensorRT-LLM 等主流服務框架採用。
sunblaze-ucb/exploitgym
ExploitGym 是一個大規模的真實世界漏洞基準測試,用於評估 AI 代理開發功能性安全漏洞利用程式的能力。
alibaba/zvec
Zvec 是阿里巴巴推出的開源、進程內向量資料庫。它可儲存密集或稀疏嵌入,提供閃電般快速的 ANN 與全文搜尋,支援混合查詢,並提供 Python、Node.js、Go、Rust 與 Dart 的 SDK。該函式庫可在 Linux、macOS、Windows、Android 與 iOS 上本地執行,具備持久的 WAL 儲存與並行讀取能力。適用於基於 LLM 的檢索、邊緣裝置,或任何需要快速嵌入式相似性搜尋的應用。
czlonkowski/n8n-skills
一組 14 個專家技能與一個為 Claude AI 設計的強制執行層,使其能透過 n8n-mcp 伺服器建構、驗證與部署生產就緒的 n8n 工作流程。
wavetermdev/waveterm
一個開源的 AI 結合終端,結合命令列介面、上下文感知 AI 協助、持久的 SSH 會話與內建圖形化編輯器。
plannotator/herdr-annotate
一個 Herdr 外掛程式,允許使用者對終端機文字進行註解並審查 AI 代理的回應,並將反饋直接發送回代理。
firerpa/lamda
一個將 UI 自動化、遠端桌面、封包擷取和 AI 代理整合到單一統一服務的全能型 Android 自動化與控制平台。
DevnorsAI/devnors-data-python
一個為 AI 代理優化、提供單一 API 網關,用於存取法律案件、企業紀錄與學術研究等多樣化資料領域的 Python SDK。
yuxino/kiri
適用於 macOS 與 Windows 的本地優先螢幕擷取工具,整合截圖、註解、OCR 與區域錄製。
OpenPipe/ART
一個使用 GRPO 訓練多步 AI 代理,使其從經驗中學習並提高在現實世界任務中可靠性的開源 RL 框架。
huggingface/Repo2RLEnv
一個將軟體儲存庫、拉取請求和任務種子轉換為 Harbor 格式的可執行、可驗證 RL 環境的工具,用於訓練和評估 AI 代理。
stefan-jansen/machine-learning-for-trading
一個全面的框架與程式碼庫,用於開發機器學習驅動的交易策略,涵蓋從資料取得與訊號研究到即時生產部署的整個流程。
meilisearch/meilisearch
一款提供全文、語意與混合搜尋功能的超高速搜尋引擎,支援輸入即搜尋性能與 AI 就緒整合。
ParthJadhav/app-store-screenshots
一項適用於 AI 程式設計代理的技能,能夠搭建 Next.js 編輯器,用於建立並匯出可用於實際產品的 Apple App Store 與 Google Play Store 行銷截圖。
duriantaco/skylos
一個開源的靜態分析 CLI,可在多種語言中偵測死程式碼、安全弱點與 AI 生成程式碼的幻覺,確保合併前的程式碼品質。
dmtrKovalenko/fff
一個高效能的檔案和內容搜尋工具包,為人類和 AI 代理提供防拼寫錯誤、頻率排名搜尋。
kenn-io/agentsview
一個以本地為首的會話瀏覽器與成本追蹤工具,為 AI 編碼代理提供跨多個工具的統一搜尋、分析與支出監控。
anthropics/sandbox-runtime
一個輕量級的作業系統層級沙盒工具,透過強制執行檔案系統與網路限制來保護處理程序,從而實現更安全的 AI 代理與 MCP 伺服器執行環境。
deepset-ai/haystack
一個開源的 AI 編排框架,用於在 Python 中構建可投入生產的 RAG 系統、自主代理與 LLM 應用。
zhnnky329/MathModeling-skills
一款針對數學建模競賽的嚴謹工作流助手,透過門控管道與審計層確保資料一致性和可重現性,同時將建模決策權保留在人類手中。
NVIDIA/SkillEvaluator
一個多層次框架,用於評估 AI 代理技能,確保其安全、無重複,並透過驗證、去重與即時沙箱測試有效提升代理效能。
Dryxio/reagent
一個使用 Ghidra 和 LLM 透過自主流程,從編譯後的二進位檔中重建並驗證 C/C++ 函數的 AI 驅動逆向工程代理。
cube-js/cube
一個開源語義層,用程式碼定義指標和業務邏輯,並透過 API 將其暴露給 BI 工具和 AI 代理。