criptogus/HermesOffice

一個開源的 AI 驅動的辦公套件,支援對 Microsoft Office 格式與 PDF 的原生位元保留編輯,並整合 AI 代理以實現文件工作流程中的 AI 編輯。

supabitapp/supacode

一個原生 macOS 命令中心,透過為每個 AI 編碼代理提供獨立的 git 工作樹和持久終端,使開發者能夠並行運行多個 AI 編碼代理。

kdcokenny/ocx

一個 OpenCode 的配置與元件管理器,讓使用者能在不同的倉庫間套用可攜帶、經 SHA 驗證的設定檔與元件。

zhimaAi/chatwiki

ChatWiki 是一個基於 Docker 的開源平台,可將微信官方帳號轉換為 AI 助手。提供視覺化工作流建構、自動回覆(文字、語音、圖片、小程序卡片)、從抓取文章或上傳文件建立知識庫、混合向量-圖譜搜尋以及人工交接功能。後端使用 Go 和 Python,前端使用 Vue.js,資料庫為 PostgreSQL 16 與 pgvector 實作嵌入。支援超過 20 個 LLM 提供商(如 OpenAI、Claude、DeepSeek),可部署為 Web 應用、桌面客戶端或嵌入其他服務。個人使用者可免費使用;商業使用者需購買付費授權。

autonomous-ai/autonomous-os

一個可自訂的機器人作業系統,整合了代理推理引擎和模組化技能系統,以實現真正的物理自主性。

google-deepmind/concordia

用於構建生成式基於智能體模型,模擬實體在物理、社會或數位環境中的落地交互的庫。

google/sam

一個去中心化、零信任的P2P網路層,使自主AI代理能在分散式環境中安全地發現與通訊,同時維持資料與身分的完全主權。

RefoundAI/lenny-skills

一個由 76 個產品管理與工程技能組成的 Markdown 檔案庫,基於 Lenny 的播客與新聞通訊,為 AI 代理提供專業知識與工作流程。

sktime/sktime

一個為時間序列分析提供統一介面的 Python 函式庫,包括預測、分類和異常檢測,並與 scikit-learn 生態系統相容。

jd-opensource/JoyAI-Video-Edit

一種利用自回歸擴散技術,在幀到達時即時編輯直播影片串流或上傳影片的系統。

zhongkaifu/TensorSharp

TensorSharp 是一個原生 .NET 引擎,可在 CUDA、Vulkan、Metal、Apple-MLX 或純 C# CPU 上執行 GGUF 格式的 LLM、基於擴散的圖像/影片生成與多模態模型。其效能可與或超越 llama.cpp,支援連續批次、分頁 KV 快取、張量平行、推測解碼、工具呼叫/代理技能,並提供 Ollama/OpenAI 相容 API 與 Web UI。

nexu-io/codex-slides

專為 Codex 編碼代理設計的開源 AI 投影片工作室,透過可控的即時編輯工作流,將提示詞、程式碼庫或檔案轉換為專業的簡報。

PhiloLabs/fable51-worlds

一個利用AI代理群從文字、影像或影片生成可驗證、可行走3D世界的系統,以基於程式碼的Three.js應用形式渲染。

mkturkcan/DART

一個免訓練框架,利用 TensorRT 優化與蒸餾主幹,將 SAM3 轉換為即時多類別開放詞彙偵測器。

product-on-purpose/pm-skills

一個精心整理的 68 個專業產品管理技能、範本與工作流程資料庫,讓 AI 代理能消除提示摸索的困擾,並統一高品質的產品管理輸出。

ros2/ros2

機器人作業系統(ROS)是一套開源的軟體程式庫與工具,旨在協助開發者建構機器人應用。

compozy/compozy

一個為 ACP 相容代理 CLI 提供的守護程序式執行時,用於管理持久會話、自動化和記憶的 AI 代理作業系統。

vibe-motion/skills

一套專為AI代理設計的動畫與動態圖形技能集合,可生成從3D渲染到品牌宣傳影片的各類專業視覺資產。

PacktPublishing/LLM-Engineers-Handbook

一個可直接投入生產的框架與程式碼庫,用於建構端到端的 LLM 系統,涵蓋訓練、RAG 與在 AWS 上的部署。

OSU-NLP-Group/HippoRAG

一個為 LLM 設計的記憶框架,透過模擬人類長期記憶功能,提升了多跳檢索(multi-hop retrieval)與複雜上下文整合的能力。

tuya/TuyaOpen

一個跨平台的 C/C++ SDK 與框架,用於構建整合了嵌入式設備、多模態 AI 以及透過 Tuya Cloud 連接領先 LLM 的 AI-agent 硬體。

colliery-io/graphqlite

一個為 SQLite 添加圖資料庫功能與 Cypher 查詢語言支援的擴展,使嵌入式圖資料儲存與查詢成為可能。

FujiwaraChoki/supoclip

一款開源、AI 驅動的影片剪輯工具,可將長影片自動轉換為適合傳播的直式剪輯,支援自動人臉裁切、字幕與病毒傳播評分。

PetoiCamp/OpenCatEsp32-Quadruped-Robot

OpenCatESP32 是運行在 ESP32 基礎 BiBoard 上的固件,用於 Petoi 的開源四足機器人(Bittle X、Nybble Q 和即將推出的 Quaddle)。它提供即時步態控制、動作錄製「木偶模式」,以及足夠的處理能力用於視覺或強化學習實驗,所有功能均可透過 Arduino IDE 編程實現。

hanlinwenyuan/hlwy-ai-checker

一種透過將其統計輸出指紋與官方 API 基準進行比較,來驗證第三方 AI API 供應商是否使用真實模型的工具。

owl234/ARL-Next

一個 AI 原生的資產偵察與漏洞監控平台,使用 AI 代理自動化資產發現與威脅情資收集。

thinking-machines-lab/tinker-cookbook

透過Tinker API實現語言模型微調的抽象化與配方庫,支援SFT、RL與多模態訓練。

chen0416ccc-cpu/codex-windows-fast-patch-skill

一組用於修復 Windows Codex Desktop 在軟體更新後出現的損壞功能(如 Fast Mode、Computer Use、外掛程式市場)的修復腳本與代理技能集合。

su-kaka/gcli2api

一個將 GeminiCLI 和 Antigravity 轉換為 OpenAI、Gemini 和 Claude 兼容介面的 API 網關,具備先進的 OAuth 憑證輪換與管理功能。

JuneYaooo/gpt-image2-ppt-skills

gpt-image2-ppt-skills 是一個 Python 技能,適用於多模態 AI 代理,利用 OpenAI 的 gpt‑image‑2 模型生成高品質 16:9 投影片影像,並打包成 .pptx 檔案。支援視覺優先模式與可選的可編輯模式(將投影片重構為原生 PowerPoint 物件)。使用者可透過自然語言提示建立新投影片集、克隆現有的 .pptx 模板,或編輯特定投影片元素。安裝方式為透過支援的代理安裝技能,或執行提供的腳本;需 OpenAI API 金鑰與本地 PowerPoint/Keynote/LibreOffice 渲染器。專案採用 Apache-2.0 授權。

fxy2311-youyou/expression-trainer

一款本地桌面應用,利用離線語音辨識與 AI 技術,幫助使用者透過識別填充詞與模糊語言來提升口語表達能力。

SWivid/F5-TTS

F5-TTS 是一個使用擴散 Transformer 與流匹配的高效率語音轉換系統,可快速生成流暢且忠實的語音,訓練與推論速度均顯著提升。

bytedance/flowgram.ai

一個用於建構自訂 AI 工作流程平台的可組合工作流程開發框架與工具包,支援視覺化畫布與變數管理。

Zafer-Liu/Data-Analysis-Agent

一個用於商業資料分析的對話式 AI 代理,能將自然語言問題轉換為 SQL 查詢、視覺化圖表與商業洞察。

Gsync/jobsync

JobSync 是一個基於 Docker 的自托管 Web 應用,用於追蹤求職申請、履歷、任務與面試問題,並透過支援工具呼叫的 LLM(本地 Ollama 或雲端服務)提供 AI 功能——履歷審查、職缺匹配評分、求職信生成與自動職缺發現。它還提供 MCP 伺服器,允許外部 AI 代理直接新增職缺或面試項目。

kennss/SiliconScope

一個無需 sudo 的 Apple Silicon 系統監控工具,為 AI 和媒體工作負載提供對神經網路引擎、媒體引擎和記憶體頻寬的深度可見性。

microsoft/agent-framework-go

基於圖的編排,用於建構生產級 AI 代理與多代理工作流程的 Go 實作 Microsoft Agent Framework。

Anionex/agent-vision-toolkit

一個透過任務感知視覺工具與無縫代理整合,為僅支援文字的 LLM 代理賦予圖像問答與 GUI 自動化能力的工具包。

fufankeji/deepseek-harness-studio

一個針對 DeepSeek Harness 的零程式碼桌面應用程式,提供視覺化介面以管理 AI 代理、外掛程式和本地模型推理。

TNTwise/REAL-Video-Enhancer

一款支援多種 GPU 後端與多種專用模型的跨平台 GUI 應用程式,用於 AI 驅動的影片畫格插值與超解析度。

OpenPetsHQ/openpets

一個將動畫寵物置於螢幕上的桌面伴侶平台,具備插件 SDK 與 MCP 整合,讓 AI 編碼代理驅動寵物的反應與狀態。

only-cli/oc

一個 CLI 工具,可將網站轉換為緊湊、編號格式,供 AI 代理瀏覽網頁時節省 token。

facebookresearch/map-anything

一個開源研究框架,透過單個 Transformer 模型處理來自各種輸入組合的多種 3D 任務,實現通用的度量 3D 重建。

ghbalf/freecad-ai

一個 AI 驅動的工作台,可從自然語言描述生成並執行 Python 程式碼,以建立 3D 模型。

pytorch/executorch

ExecuTorch 是一個開源的 PyTorch 基礎執行時,用於將 AI 模型部署到邊緣裝置——從手機到微控制器。它可直接從 PyTorch 導出模型,提前編譯為極小的 `.pte` 檔案,並透過輕量級 C++/Python/Swift/Kotlin API 在多種硬體後端上執行。支援視覺、語音和 LLM(例如 Llama),已在 Meta 的生產應用中使用。

EricLBuehler/mistral.rs

以 Rust 寫成的快速、彈性 LLM 推論引擎,支援多模態模型、代理工具執行與 OpenAI/Anthropic 兼容 API。

goohai/Goohaitools-comfyui

一個超過 70 個自訂節點的完整工具包,專為 ComfyUI 設計,用於專業影像製作,專注於批次處理、自動化證件照製作與進階遮罩操作。

BryceWG/BiBi-Keyboard

一款 AI 驅動的 Android 語音輸入法,支援多種雲端與本地 ASR 引擎,並使用 LLM 進行文字後處理。