pzqpzq/LSF_MDia
MDia 是一個 Python 庫,將 LLM 的中間推理形式化為可重用的「方言卡」(LSF),並提供一個確定性的八階段流水線(collect → create → evolve → profile → select → run → validate-rules → report),用於在異質模型間生成、演化、分析、路由和審計這些協定。它支援黑盒 LLM API,提供多種路由計畫,包含 100 條規則庫,並透過在測試評估前凍結決策來保證可重現性。該倉儲包含一個無需任何 API 金鑰的玩具離線示範、詳盡的文件、MIT 授權,以及對 ICML 2026 海報和 arXiv 論文的引用。
clearbluejar/pyghidra-mcp
一個將 Ghidra 的逆向工程套件與 LLM agent 集成的 MCP server,可實現自動化反編譯、語義代碼搜索和二進制分析。
yehonathanlitman/Lift4D
Lift4D 透過將每幀的 3D 估計融合至可變形模型中,從單一視角的「野外」影片中重建出時間一致的 4D 資產。
agent-network-protocol/anp
Agent Network Protocol (ANP) 的多語言 SDK 與參考實作,讓 AI 代理能透過標準化介面實現發現、驗證與安全通訊。
martin-rizzo/ComfyUI-ZImagePowerNodes
一組為 Z-Image Turbo 模型優化之 ComfyUI 自訂節點,提供增強的風格控制、低步驟一致性與構圖多樣性。
Quantatirsk/qwen3-asr
Qwen3‑ASR 是一個自托管語音轉文字伺服器,封裝了 Qwen3‑ASR 模型(0.6 B 與 1.7 B)。它自動選擇 GPU‑vLLM 後端或 CPU‑Rust 後端,提供 OpenAI 與阿里雲相容的 HTTP/WebSocket API,支援說話人分離、基於 VAD 的分段、批次推理,並可透過 Docker、自訂 GPU 鏡像或離線 tarball 部署。MIT 許可證。
aws/mcp-proxy-for-aws
一個讓 AI 應用與代理能連接到 AWS 主機 MCP 伺服器的橋接器,可自動處理 AWS IAM(SigV4)驗證。
IBM/LNN
LNN 是一個 Python 庫,用於神經符號人工智能,將邏輯公式表示為加權神經網絡,即使在知識不一致或不完整的情況下,也能實現可解釋、可微分的推理與學習。
llt22/talkio
一個本地優先、支援多模型的 AI 聊天客戶端,支援自訂角色與 MCP 工具,實現不同 AI 模型之間的群組對話。
Lamatic/AgentKit
AgentKit 是一個開源 SDK,提供 70 個現成的「套件」(完整應用、流程或範本),用於建立、測試與部署 AI 代理。套件由簡單的設定檔定義,可在視覺化流程工作室中編輯,並以無伺服器運行的 Next.js 應用形式交付。該集合涵蓋支援分診、程式碼審查、RAG 聊天、招聘助理、法律/醫療機器人等多種業務導向代理,是一個即時可用的平台,可快速建立可靠、企業級的 AI 代理。
Ammaar-Alam/minebench
MineBench 是一個基於網頁的基準測試工具,透過讓 LLM 對『中世紀城堡』等提示輸出體素座標,來評估其三維空間推理能力。它可視化生成結果,支援人類進行頭對頭對比,並使用 Bradley-Terry 系統對模型進行排名。平台包含成對投票用的 Arena、自訂建構用的 Sandbox、社群提示的 Gallery,以及 GLB、STL、.vox、.schem 等格式的匯出功能。支援主流 LLM 提供商,可透過 Node.js、pnpm 和 Docker 在本地執行。
yejy53/GenClaw
GenClaw 是一個用於圖像生成的程式碼驅動代理框架,它使用可執行的視覺草圖(SVG、HTML/CSS)作為可控畫布,然後再進行最終渲染。
redis/agent-memory-server
一個為 AI 代理提供的受管記憶層,透過兩層式會話與長期記憶模型,在跨工作階段中提供事實與偏好的持久儲存。
ammaarreshi/RedAlert2-Mac-iOS-iPad
專為 iOS 與 iPadOS 打造的 Command & Conquer: Red Alert 2 及 Yuri's Revenge 原生體驗移植版,具有自定義 RTS 觸控控制與重構的遭遇戰 AI。
freestylefly/wesight-obsidian
一個將本地 AI 代理(Claude Code、Codex、OpenCode)與多平台內容發布工作台整合的 Obsidian 外掛,支援社交媒體與專業文件發布。
Entrpi/ds4-on-spark
針對NVIDIA DGX Spark的高性能服務堆疊,支援DeepSeek-V4-Flash,具備連續批次、推測解碼與大上下文視窗記憶體管理功能。
cvs-health/uqlm
一個使用多種不確定性量化技術為模型輸出分配置信度分數的 Python 庫。
agentscope-ai/Trinity-RFT
一個通用的 LLM 強化微調框架,透過解耦探索、訓練與資料緩衝,支援多樣的 RL 算法與智能體工作流程。
vvvvvjdy/D-OPSD
D-OPSD 是一個在線策略自我蒸餾框架,允許步進式蒸餾擴散模型在保持快速推理能力的同時,持續地針對新風格和概念進行微調。
modelstudioai/cli
Aliyun Model Studio CLI (bailian‑cli) 是 Alibaba Cloud AI 平台的終端工具,提供多模態生成(文字、影像、影片、語音)、資產理解、托管代理編排、資料集驗證、微調、部署與帳戶管理的指令。可透過 npm 或單行指令安裝,使用 API 金鑰或 OAuth 認證後,執行 `bl …` 指令,或讓 AI 代理將自然語言提示翻譯為 CLI 呼叫。
physiclaw/PhysiClaw
PhysiClaw 是一個 AI 代理,透過機器人臂與攝影機物理操作智慧型手機,無需 API 或軟體安裝,即可在任何應用程式中自動化任務。
mit-acl/mighty
MIGHTY 是一個 ROS 2 函式庫,利用 Hermite spline 為無人機 (UAV)、多無人機集群和地面機器人規劃快速、平滑的軌跡。它可以在模擬(Gazebo, RViz)或真實硬體上執行,提供 Docker、原生 Ubuntu 和 Jetson 安裝選項,並在 IEEE RA-L 論文中有所描述。
aerostack2/aerostack2
一個專注於模組化與集群能力的 ROS 2 框架,用於建立自主式多空中機器人系統。
visose/Robots
用於 Rhino 8 和 Grasshopper 的插件,允許使用者為各種工業機器人建立、模擬並生成特定製造商的代碼。
vmayoral/robot_hacking_manual
機器人網路安全綜合入門系列及手冊,透過案例研究與教學來凸顯漏洞並推廣「安全第一」的機器人開發理念。
OpenLegged/URDF-Studio
URDF Studio 是一個瀏覽器-based 的機器人創作工作台,可編輯 URDF/MJCF/USD 模型,組裝多個機器人,匯出至多種格式,並使用 AI 助手進行生成與檢視。採用 React、Three.js、TypeScript 與 Zustand 建構,同時提供可重用的 `@urdf-studio/react-robot-canvas` 元件。採用 Apache-2.0 授權。
gazebosim/ros_gz
一套用於橋接 ROS 與 Gazebo 模擬器的整合套件,可實現機器人模擬中的雙向通訊與感測器數據傳輸。
real-stanford/umi-on-legs
一個將人類示範與模擬訓練的全身控制器結合的框架,旨在為配備手臂的四足機器人實現移動操作技能。
nasa/ogma
用於將安全的執行時監控器整合至 NASA Core Flight System 與 ROS 等系統中的工具,可自動生成即時 C99 膠水程式碼。
Teddy-Liao/walk-these-ways-go2
Unitree Go2 四足機器人的 Sim-to-Real 運動控制入門套件,將 walk-these-ways 框架適配於 unitree_sdk2 架構。
NVIDIA-ISAAC-ROS/isaac_ros_nvblox
nvblox 的 ROS 2 整合,實現基於視覺的障礙物避讓所需的即時 3D 場景重構與 2D 成本地圖產生。
abizovnuralem/go2_omniverse
一個在 Nvidia Isaac Sim 中為 Unitree Go2 與 G1 機器人打造的高保真數位雙生專案,實現物理機器人與其虛擬對應物之間的即時同步。
SJTU-ViSYS/M2DGR
M2DGR 是一個用於地面機器人、具備豐富感測數據與具挑戰性的真實世界場景的大規模、多模態 SLAM 資料集,用於基準測試導航演算法。
RoboVerseOrg/RoboVerse
一個用於可擴展機器人學習的統一平台與基準,將多個模擬框架和資料集整合到單一介面中。
NetManAIOps/ChatTS
ChatTS 是一種專為多變量時間序列設計的多模態 LLM,能原生理解並推理時間序列資料,讓使用者能對數值資料進行對話式問答。
FrigadeHQ/yap
一款輕量級、在設備上運作的 macOS 語音輸入工具,利用 Apple 原生語音 API 將轉錄文字私密地貼上至任何活躍應用中。
jamsch/expo-speech-recognition
一個為 React Native 與 Expo 提供跨平台語音轉文字功能統一 API 的套件,支援 iOS、Android 與 Web。
octimot/StoryToolkitAI
一款 AI 驅動的電影剪輯助手,可對影片素材進行轉錄、索引和搜尋,允許剪輯師使用 LLM 自動建立用於匯出至剪輯軟體的敘事片段。
cmusphinx/pocketsphinx
PocketSphinx 是一個開源、離線的語音轉文字引擎(C 庫,附帶 Python 繫結),可在低資源裝置上高效運行。它提供命令列工具與 API,用於辨識或對齊音訊,並將結果輸出為 JSON 格式。
sanjay3290/ai-skills
為 AI 程式設計助手提供的便攜式、標準化技能集合,使其能夠與資料庫、生產力工具和雲端基礎設施進行互動。
basetenlabs/truss
用於將 AI/ML 模型打包並部署至生產環境的 CLI 工具,自動化容器化、GPU 設定與相依性管理。
xxxily/hello-ai
一個由 AI 驅動的導航中心,利用自主代理從 GitHub 發現、評估並組織高品質的開源 AI 專案,形成一個自動更新的目錄。
YanWenKun/ComfyUI-Docker
為 NVIDIA、AMD、Intel 與 CPU 環境提供預先設定的 Docker 影像,簡化節點式 AIGC GUI 工具 ComfyUI 的部署。
lynote-ai/ai-image-detector
AI Image Detector 是一個開源的 Python 工具,用於估計圖像是由 AI 產生的可能性。它內建多種即用型後端(UnivFD、Sentry、Nonescape、混合集成)並允許你只需執行單一指令 (`aidetect detect …`) 於檔案或資料夾,即可輸出機率與標籤。可選的 extras 提供 Gradio 網頁 UI 或 FastAPI 伺服器。此倉庫還包含基準測試腳本、閾值校準,以及選擇後端的清晰指引。它是一個輕量、一次安裝、隨處可執行的 AI 圖像偵測工具,並有文件說明其限制(無全域保證、無區域層級定位)。
OpenEnvision/WorldFoundry
一個開源基礎設施,為影片生成、3D/4D 表示與具身 AI 提供統一的推論、資產階段化與基準評估堆疊。
devswha/patina
一種在四種語言中運作的決定論、基於模式的人類化工具,將AI式文本重寫為自然語言,同時嚴格保留事實意義。
ai-shifu/ChatALL
一個桌面客戶端,允許使用者同時向多個 AI 機器人發送提示詞,以比較它們的回應並找到最佳結果。
shinpr/claude-code-workflows
Claude Code Development Workflows 是一組 Claude Code 插件,將 Claude AI 助手轉變為結構化的開發流程。插件提供「食譜」(如 `/recipe‑implement`、`/recipe‑design`、`/recipe‑review`),強制執行結果共識、設計文件化、工作計畫生成、任務級實作與自動驗證,以及獨立安全審查。三個插件家族分別涵蓋後端、React 前端和全端專案,可透過 Claude 市場安裝。當需要可重複的安全門和設計到程式碼生成的正式交接時非常有用;對於快速原型可跳過。