stereolabs/zed-ros2-wrapper
Stereolabs ZED 深度相機的官方 ROS 2 包裝器,支援影像、深度、點雲、SLAM、物件檢測、人體追蹤、GNSS 融合及模擬。可在 Ubuntu 上安裝 ZED SDK 與 CUDA,透過 `ros2 launch zed_wrapper zed_camera.launch.py` 啟動。
virgo777/buddyme
一個基於 Python 的 AI 代理框架,可自動化跨多個 LLM 提供者的複雜任務分解與執行,並具備內建排程與持久記憶。
openclimatefix/graph_weather
一個基於 PyTorch 的程式庫,實現多種圖神經網絡用於天氣預報與資料同化,包含 GenCast 和 Aurora 等模型。
netdur/llama_cpp_dart
一個為 llama.cpp 提供 Dart FFI 綁定的專案,可在 Flutter 應用中於 iOS 與 Android 上本地執行 LLM、視覺與音訊模型。
javifalces/HFTFramework
以Java與Python建構的高頻率交易框架,透過統一程式碼庫實現L2 tick資料回測與即時市場執行。
microsoft/onnxconverter-common
轉換器用於將各種框架的 AI 模型轉換為 ONNX 格式時所使用的常見實用工具與函式集合。
FradSer/mcp-server-mas-sequential-thinking
一個 MCP 伺服器,透過多代理系統增強 LLM 客戶端的序列思考能力,透過一組專業 AI 代理處理每個想法,進行多維度分析。
alesaccoia/VoiceStreamAI
使用 WebSockets、語音活動檢測 (VAD) 和 Faster Whisper 實現近實時音訊串流與轉寫的 Python 與 JavaScript 解決方案。
liangnjupt/VisTouch
用於材質辨識與跨模態學習的機器人滑動接觸大型同步視頻、音訊與觸覺力資料集。
RoboDK/RoboDK-API
用於工業機器人模擬與離線編程的多語言 API,允許開發人員使用通用語言而非特定廠商語言來對任何工業機械臂進行編程。
graspnet/graspnetAPI
一個用於 GraspNet-1Billion 資料集的 Python API,提供載入、處理與驗證機器人抓取研究所需的抓取標籤與點雲資料的工具。
google-research/language-table
一套用於開放詞彙視覺-語言-運動學習的人類收集數據集及基準測試,使機器人能夠執行大量的自然語言指令。
ClemensElflein/xESC
專為機器人設計的開源、低成本無刷直流馬達電子調速器 (ESC),支援 FOC 與多種控制模式。
PeterFWS/Structure-PLP-SLAM
一種利用點、線與平面實現高效稀疏建圖與定位的視覺 SLAM 系統,適用於單眼、RGB-D 與立體相機。
livekit/rust-sdks
LiveKit 的 Rust 客戶端 SDK,支援跨桌面與行動裝置平台的即時影音/數據流串流、房間管理以及硬體加速編碼。
cyberbotics/webots_ros2
該套件提供介面,透過使用 ROS2 訊息、服務和動作,在 Webots 3D 模擬器中模擬機器人。
vikashplus/robohive
一個統一的機器人學習框架,提供透過 OpenAI-Gym API 暴露的 MuJoCo 模擬環境與任務集合。
Firmament-Autopilot/FMT-Firmware
一種基於模型設計的高性能嵌入式自動駕駛系統,可實現快速控制系統開發與自動程式碼產生。
UM-ARM-Lab/pytorch_kinematics
用於 PyTorch 的並行且可微的機器人運動學庫,提供快速的正向運動學、逆運動學及 Jacobian 計算。
rsasaki0109/lidar_slam_ros2
一個將感測器資料包轉換為 Autoware 相容地圖套件(包含點群與自動產生的 lanelet2 檔案)的 ROS 2 LiDAR SLAM 系統。
snape/RVO2
一個 C++ 庫,實作了最優相互碰撞避讓(ORCA),讓數千個獨立的機器人或代理能在共享空間中無碰撞、無通訊地導航。
Phylliade/ikpy
支援 URDF 與 MuJoCo MJCF 匯入,並具備加速 JAX 後端的純 Python 逆運動學計算庫。
IDEA-CCNL/Fengshenbang-LM
一個開源的中文預訓練基礎模型生態系統,以及用於自然語言理解、生成和多模態任務的支援框架。
gokayfem/ComfyUI_VLM_nodes
面向視覺-語言模型的生產導向 ComfyUI 節點套件,提供結構化檢測、分割與自適應影片推理,並優化 VRAM 使用。
jim60105/docker-whisperX
一組為 WhisperX 優化的 Docker 映像,提供預打包的 ASR 模型,支援詞彙級時間戳,實現快速且高效的語音轉文字轉錄。
TalAter/annyang
一個輕量級的 JavaScript 函式庫,使用語音辨識技術使用戶能夠透過語音指令控制網站。
MatteoFasulo/Whisper-TikTok
一款利用 OpenAI-Whisper 和 Edge TTS 自動生成帶有自然語音旁白的字幕 TikTok 影片的 AI 工具。
wildminder/ComfyUI-VoxCPM
VoxCPM 的 ComfyUI 自定義節點集成。VoxCPM 是一個無需分詞器(tokenizer-free)的 TTS 系統,能夠實現富有表現力的語音生成、自然語言語音設計以及高級語音克隆。
thiswillbeyourgithub/AnkiAIUtils
一套由AI驅動的工具,可自動為Anki閃卡加入AI生成的圖像、記憶術與解釋,以提升學習效率。
microsoft/ai-dev-gallery
為 Windows 開發者提供的互動式 AI 範例庫,可探索本地 AI 模型並將其匯出為 C# Visual Studio 專案。
MochiDiffusion/MochiDiffusion
專為 Apple Silicon 設計的 macOS 原生應用程式,用於在本地執行 Stable Diffusion 與 FLUX.2 Klein,透過 Core ML 優化了高性能與低記憶體佔用。
1ay1/agentty
一個由 C++26 驅動的極速終端機編碼代理,使用本地 RAG 和多模型編排器,提供輕量級、與供應商無關的 Claude Code 替代方案。
Faceplugin-ltd/FaceRecognition-Android
適用於 Android 的在地設備人臉辨識與活體檢測 SDK,支援私密、離線生物辨識身分驗證與屬性分析。
yixuantt/MultiHop-RAG
一個 QA 資料集與基準測試工具,旨在評估 RAG 流程在跨多篇文件與中繼資料檢索與推理的能力。
aayoawoyemi/Ori-Mnemos
一個為 AI 代理設計的開源持久化記憶體基礎設施,利用 Markdown 檔案知識圖譜來實現認知遺忘與遞迴檢索。
Dana-Farber-AIOS/pathml
PathML 是一個開源的 Python 函式庫(亦提供 Docker 映像),可簡化全片病理工作流程:載入多種切片格式、執行可擴展的前處理(染色正規化、切片、GPU 轉換)、將資料轉換為 PyTorch 張量、建構細胞層級圖形,並執行深度學習或 ONNX 模型。它旨在降低 AI 驅動的計算病理門檻,已在多篇高影響力的生醫出版物中使用。
langchain-ai/langchain-google
Google 生成式 AI、Gemini API 與 Vertex AI 服務的 LangChain 結合的中央集合。
goat-sdk/goat
一個具備代理功能的金融工具套件,使 AI 代理能夠管理錢包、執行付款,並使用區塊鏈基礎設施執行投資策略。
aallan/vera
一種專為 LLM 寫作設計的程式語言,使用結構化參考取代變數名稱,並強制要求 SMT 證明契約以確保正確性。
MeetKai/functionary
Functionary is a language model specialized in interpreting and executing functions and plugins, supporting parallel tool calls and a built-in code interpreter.
meta-pytorch/torchx
TorchX 是一個適用於 PyTorch 應用程式的通用工作啟動器,可讓使用者在 Kubernetes、Slurm、Docker 與本機環境中啟動工作。
apocas/restai
一個 AI-as-a-Service 平台,可透過 REST API 與完整的管理儀表板來建立和部署 RAG 系統、agents 和推論端點。
stereolabs/zed-unity
一個 Unity 外掛程式,將 ZED 相機的深度感測、空間映射與物件偵測功能整合到 Unity 引擎,以支援 AR/MR 開發。
deepfates/memery
利用 OpenAI 的 CLIP 技術,透過文本或圖像查詢在本地資料夾中尋找特定圖像的自然語言圖像搜尋工具。
xavierpuigf/virtualhome
一個互動式的家庭活動模擬平台,允許研究人員透過 Python API 訓練具身 AI 代理人並產生合成影片資料。
nachifur/MulimgViewer
專為高效比較、過濾和拼接大規模圖像數據集而設計的多圖查看器,具有並行縮放和自動圖表生成功能。
GoogleCloudPlatform/genai-for-marketing
一個基於 Google Cloud 的解決方案,利用 Vertex AI 與 Google Workspace 整合,自動化行銷內容產生、趨勢分析與資料查詢。
unbody-io/unbody
Unbody 是一個為 AI 應用程式設計的開源後端基礎設施專案,旨在提供全面的數據管理與索引系統。