mishushakov/llm-scraper
LLM Scraper 是一個 TypeScript 函式庫,它允許你使用大語言模型從任何網頁中提取結構化數據。它將瀏覽器自動化與基於 Schema 的提示相結合,將原始 Web 內容轉換為有序的 JSON,支援多種 LLM 提供商和串流輸出。
tile-ai/TileRT
一個基於瓦片的即時執行引擎,用於超低延遲的 LLM 推理,最小化 NVIDIA B200 GPU 上大型模型的每個輸出 token 的時間。
facebookresearch/AugLy
一個提供超過 100 種轉換的多模態資料增強套件,適用於音訊、影像、文字與影片,以提升 AI 模型對真實世界網路資料的韌性。
toki-plus/video-mover
一個從檔案監控、AI生成字幕到多平台瀏覽器自動化上傳的全自動影片分發流程。
NVIDIA-NeMo/Megatron-Bridge
一個 PyTorch 原生的函式庫,支援在 Hugging Face 與 NVIDIA Megatron Core 之間雙向檢查點轉換與高效能訓練。
plasma-ai/fractal
fractal 是一個 Python 庫/CLI,透過建立一個由獨立 LLM 代理循環組成的樹狀結構,每個循環在各自的 Git worktree 和 tmux 會話中執行。節點可產生子節點,實現遞迴自我組織以解決複雜任務。系統使用 SQLite 追蹤執行記錄,提供終端 UI 仪表板,並支援多種 LLM 後端(Claude、Codex、Grok、OpenCode、Oh My Pi)。安全警告指出,代理預設無權限提示執行,因此應僅在可信或沙箱主機上使用。
ucam-eo/tessera
TESSERA 是一個開源地理空間基礎模型,可將受雲層干擾的衛星時序數據轉換為用於全球地球表示和分析的緊湊型 128 維嵌入。
vllm-project/vime
Vime 是一個用於大型語言模型(LLM)的開源 RL 後訓練框架。它結合了 slime/Megatron 分佈式訓練棧與 vLLM 推論,透過 vllm-router 提供高吞吐量的 rollout 過程,並提供靈活的數據生成管道。支援的模型包括 Qwen、DeepSeek V3 和 LLaMA 3。使用者可以透過配置 Megatron、vLLM 和 router 參數來執行 agentic RL、coding-agent RL 或自定義 RL 演算法。該儲存庫提供快速入門文件、多個現成的範例,以及為開發者提供的清晰的程式碼閱讀路徑。
joey-zhou/xiaozhi-esp32-server-java
一個針對 ESP32 智慧硬體的企業級 Java 後端與管理平台,提供即時 AI 語音互動、RAG 與 IoT 裝置管理。
huggingface/xet-core
一個用於 Hugging Face Hub 的儲存系統,透過基於區塊的去重機制,高效地上傳與下載大型 AI 模型與資料集。
finnvoor/yap
使用 Apple 的 Speech.framework 在 macOS 上對檔案、即時系統音訊與麥克風輸入進行裝置端語音轉錄的 CLI 工具。
lquesada/ComfyUI-Inpaint-CropAndStitch
一個 ComfyUI 擴充,透過裁切遮罩區域、在目標解析度下處理並無縫縫合回原始影像,實現修復最佳化。
linuxhsj/openclaw-zero-token
一個網關,透過自動化瀏覽器登入並驅動官方 Web 界面,而非使用付費 API 令牌,實現對多個高階 LLM 的免費存取。
deepinv/deepinv
DeepInverse 是一個基於 PyTorch 的開源函式庫,旨在透過算子與演算法的模組化框架,利用深度學習解決成像逆問題。
unit8co/darts
一個用於使用者友善的時間序列預測與異常檢測的 Python 函式庫,提供統一的 API,支援從傳統統計方法到深度神經網路的各種模型。
JungHoonGhae/tossinvest-cli
一個 CLI 與 MCP 伺服器,連接 AI 代理與使用者至 Toss Securities,提供完整的官方 API 覆蓋,以及 58 項額外的內部網頁功能,用於交易與分析。
jjang-ai/vmlx
一個自託管的 Apple Silicon 推理伺服器,提供相容 OpenAI、Anthropic 與 Ollama 的 API,讓本機執行 LLM、VLM 與影像生成模型。
sybil-solutions/local-studio
Local Studio 是一個開源的 macOS/桌面應用,可讓您執行、管理並與自托管的 LLM 後端(vLLM、SGLang、llama.cpp、MLX)聊天互動。它結合了 Bun + Hono 控制器(模型生命週期、OpenAI 相容代理、GPU 指標)與 Next.js/Electron UI 及整合的 Pi 程式碼代理。UI 可在本地運行,也可指向遠端控制器,配套行動應用(KittyLitter)可重複使用相同會話。倉儲提供完整的開發環境設定指令碼、生產建構說明與 CI 驅動的發布流程。
superagent-ai/superagent
一個開源的 AI 代理安全 SDK,可阻止提示注入、刪除敏感資料,並掃描倉儲中針對 AI 的威脅。
overcuriousity/pdf2epub
使用智慧版面偵測與 AI 驅動的文字提取,將 PDF 檔案轉換為結構化 Markdown 與 EPUB 格式的工具。
caidaoli/ccLoad
一個為 Claude Code、Codex、Gemini 和 OpenAI 等上游提供智能路由、自動故障轉移和成本控制的 AI API 網關。
owainlewis/blueprint
一套可攜式的技能檔案集合,引導 AI 程式碼代理遵循專業的軟體工程實務,如設計、規劃與審查。
ROCm/rocm-libraries
一個整合的超倉儲,用於簡化多個 GPU 加速數學與運算函式庫的開發、CI 和整合。
cbcoutinho/nextcloud-mcp-server
一個可投入生產環境的 MCP server,可將 AI 助手連接至 Nextcloud,讓 LLM 透過自然語言對筆記、行事曆和檔案進行 CRUD 操作。
koreainvestment/open-trading-api
一套完整的韓國投資證券 Open API 範例程式庫與工具集,包含針對大型語言模型優化的程式碼片段、視覺化策略建構器以及回測引擎。
jacklandrin/OnlySwitch
一款 macOS 選單列實用工具,將系統開關和日常任務整合到一個單一的開關樞紐中,具備 AI 驅動的自然語言控制和自訂腳本功能。
homelab-00/TranscriptionSuite
一款免費開源的轉錄應用,使用多種 AI 模型在本地電腦上將語音轉換為文字,兼顧隱私與速度。
tdrussell/diffusion-pipe
一個允許在多個 GPU 上訓練大規模圖像與影片擴散模型的流水線並行訓練腳本。
grobidOrg/grobid
一個機器學習函式庫,將原始 PDF 科學出版物解析為結構化的 XML/TEI 文件,以進行大規模書目資料擷取。
google/adk-java
一個以程式碼為首的 Java 工具包,用於建構、評估與部署 AI 代理,具備彈性編排能力,並與 Google Cloud 服務深度整合。
TheR1D/shell_gpt
一個命令列生產力工具,使用大型語言模型(LLM)直接在終端機中產生 shell 指令、程式碼片段與文件說明。
bbycroft/llm-viz
一個用於顯示 GPT 風格大語言模型網路拓撲和推理過程的 3D 互動式視覺化工具。
shepherd-agents/shepherd
面向 AI 代理的執行時期基礎,提供安全沙箱、可逆執行軌跡以及所有檔案系統變更的審查和核准工作流程。
mobile-next/mobilewright
一個適用於 iOS 和 Android 的行動裝置自動化框架,將 Playwright 的 API 與開發者體驗帶入行動應用程式,專門針對 E2E 測試與 AI 代理控制進行了最佳化。
anthropics/claude-code-base-action
一個將 Claude Code 集成至 CI/CD 工作流程的 GitHub Action,支援自動化智能體編碼任務,如 PR 審查與相依性更新。
google-gemini/gemini-live-api-examples
Gemini Live API 的範例集合,使開發者能利用多模態輸入建構低延遲、即時的語音與影片 AI 代理。
WordPress/ai
一個實驗性 WordPress 外掛,提供模組化框架,將 AI 驅動的內容創建、審核和 SEO 工具直接整合到區塊編輯器中。
thu-ml/Causal-Forcing
使用因果 ODE 或因果一致性蒸餾的高品質即時互動式影片生成框架,支援高效少步自回歸擴散
cellebrite-labs/ghidra-rpc
一種讓 LLM 透過基於 JSON 的 CLI 和背景守護程序存取 Ghidra 的代理技能,使 AI 能自主執行逆向工程任務。
Vchitect/VBench
VBench 是一個開源基準測試套件,能自動從數十個品質維度(技術、美學、可信度)評估影片生成模型。它包含提示詞集合、指標管道、符合人體感知的評估分數,以及針對 T2V、I2V、長影片和內在忠實度評估的公開排行榜。
open-gigaai/giga-brain-0
GigaBrain‑0.7 是一個開源、大規模的機器人視覺-語言-動作模型。它在 37,000 小時的異質具身資料上進行預訓練,支援 8 種機器人形態,並附帶訓練腳本、基準測試套件(VLM‑Benchmark、RoboColiseum、RoboTwin 2.0、EBench)以及可與 ROS 集成的即用型推理伺服器。
XiaoLuoLYG/GOD
一個允許使用者即時觀察、暫停與干預 AI 代理模擬的語言代理社會控制室框架。
SIGRobotics-UIUC/LeKiwi
LeKiwi 是一款具備全向驅動與整合機械臂的低成本移動操作臂,旨在為機器人研究與資料收集提供可存取的解決方案。
microsoft/work-iq
一個將 GitHub Copilot 等 AI 助手連接到 Microsoft 365 資料的插件市場與 MCP 伺服器集合,支援使用自然語言查詢郵件、會議與文件。
LilMGenius/paperthin
一組供 AI 代理使用的低層級代理設計模式和技能,優先考慮減法和精煉,以防止 AI 生成的膨脹和儲存庫腐化。
planetscale/database-skills
一套面向 AI 編碼助手的資料庫聚焦技能,提供 MySQL、Postgres、Neki 與 Vitess 的專家級指導。
tracefinity/tracefinity
一款利用 AI 驅動的輪廓追蹤與比例校準技術,從工具照片生成客製化 Gridfinity 3D 列印儲存箱的工具。
coollabsio/jean
一個原生桌面 AI 助手,提供統一介面以管理多個 AI CLI 工具、git worktrees 和專案會話,避免廠商鎖定。