talesofai/neta-skills

為 Neta Art API 提供的 AI Agent 技能與 CLI 工具集,使 Agent 能夠生成多媒體、管理角色並執行互動故事冒險。

facebookresearch/tuna-2

Tuna-2 是一種統一的多模態模型,透過使用直接的像素嵌入取代複雜的視覺編碼器和 VAE,從而同時提升圖像理解與生成能力。

aimclub/FEDOT

FEDOT 是一個開源的 Python AutoML 框架,它使用進化演算法自動設計和優化機器學習流水線(包括預處理、特徵工程和模型)。它支援分類、回歸、分群和時間序列預測,集成了流行的 ML 函式庫,提供簡單的高階 API,並提供可復現的流水線匯出功能。

LucasAlegre/morl-baselines

MORL‑Baselines 是一個可靠的多目標強化學習演算法(單策略與多策略,SER/ESR)的 PyTorch 套件。它遵循 MO‑Gymnasium API,提供實用工具、自動 W&B 日誌記錄,並與 Open RL Benchmark 集成,支援可重現的實驗。

zrt-ai-lab/ViNote

一個 AI 驅動的工具,可將 YouTube、Bilibili 和本機檔案中的影片轉換為結構化筆記、心智圖和可搜尋的知識資產。

BlockRunAI/blockrun-mcp

BlockRun MCP 是一個開源 MCP 伺服器,為 AI 代理(Claude、Codex 等)提供 19 個即時工具——市場資料、網路搜尋、媒體生成、鏈上查詢,以及在 Polymarket 上進行真實 USDC 下注的能力。代理可透過自託管 USDC 錢包(透過 x402 微支付協定)或預付 API 金鑰按調用付費。伺服器透過單一 `npx` 命令安裝,相容多種 MCP 客戶端,並支援人工在環支出審核,是自主代理存取即時資料並執行真實操作的實用橋樑。

guochengqian/Magic123

一個透過結合 2D 與 3D 擴散先驗,在粗到細的流程中,從單張 2D 圖片生成高品質 3D 物件的系統。

pykale/pykale

基於 PyTorch 的多模態與遷移學習函式庫,提供標準化、管線式 API,打造永續且可重複使用的 AI 工作流程。

rockbenben/img-prompt

一款面向 AI 圖像與影片模型的視覺化、多語言提示建構工具,透過一個包含 5000 多個雙語標籤的精選標籤庫與預覽圖像,協助使用者組合高品質的英文提示。

huggingface/finetrainers

一個用於可及性訓練與微調擴散模型的函式庫,專注於記憶體高效的文字到影片與文字到影像生成。

laminlabs/lamindb

LaminDB 是一個開源、類 Git 的資料管理系統,專為 AI/ML 設計,尤其適用於多模態生命科學資料。它版本控制檔案、表格與陣列格式,追蹤程式碼與環境的來源,支援分支/合併,並以 ACID 安全的方式將元資料儲存在 SQLite/Postgres 中。整合 Python/R 工具(Polars、DuckDB)、生物本體與工作流程管理器,為研究與生技領域提供可追蹤、符合 FAIR 原則的資料集。

Woolverine94/biniou

一個自架設的 Web 界面,可在最低僅 8GB RAM 的硬體上本地執行多種生成式 AI 模型,支援文字、影像、音訊、影片與 3D 生成。

hoanganh8389/bizcity-twin-ai

Bizcity Twin AI 是一個開源 WordPress 插件,可將網站轉變為企業的統一 AI「大腦」。它標準化來自多個渠道的訊息,建立帶有來源的單一知識圖譜(KG),並透過托管控制平面(MCP)向 LLM(Claude、ChatGPT 等)公開資料。核心服務(身份、KG、推理、自動化、日誌、權限)不可變;開發者透過輕量級插件(act、channel、view)新增領域特定功能。專案提供 CLI 腳手架工具、診斷功能與即時示範,採用 GPL-2.0-or-later 授權釋出。

Minidoracat/mcp-feedback-enhanced

MCP Feedback Enhanced 是一個安全強化的 MCP 伺服器,為長時間 AI 任務添加基於 Web(可選 Tauri 桌面)的 UI,用於人類介入回饋。它可在本地、SSH 和 WSL 環境中運作,支援會話追蹤、影像、Markdown 和多語言 UI,是原始 interactive-feedback-mcp 專案的維護分支。

cyx2333hhh/talk-type

結合即時語音識別、本地Whisper回退與AI驅動文字清理的macOS語音輸入工具,實現跨應用的無縫雙語輸入。

Blacktrupersist/hailuo-ai-pulse

Hailuo AI Pulse 是 Windows 上的精簡 AI 工作空間,提供內容生成、支持分析和創意-自動化功能。

backblaze-labs/genblaze

一個用於編排生成式影片、音訊和圖像工作流程的 AI 管線 SDK,內建雜湊驗證的來源清單。

AvalancheAlbatross/midjourney-lab

Midjourney Lab 是一個支援文字、影像、音訊與影片多模態生成與處理的 Windows 基礎機器學習平台。

matterantmill/kling-ai-pulse

一個用於內容生成、分析與創意自動化的輕量級 Windows AI 工作空間。

v-modal/vmodal_sdk_android

一款用於為影片和影像庫新增多模態語意搜尋的 Android SDK,允許使用者透過含義查找特定時刻。

GangTailorUpgrade/undress-service

一個可自託管的 AI 時尚平台,能將您的衣櫥數位化,並利用生成式 AI 根據天氣、場合和風格推薦並視覺化穿搭。

ling-kong-ran/pisper

Pisper 是一款跨平台多代理聊天與工作流工具,讓您可以對 LLM 對話進行分支、並行化與自動化。基於開源的 Pi Coding Agent 開發,它提供桌面端、終端機與行動裝置客戶端、按需插件、安全的本地數據存儲,以及可選的 LAN/P2P 遠端連結。

AutoArk/TinyEngram

一個開放研究專案,探索基於 Engram 的記憶注入,用於 LLM 與 Stable Diffusion,以在不產生災難性遺忘的情況下實現參數高效的知識更新。

AutoArk/EVA-OS

一款針對即時多模態應用與智慧硬體的 AIOS,提供從 AI 原生編碼到設備端推論的整合開發體驗。

flatkey-ai/flatkey-cli

用於統一多模態 AI 生成的命令列介面,允許媒體團隊和 AI Agent 透過單一 API 金鑰和點數餘額生成圖像、影片、音訊和文本。

hezo-ai/hezo

Hezo是一個開源伺服器+Web UI,允許你在沙箱容器內建置和運行有組織的AI代理團隊(CEO、隊長、工程師、設計師等)。你提供自己的LLM提供者金鑰,設定令牌和容器小時預算,平台處理秘密保護、Git整合和統一「元框架」,規範化不同的模型執行階段。使用單一二進位檔案安裝,自架或使用Hezo Cloud,並透過組織圖風格UI管理專案。

dreamers-laboratory/image-to-3d-pipeline

一個將影像轉換為3D網格的流程,允許使用者執行並比較多個開源重構模型,以找到最佳輸出。

AkshitIreddy/Interactive-LLM-Powered-NPCs

一個系統,能為任何現有開放世界遊戲中的NPC加入動態、由LLM驅動的語音對話和同步臉部動畫,而無需修改遊戲的原始碼。

Hchen1218/heytea-style

透過提取視覺元素生成一致角色,將照片轉化為手繪海報與互動式桌面寵物的創意工具組

chflame163/ComfyUI_LayerStyle_Advance

一套用於高品質圖像標註、VLM 推理以及使用本地模型和外部 API 進行複雜圖像合成的進階 ComfyUI 節點集合。

dexhunter/seedance2-skill

一個與 Claude 相容的「技能」,提供編寫正確 Seedance 2.0 影片生成提示詞(字節跳動的多模態模型)的 Markdown 指南。透過將 Markdown 複製到 ~/.claude/skills 或使用 npx skills add 進行安裝。指南涵蓋了限制、參考語法、鏡頭語言、提示詞結構以及適用於廣告、戲劇、MV、教育等領域的模板,內容源自字節跳動官方文件。採用 MIT 授權。

11273/mooc-work-answer

一個跨平台 Python 工具,可自動完成中國 MOOC 服務(智慧職教、AI 优課、資源庫)中的學習進度追蹤、討論發帖及 AI 輔助作業提示。透過調用官方 API,並可選地調用 DeepSeek 生成參考答案(60–100% 相關性)。支援預建可執行檔或原始碼執行,內建安全延遲以模擬人類操作。

taruma/SceneFlow

一款專為 AI 電影創作者設計的腳本到螢幕同步工具,用於分析提示遵守度,並評估 AI 影片模型如何將劇本指示視覺化。

geometric-kernels/GeometricKernels

GeometricKernels 是一個 Python 函式庫,為非歐幾里得域(流形、圖、網格)提供熱核與 Matérn 核。它讓高斯過程模型能在這些空間上運行,並提供 TensorFlow (GPflow)、PyTorch (GPyTorch) 與 JAX (GPJax) 的轉接器。透過 `pip install geometric_kernels` 安裝並加入所需的後端即可使用。儲存庫包含豐富的筆記本、JMLR 論文引用以及清晰的貢獻流程。

JuliaDiff/ReverseDiff.jl

ReverseDiff.jl 是一個 Julia 庫,用於快速、基於磁帶的反向模式自動微分,可計算原生 Julia 程式碼的梯度、雅可比矩陣、海森矩陣與高階導數。它提供磁帶重用、非配置式線性代數最佳化、與 ForwardDiff 的混合模式相容性,是需要高效梯度計算的機器學習或科學計算專案理想的後端選擇。

mir-group/flare

FLARE(原子罕見事件的快速學習)是一個 Python 庫,使用稀疏高斯過程回歸與 ACE 類型描述子建構貝葉斯原子間力場。它提供不確定性感知分子動力學、即時主動學習以及 LAMMPS 對勢實作,使材料與罕見事件的快速、高精度模擬成為可能。

BINE022/EEGPT

EEGPT 是一個使用雙重自監督學習方法設計的預訓練 Transformer 模型,旨在克服低信號對雜訊比問題,實現通用 EEG 特徵提取。

IBM/materials

IBM/materials 是一套真正的開源大型基礎模型套件,專為化學與材料科學設計。它提供預訓練的單模態模型(SMILES、SELFIES、圖、3D結構)和多模態融合工具,均可透過統一的Python包裝器(FM4M‑Kit)或Hugging Face網頁UI存取。倉儲包含安裝說明、範例筆記本以及Hugging Face上託管模型的連結。

hankcs/HanLP

HanLP 是一個開源的多語言 NLP 工具包(提供 Python 核心以及 Java/Go 客戶端),為分詞、詞性標註、命名實體識別、句法分析、語義角色標註、AMR、摘要、情感分析、語言檢測等任務提供生產級預訓練模型。它提供兩種 API:輕量級 RESTful 服務(無需 GPU)以及基於 PyTorch/TensorFlow 的原生 Python 函式庫。模型涵蓋 130 種語言,並提供兼顧速度的多任務聯合模型與高精度的單任務模型。安裝方式僅需 `pip install hanlp`(原生)或 `pip install hanlp_restful`(REST)。該函式庫回傳一致的 JSON 輸出,並包含視覺化工具、自定義詞典支援及詳盡的文件。

Dooy/chatgpt-web-midjourney-proxy

一個將 ChatGPT 與 Midjourney 以及數十種生成式 AI 後端(圖像、影片、音樂、舞蹈、換臉)整合的網頁 UI。可透過 Docker、Vercel 或預先編譯的二進位檔案部署,並透過環境變數進行設定。支援語音輸入、GPT-4-vision 圖像上傳、即時聊天,以及用於切換模型端點的「GPT-Store」。

Relaxed-System-Lab/Flash-Sparse-Attention

Flash‑Sparse‑Attention (FSA) 是一個基於 Triton 的 PyTorch 模組,為 Native Sparse Attention 提供了優化版本。透過重新排序迴圈並將工作拆分為三個專用核心,它減少了記憶體流量並消除了原子加法,在現代 NVIDIA GPU 上對長序列 LLM 的訓練和推理速度提升了 2‑3 倍。它適用於 PyTorch ≥ 2.4、transformers ≥ 4.45,並在 Ampere/Hopper 硬體上支援 fp16/bf16。

fcakyon/phd-skills

一個零依賴的 Claude Code 外掛程式,為機器學習研究人員添加研究防護機制、自動觸發技能和背景代理,幫助避免在論文重現、實驗除錯和訓練啟動過程中因錯誤設定、未經驗證的主張或破壞性命令所導致的高成本 AI 助手錯誤。

jmiao24/Paper2Agent

Paper2Agent 是一個多代理 Python 系統,可自動將研究論文(及其程式碼)轉換為可執行的 MCP 伺服器,將論文的方法公開為 AI 可呼叫的工具。使用者將「paper2agent」技能安裝到程式設計助手(Claude Code、Codex、Gemini CLI)中,然後提示助手將論文 URL「代理化」。該系統會生成專業子代理來解析論文、建立隔離環境、封裝原始程式碼、執行驗證測試,並將所有內容打包成包含使用說明的 ZIP 檔案。產生的伺服器可在本地執行或託管於 Hugging Face,隨後可連接回程式設計助手進行互動式科學查詢。

huggingface/meshgen

一個使用 AI 代理實現自然語言控制 3D 建模的 Blender 插件,支援本地與遠端 LLM 後端。

marcellodebernardi/loss-landscapes

`loss‑landscapes` 是一個基於 PyTorch 的庫,可在模型參數空間的低維切片上採樣標量指標(損失、梯度範數、曲率、預期回報等),便於輕鬆建立損失面可視化圖。它提供靈活的 `Metric` 抽象、子空間生成器(直線、平面等),以及 `ModelWrapper` 以支援標準模型與強化學習智能體。原始 2019 年版本已損壞,正在重寫中,因此 API 可能會變更。

20000419/fauxnix

fauxnix是基於npm的工具,可將精選的bash命令子集翻譯為PowerShell,讓LLM代理無需虛擬機即可在Windows上執行熟悉的Linux風格命令。它提供決定性翻譯、MCP伺服器整合、批次執行與廣泛測試,旨在提升Windows環境中AI驅動程式碼助手的可靠性。

Aperivue/medsci-skills

MedSci Skills 是一個開源集合,包含 59 個 AI 代理「技能」,可自動化完整的臨床研究流程——包括文獻搜尋、研究設計、數據清理、統計分析、論文撰寫、合規性檢查,以及針對 AI 研究的可重現模型架構與驗證。它專為 Claude Code、Copilot、Cursor 等工具設計,可透過 npx、GitHub CLI 或 Claude 插件安裝,並提供端到端的演示(如診斷準確性、統合分析、流行病學、CNN 分割、外部驗證),能輸出論文、圖表及符合指南的審計報告。

mcneel/RhinoAI

一個MCP伺服器,讓AI代理能直接在Rhino中建立和編輯3D幾何