Gemini-API: 一個針對 Google Gemini 網頁版應用程式的逆向工程非同步 Python 封裝庫
一個針對 Google Gemini 網頁版應用程式的逆向工程非同步 Python 封裝庫,可程式化地存取圖片生成、深度研究與自定義 Gems 等功能。
hallucination-leaderboard: 一個追蹤 LLM 在摘要任務中幻覺率的公開排行榜
一個使用 Vectara 的 Hallucination Evaluation Model (HHEM) 來衡量並比較不同 LLMs 在摘要文件時產生幻覺頻率的公開排行榜。
semantic-router: 一個使用語義向量空間進行路由,為 LLMs 和 agents 提供超快速決策層的工具
一個為 LLMs 和 agents 提供高速決策層的工具,利用語義向量空間根據意義而非緩慢的 LLM 生成來路由請求。
Decepticon:在硬化沙箱中執行專業攻擊鏈與殺戮鏈的自主紅隊代理
一個在硬化沙箱中執行真實且專業的攻擊鏈與殺戮鏈的自主紅隊代理,用於自動化安全測試與防禦驗證。
transformer-explainer: 一個用於學習 GPT-2 內部運作機制的互動式瀏覽器視覺化工具
一個在瀏覽器中執行即時 GPT-2 模型的互動式視覺化工具,旨在幫助使用者學習基於 Transformer 的模型如何預測文字。
ChatGPT-Shortcut: 一個用於提升多平台 AI 輸出品質的精選提示詞庫與管理工具
一個 AI 提示詞管理工具,提供超過 5,000 個精選提示詞的庫,以及用於在各種 AI 平台中整理、建立和分享自定義提示詞的工具。
morphic: 一個具備生成式 UI 的 AI 搜尋引擎,能從串流 JSON 渲染豐富的內嵌組件
一款由 AI 驅動的搜尋引擎,使用生成式 UI 來渲染豐富且附帶引用來源的答案,並以互動式組件取代純文字。
krita-ai-diffusion: 一款為 Krita 開發的生成式 AI 外掛程式,整合了擴散模型以實現精確的圖像編輯與繪畫
一款將生成式 AI 擴散模型整合到繪畫工作流程中的 Krita 外掛程式,提供局部重繪、即時繪畫以及精確的結構控制工具。
outlines: 一個透過類型約束生成來保證 LLM 結構化輸出的函式庫
一個透過將生成過程約束為符合特定 Python 類型或 Pydantic models 以來保證 LLM 結構化輸出的函式庫。
Open-Generative-AI:一個具備本地推論與多模型支援、不受限制的 AI 影片平台開源替代方案
一個開源且不受限制的 AI 工作室,可使用 200 多種模型生成圖像與影片,具備本地推論選項與視覺化工作流構建器。
openui: 一個開源的 AI 驅動 UI 生成器,可將即時描述渲染為框架就緒的程式碼
一個開源工具,讓您能以自然語言描述 UI 元件並即時查看渲染結果,並具備將其轉換為 React、Svelte 或 Web Components 的能力。
TurboDiffusion:一個將擴散延遲降低 100-200 倍的影片生成加速框架
TurboDiffusion 是一個影片生成加速框架,透過注意力優化與時間步蒸餾,在單一 GPU 上將擴散生成速度提升 100-200 倍。
MAGI-1:一種用於可擴展高保真影片生成且具備強大物理準確性的自回歸世界模型
MAGI-1 是一種自回歸影片生成模型,透過分塊生成高保真影片,以確保時間一致性和物理準確性。
ComfyUI-LTXVideo:用於進階 LTX-2 影片生成與音訊合成的自訂 ComfyUI 節點
一套自訂的 ComfyUI 節點與工作流程,為 LTX-2 影片生成模型加入 HDR 輸出、口型同步與生成式升級等功能。
transformerlab-app:一個開源機器學習平台,統一 AI 研究工具與叢集編排
一個開源機器學習平台,將訓練、微調、推論與評估統合於單一介面,適用於個人與研究實驗室。
maestro: 一款加速多模態視覺語言模型微調的精簡工具
一款用於加速 Florence-2、PaliGemma 2 和 Qwen2.5-VL 等多模態視覺語言模型微調的精簡工具。
SimpleTuner: 一個用於微調多模態生成式模型並具備企業級編排功能的統一訓練框架
一個用於微調圖像、影片和音訊生成式模型的全面訓練框架,支援廣泛的架構,並專注於簡單易用與記憶體效率。
OneTrainer: 一款用於訓練與微調各種擴散模型的全方位解決方案
一套全面的擴散模型訓練套件,透過 GUI 或 CLI 提供數據集準備、微調與模型轉換的工具。
OpenDeepWiki: 一個由 AI 驅動的儲存庫知識庫,可從程式碼庫生成結構化文件、聊天介面和 MCP 端點
一個由 AI 驅動的知識庫生成器,可將 Git 儲存庫和本地目錄轉換為結構化文件、可搜尋的聊天介面和 MCP 端點。
MetaClaw:一個讓 AI 助手能透過真實對話進行元學習與演化的代理程式
一種代理程式,透過技能注入與非同步 RL 微調,讓 AI 助手能透過真實對話進行元學習與演化。
Kiln: 一個用於提示詞優化、評估與代理編排的本地優先 AI 開發工作台
一個用於提示詞優化、評估、RAG 和微調的本地優先 AI 開發工作台,為團隊提供單一的工作流程。
h2o-llmstudio:一個無需編碼的 GUI 與框架,用於微調大型語言模型,支援記憶體效能訓練
一個無需編碼的 GUI 與框架,用於微調大型語言模型,支援 LoRA 等記憶體效能技術以及 DPO 等進階最佳化方法。
CosyVoice: 一款基於大型語言模型的可擴展多語言零樣本文字轉語音合成器
一個基於 LLM 的文字轉語音系統,用於實現具有高說話者相似度與低延遲串流的零樣本多語言語音合成。
any-llm:使用官方 SDK 直接存取任意 LLM 供應商的統一 API(無需 Proxy)
一個統一的 Python SDK,提供單一介面存取多家 LLM 供應商(如 OpenAI、Anthropic、Mistral),無需更改程式碼。
dstack: 一個用於跨多雲與地端集群進行 GPU 配置與編排的統一控制平面
一個用於 GPU 配置與編排的統一控制平面,可簡化任何 GPU 雲端、Kubernetes 或地端集群上的開發、訓練與推論流程。
XNNPACK:提供跨平台推論優化神經網路基元的低階加速函式庫
XNNPACK 是一套高度優化的低階效能基元函式庫,用於在 ARM、x86、WebAssembly 與 RISC‑V 平台上加速神經網路推論。
optimum: 一個用於在各種 AI 加速器上最大化訓練與推理效率的硬體優化工具包
Hugging Face 生態系統的擴展,提供優化工具,以便在目標硬體加速器上以最高效率訓練與執行 AI 模型。
zml: 一個將 AI 工作負載與專有硬體解耦的生產級推論堆疊
一個將 AI 工作負載與專有硬體解耦的生產級推論堆疊,允許使用單一程式碼庫在 NVIDIA、AMD、Intel 以及 TPU/Trainium 加速器上執行模型。
FastDeploy: 一款具備 PD 分離與廣泛硬體加速功能的生產級 LLM 與 VLM 部署工具包
一款基於 PaddlePaddle 的 LLM 與 VLM 生產級部署工具包,提供高效能推理與廣泛的硬體相容性。
csghub: 一個類似 Hugging Face 的私有地端 LLM 資產管理平台
一個開源、地端的 Hugging Face 替代方案,用於管理、儲存和分發 LLM 資產、數據集和代碼。
typedb:一個以強類型統一關聯式、文件式與圖形模型,並具備宣告式查詢語言的資料庫
TypeDB 是下一代資料庫,將關聯式、文件式與圖形模型統一於單一強類型系統,簡化複雜且相互關聯資料的管理。
open_model_zoo: 一個用於高效能推論的優化預訓練深度學習模型與工具集合
一個用於加速高效能推論應用程式開發與部署的優化預訓練深度學習模型與工具集合。
CTranslate2: 針對 Transformer 模型的高性能推理引擎,具備先進的量化與硬體優化功能
一個用於高效 Transformer 模型推理的 C++ 和 Python 函式庫,利用量化與自定義運行時在 CPU 和 GPU 上加速執行並減少記憶體使用量。
whichllm:一個具備硬體感知能力推薦引擎,根據系統規格與真實世界基準測試為最佳在地 LLM 進行排名
一款具備硬體感知能力的 LLM 推薦工具,根據您的特定 GPU/CPU/RAM 與真實世界的基準測試效能,為最佳的 HuggingFace 模型進行排名。
argmax-oss-swift:為 Apple 平台提供語音轉文字、文字轉語音與說話者分離的裝置端音訊推論框架
一套基於 Core ML 的 Apple 平台裝置端推論框架,提供語音轉文字、文字轉語音與說話者分離功能。
TensorRT: 一個用於在 NVIDIA GPU 上加速 AI 模型的超高性能推理優化器與運行時
一個 AI 推理優化器與運行時,可在 NVIDIA GPU 上加速各種模態的深度學習模型執行。
ncnn: 針對行動、嵌入式與桌面部署優化的高效能神經網路推論框架
一個針對行動、嵌入式與桌面部署優化、且無第三方執行時依賴的高效能神經網路推論框架。
ColossalAI: 一個用於高效大規模模型訓練與推理的分佈式深度學習框架
一個透過先進的並行技術與記憶體管理,讓大型 AI 模型的訓練與推理變得更快且更便宜的分佈式深度學習框架。
keras-tcn: 一個用於 Keras 的 Temporal Convolutional Network 層,用於在序列建模中取代 LSTMs 和 GRUs
一個 Keras 的 Temporal Convolutional Networks (TCN) 實作,為長序列建模提供了一個比 LSTMs 和 GRUs 更穩定且更具平行化能力的替代方案。
pykeen: 一個用於訓練與評估知識圖譜嵌入模型的 Python 框架
一個用於訓練與評估知識圖譜嵌入模型的 Python 套件,具備豐富的內建資料集與模型。
PyPOTS: 一個用於分析含有缺失值的多元時間序列的機器學習工具箱
一個用於部分觀測時間序列機器學習的 Python 工具箱,為含有缺失值的數據提供填補、預測與異常檢測的統一 API。
diffrax:基於 JAX 的自動微分與 GPU 支援數值微分方程求解器庫
一個基於 JAX 的數值微分方程求解器庫,具備自動微分與 GPU 支援,支援 ODE、SDE 與 CDE。
SimpleHTR:一個將單字與文本行圖像轉換為數位文字的手寫文字辨識系統
一個基於 TensorFlow 的手寫文字辨識系統,利用 CNN 與 LSTM 層將單字或文本行的圖像轉換為數位文字。
xlstm: 一種擴展 LSTM 以在語言建模中與 Transformers 競爭的遞歸神經網絡架構
一種新的遞歸神經網絡架構,擴展了 LSTM 以與 Transformers 和 State Space Models 競爭,其特點是具有一個用於高效推理的 7B 參數語言模型。
GeneticAlgorithmPython: 一個用於優化機器學習模型與複雜函數的直觀遺傳演算法函式庫
一個用於建立遺傳演算法以優化數學函數與機器學習模型的 Python 函式庫,並原生支援 Keras 與 PyTorch。
raster-vision: 一個用於在衛星與航空影像上建立 ML 模型之地理空間電腦視覺框架
一個使用 PyTorch 在衛星、航空與無人機影像上建立電腦視覺模型的 Python 函式庫與低程式碼框架。
audiomentations:一個快速且易於使用的深度學習音訊資料增強函式庫
一個 Python 音訊資料增強函式庫,提供多樣化的轉換,使音訊深度學習模型在實際應用中更具魯棒性。
torchio: 一個基於 PyTorch 的工具包,用於預處理和增強具有領域特定偽影的 3D 醫學影像
一個用於 PyTorch 的 Python 函式庫,提供高效載入、預處理和增強 3D 醫學影像的工具。
synthetic-data-generator: 一個支援 GANs、LLMs 與十億級數據集的隱私保護表格數據生成器
一個專門用於使用統計模型、GANs 與 LLMs 生成高品質、隱私保護的合成表格數據的專業框架。
torchmetrics: 一個用於分散式訓練與評估的可擴展 PyTorch 指標函式庫
包含超過 100 種 PyTorch 指標實作的集合,可自動化分散式裝置間的累積與同步,以減少機器學習流程中的樣板程式碼。