Hugging Face Accelerate:使用 PyTorch 執行大型模型
Hugging Face Accelerate 透過利用 PyTorch 的 meta 裝置與分片檢查點,管理 GPU、CPU 記憶體與磁碟的記憶體使用,使得在消費者硬體上也能執行巨量 AI 模型。
SetFit:高效的少樣本學習(無提示)
Hugging Face 推出 SetFit,一個無提示的少樣本微調 Sentence Transformers 框架,能在極少標註資料下達到高準確率。
Hugging Face 倫理與社會電子報 #1
Hugging Face 推出其倫理與社會電子報,並概述了一種透過協作、透明與負責任的價值驅動方式,去分散化地落實 AI 倫理。
極速 BLOOM 推理:DeepSpeed 與 Accelerate
Hugging Face 展示了在 8×80 GB A100 GPU 上,使用 DeepSpeed‑Inference 張量並行和 Accelerate 流水線並行,對 176B 參數的 BLOOM 模型實現每個 token 低於毫秒的生成速度。
Diffusers 0.3 版加入影像到影像、文字反轉、修補、GPU 最佳化、Mac MPS、ONNX 支援與新文件
Hugging Face 宣布 Diffusers 0.3 版,推出影像到影像、文字反轉、實驗性修補、較小 GPU 最佳化、Mac MPS 支援、ONNX 匯出器、擴充文件,以及一波社群專案。
離線強化學習的決策變換器訓練
Hugging Face 提供了一份指南與實作,說明如何從頭開始訓練離線 Decision Transformer,以解決 HalfCheetah 環境,並使用 transformers 的 Trainer 以及自訂的資料整理器。
使用 Megatron-LM 訓練語言模型
Hugging Face 提供了一份指南,說明如何使用 NVIDIA 的 Megatron-LM 框架在 GPU 上高效預訓練大型語言模型,並整合 Transformers 套件。
OpenRAIL:邁向開放且負責任的 AI 授權框架
Hugging Face 宣佈了 OpenRAIL,一套結合開放存取與使用限制的 AI 專屬授權,旨在促進機器學習模型的負責任部署。
在 Hugging Face Spaces 上視覺化蛋白質
Hugging Face 提供了一份指南,說明如何透過 Gradio 將 3Dmol.js 整合至 Hugging Face Spaces,以在瀏覽器中實現 3D 蛋白質結構的視覺化。
使用 Hugging Face Transformers 與 Habana Gaudi 進行 BERT 預訓練
Hugging Face 示範了如何在 AWS 上使用 Habana Gaudi DL1 實例從頭預訓練 BERT-base,較基於 NVIDIA V100 GPU 的訓練可降低 25% 成本。
使用 Diffusers 的 Stable Diffusion
Hugging Face 公布了如何使用 Diffusers 套件執行文字生成影像的 Stable Diffusion 模型,提供了程式碼、授權細節以及模型潛在擴散架構的說明。
在 Vertex AI 上部署 Hugging Face ViT
Hugging Face 示範如何在 Google Cloud 的 Vertex AI 平台上部署 Vision Transformer(ViT)模型,以實現 Kubernetes 級別的可擴展性,同時大幅減少程式碼量。
Vision Transformers 在 Hugging Face Optimum Graphcore 上
Hugging Face 與 Graphcore 透過 Optimum 函式庫,使在智慧處理單元(IPU)上高效微調 Vision Transformer(ViT)模型成為可能,並以多標籤胸部 X 光分類任務示範其效能。
Hugging Face 將 LLM.int8() 8 位矩陣乘法整合至 Transformers 與 Accelerate
Hugging Face 發佈了將 LLM.int8() 8 位量化技術整合至 Transformers 與 Accelerate 函式庫的功能,使得在不降低效能的情況下,對極大型語言模型進行推論,並可節省高達 2 倍的記憶體用量。
Hugging Face 的 TensorFlow 哲學
Hugging Face 概述了其對 TensorFlow 整合的技術方法,強調與 Keras 及 XLA 的深度對齊,以優化 transformer 模型的效能與部署。
Skops 函式庫讓 scikit-learn 模型在 Hugging Face Hub 上託管、文件化與協作
Hugging Face 宣佈了 Skops,一個讓使用者能打包、文件化並將 scikit-learn 模型推送至 Hub,且自動生成模型卡與推論小工具的函式庫。
在 Kubernetes 上使用 TF Serving 部署 Hugging Face ViT
Hugging Face 提供了一份技術指南,說明如何使用 Docker 與 Kubernetes 搭配 TensorFlow Serving 來擴展 Vision Transformer(ViT)部署,以實現生產等級的自動擴縮與資源管理。
Hugging Face Sentence Transformers 訓練指南(歷史參考)
Hugging Face 公布了一篇過時的教學,說明如何訓練與微調 Sentence Transformers 模型,涵蓋模型架構、資料集格式、損失函式以及模型上傳方式,同時引導使用者使用較新的訓練 API。
Hugging Face 深度強化學習課程第 8 單元:近端策略優化(PPO)說明
Hugging Face 提供了 Proximal Policy Optimization(PPO)的詳細步驟說明,展示了透過裁剪策略更新比例如何穩定訓練,並提供了從頭實作的 PyTorch 範例,已在 CartPole‑v1 與 LunarLander‑v2 上測試。
Hugging Face 私有 Hub 介紹
Hugging Face 推出了 Private Hub(現已更名為 Enterprise Hub),這是一個安全且符合規範的環境,讓公司能夠使用統一的工具集協作機器學習模型、資料集與 Spaces。
Nyströmformer:透過 Nyström 方法在線性時間與記憶體中近似自注意力
Nyströmformer 透過使用 Nyström 方法以抽樣的 landmarks 近似 softmax 矩陣,將標準自注意力的時間與記憶體複雜度從 O(n^2) 降低至 O(n)。
Hugging Face 對美國國家 AI 研究資源的建議
Hugging Face 向白宮與國家科學基金會提交回應,主張國家 AI 研究資源(NAIRR)應優先考慮倫理專業知識、標準化文件化以及可取得的工具,以實現 AI 研究的民主化。
Hugging Face Datasets 音訊與視覺文件更新
Hugging Face 已擴充 🤗 Datasets 函式庫的文件,加入針對音訊與視覺資料集的專屬指南與工具,簡化多模態資料的載入與處理流程。
使用 TensorFlow 與 XLA 加速文字生成
Hugging Face 已在使用 TensorFlow 的 transformers 套件中啟用 XLA 編譯以加速文字生成,實現最高可達 100 倍的加速,且效能常常超過 PyTorch。
在 Hugging Face 使用 TF Serving 部署 TensorFlow 視覺模型
Hugging Face 提供了一份指南,說明如何使用 TensorFlow Serving 部署 TensorFlow 視覺模型(例如 Vision Transformer(ViT)),並將其以 REST 或 gRPC 端點公開。
Advantage Actor Critic(A2C)說明
Hugging Face 解釋了 Advantage Actor Critic(A2C),這是一種混合式強化學習架構,透過結合基於策略的方法與基於價值的方法來降低策略梯度估計的變異性。
動態對抗資料收集(DADC)於 MNIST – Hugging Face 教學
Hugging Face 宣布了一個關於 MNIST 上動態對抗資料收集(DADC)的逐步教學,說明如何收集由人類產生的對抗樣本並重新訓練模型以提升韌性。
BLOOM 176B 訓練技術概覽
Hugging Face 發布了關於 1760 億參數 BLOOM 模型如何使用 384 顆 A100 GPU、Megatron‑DeepSpeed 3D 並行以及 BF16 混合精度進行訓練的詳細說明,重點說明了硬體、軟體堆疊與工程挑戰。
使用句子轉換模型構建播放清單生成器
Hugging Face 示範如何使用 Sentence Transformers 進行歌詞嵌入的語意搜尋,並以 Gradio Blocks 建立使用者介面,打造語意搜尋式的播放清單生成器。
BLOOM:全球最大開放多語言語言模型
Hugging Face 與 BigScience 計畫已發布 BLOOM,這是一個擁有 1760 億參數的開放存取多語言語言模型,於 46 種自然語言與 13 種程式語言上以完全透明的方式進行訓練。
開始使用 Twitter 情感分析
Hugging Face 提供了一份指南,說明如何使用 Inference API 對 Twitter 資料執行自動化情感分析,適用於開發者與非程式開發者。
使用 PyTorch 的策略梯度 – Hugging Face 深度強化學習課程 第 5 單元
Hugging Face 發布了一個教學,從頭開始在 PyTorch 中實作 REINFORCE 蒙特卡羅策略梯度演算法,並在 CartPole‑v1、PixelCopter 與 Pong 上進行評估。
使用 Sentence Transformers 開始機器學習之旅
Hugging Face 提供了一份指南,幫助初學者使用 Sentence Transformers 套件開始他們的第一個機器學習專案,透過建立嵌入向量並執行語意搜尋。
Hugging Face 在 Hub 上的評估
Hugging Face 推出了 Evaluation on the Hub,這是一個由 AutoTrain 提供動力的無程式碼工具,讓使用者能直接在 Hugging Face Hub 上使用任何指標對任何模型在任何資料集上進行評估。
使用 DeepSpeed 加速大型模型訓練
Hugging Face 示範如何使用 Accelerate 函式庫整合 DeepSpeed 的 ZeRO 優化,使得可以使用更大的批次大小,並訓練原本會超出 GPU 記憶體的模型。
開始使用嵌入 – Hugging Face 教程
Hugging Face 宣布了一份逐步指南,說明如何使用 Sentence‑Transformers 函式庫與 Hugging Face Hub 建立、託管與查詢向量嵌入,展示可搜尋的 FAQ 系統。
使用 Hugging Face Optimum 將 Transformers 轉換為 ONNX
Hugging Face 提供三種將 Transformers 模型轉換為 ONNX 的方法,從低階的 torch.onnx API 到高階的 Optimum 函式庫皆有涵蓋。
Intel 與 Hugging Face 合作推動機器學習硬體加速
Intel 已加入 Hugging Face 硬體合作夥伴計畫,開發 Optimum Intel 函式庫,使在 Intel 平台上對 Transformer 模型的訓練、微調與推論能夠更順暢地進行硬體加速。
Hugging Face 機器學習洞見總監:金融版
來自美國銀行、加拿大皇家銀行(RBC)以及穆迪分析的專家討論了機器學習如何透過詐騙偵測與個人化產品改變金融業,同時應對遺留系統與監管要求等挑戰。
太空侵略者的深度 Q 學習
Hugging Face 解釋了深度 Q 學習(DQN),這是一種使用神經網路來近似 Q 值的強化學習方法,適用於像 Atari 遊戲這樣的高維狀態空間。
註釋式擴散模型 – DDPM 實作的詳細步驟說明
Hugging Face 發布了一個註釋式、逐步的 PyTorch 實作,說明如何建構、訓練以及從擴散模型中抽樣以產生圖像的去噪擴散概率模型(DDPM)。
Graphcore 與 Hugging Face 擴展 IPU 就緒的 Transformer 模型
Graphcore 與 Hugging Face 已擴充 Hugging Face Optimum 函式庫,納入 10 個針對 Graphcore IPU 優化的 Transformer 模型,涵蓋 NLP、語音與電腦視覺領域。
Hugging Face Hub 社群更新:拉取請求與討論
Hugging Face 已在 Hub 引入拉取請求與討論功能,讓社群在模型、資料集與 Spaces 上進行協作,無需建立倉庫分支。
TAPEX:透過神經式 SQL 執行的高效表格預訓練
TAPEX 是一種表格預訓練方法,透過合成的 SQL 執行配對,在表格問答與事實驗證上達到最先進的表現,且相較於以往方法具備顯著更高的效率。
Hugging Face 關於 Q-Learning 的介紹
Hugging Face 提供了一份關於 Q-Learning 的技術指南,這是一種使用 Q 表來決定最佳狀態-動作配對的離策略基於價值的強化學習方法。
Hugging Face 多模態專案倫理憲章
Hugging Face 為其多模態學習專案制定了倫理憲章,將倫理原則、透明度與公平性直接融入機器學習研究生命週期。
Sempre Health 案例研究:加速 NLP 流程的 Hugging Face 專家加速計畫
Sempre Health 利用 Hugging Face 專家加速計畫部署了一個 NLP 流程,能自動處理超過 20% 的患者來訊,顯著提升了業務可擴展性。
Hugging Face 深度強化學習課程 第2單元 第1部分:Q學習概念導論
Hugging Face 發布了其深度強化學習課程的第一部分,說明了基於價值的方法、貝爾曼方程式,以及 Monte‑Carlo 與 Temporal‑Difference 學習,作為 Q‑Learning 的基礎。
Hugging Face 獎學金計畫公告
Hugging Face 推出獎學金計畫,透過資源、認可與量身訂製的支援,協助並賦能開源機器學習生態系統的關鍵貢獻者。
機器學習專家訪談 Sasha Luccioni – 關於倫理 AI 與氣候影響的重點
Hugging Face 采訪了研究科學家 Sasha Luccioni,她討論了她在倫理 AI、碳足跡測量以及將機器學習應用於氣候與社會挑戰方面的工作。