✷ 封存 · 11 個實驗室 · 870 篇 dispatch
實驗室
不用每天手動刷十幾個官方部落格。OpenAI、Anthropic、DeepMind 等實驗室的一手發布,每篇都提煉出核心內容。
使用 BentoML 部署 DeepFloyd IF
Hugging Face 展示如何使用 BentoML 部署 DeepFloyd IF 文字到圖像模型,使其多階段像素擴散架構能夠在多個 GPU 上獨立擴展。
使用 🤗 Transformers 優化 Bark
Hugging Face 展示了如何使用 Better Transformer、半精度 (fp16) 與 CPU 卸載來減少 Bark 文字轉語音模型的記憶體佔用並提升推理速度。
Swift Transformers 發布:在蘋果設備上運行 On-Device LLMs
Hugging Face 發布了 alpha swift-transformers Swift 套件、swift-chat 示範應用、已更新的 exporters 和 transformers-to-coreml 工具,以及 Llama 2 7B 和 Falcon 7B 的 Core ML 版本,使開發者能夠在蘋果應用中於設備上運行 on-device LLMs。
使用 TRL 進行 Direct Preference Optimization (DPO) 來微調 Llama 2
Hugging Face 已將直接偏好優化 (DPO) 整合到 TRL 函式庫中,使得能夠使用簡化的二元交叉熵損失來對齊 Llama 2 和其他大型語言模型 (LLMs),而無需複雜的來自人類回饋的強化學習 (RLHF) 流程。
透過 Hugging Face Inference Endpoints 部署 MusicGen
Hugging Face 展示如何使用 Inference Endpoints 和自訂處理程式(針對標準管線不支援的模型)將 MusicGen(一個文字到音樂生成模型)部署為 API。
朝向使用FHE的加密大型語言模型
Hugging Face 與 Zama 展示了 Fully Homomorphic Encryption (FHE) 如何使大型語言模型能夠處理加密的使用者資料,同時保護模型擁有者的智慧財產。
Huggy Lingo: 使用機器學習改進 Hugging Face Hub 語言中繼資料
Hugging Face 正在使用 fastText 語言識別模型和 Librarian-Bot 自動偵測並建議目前缺少語言中繼資料的資料集的語言中繼資料。
Practical 3D Asset Generation Guide
Hugging Face 提供了一個逐步工作流程,透過結合 OpenAI 的 Shap-E 模型與 Blender 與 Dream Textures,來創建低保真、PS1 風格的 3D 資產。
Segmind SD-Small 與 SD-Tiny 知識蒸餾發佈
Segmind 開源了 SD-Small 與 SD-Tiny 的代碼與預訓練權重,這兩款擴散模型比 Stable Diffusion 小 35% 與 55%,同時提供高達 2 倍的推理加速。
在 Mac 上使用進階 Core ML 量化的 Stable Diffusion XL
Hugging Face 與 Apple 已將 Stable Diffusion XL 移植至 Core ML,引入混合位元調色板量化技術,使 UNet 大小減少 71%,同時在 Apple Silicon Mac 上保持圖像品質。
Agents.js 發布:使用 JavaScript 為 LLMs 提供工具
Hugging Face 已發布 Agents.js,一個 JavaScript 庫,使 LLMs 能夠在瀏覽器或伺服器上存取並執行工具。
Hugging Face 與合作夥伴概述歐盟 AI 法案的開放機器學習考量
Hugging Face 與 Creative Commons、Eleuther AI、GitHub、LAION、Open Future 組成聯盟,提出五項關鍵建議,以確保歐盟 AI 法案支援開放原始碼機器學習發展。
Hugging Face 開源 AI 遊戲 Jam 結果
Hugging Face 舉辦了首屆開源 AI 遊戲 Jam,產生了 88 款遊戲作品,這些作品在資產、編碼和遊戲機制方面整合了開源 AI 工具。
Hugging Face Diffusers 一週年回顧
Hugging Face 慶祝 Diffusers 函式庫的一週年,重點介紹了其如何演進為一個用於文字轉圖像、影片、3D 和音訊生成的模組化工具箱。
Llama 2 發佈與 Hugging Face 整合
Meta 已發佈 Llama 2,這是一個可用於商業用途的開放存取大型語言模型系列,並已全面整合至 Hugging Face 生態系統中。
Hugging Face AI WebTV:構建自動化視訊與音樂合成串流
Hugging Face 開發了 AI WebTV,一個使用 Zeroscope 與 MusicGen 從 LLM 生成的提示詞自動合成視訊與音樂串流的實驗示範。
開源文字生成與 LLM 生態系統於 Hugging Face
Hugging Face 的 2023 部落格文章概覽了開源文字生成與 LLM 生態系統,涵蓋模型背景、授權、服務工具以及參數高效微調。
使用 Hugging Face Diffusers 在 Intel Sapphire Rapids CPU 上微調 Stable Diffusion
Hugging Face 展示了如何僅使用五張範例圖像,透過文字反演在 Intel Sapphire Rapids CPU 上微調 Stable Diffusion 模型,示範了透過 Intel Extension for PyTorch 和 oneCCL 進行 CPU 基礎微調。
使用 Transformers.js 製作具備 ML 能力的網頁遊戲
Hugging Face 展示如何使用 Transformers.js 和經微調的 MobileViT 模型,在瀏覽器中完全運行即時素描偵測遊戲 Doodle Dash。
使用 Hugging Face Inference Endpoints 部署 LLMs
Hugging Face Inference Endpoints 是一種受管理的 SaaS 解決方案,讓開發者能夠使用自動擴展、scale-to-zero 和企業級安全等功能,將開源 LLMs 部署為生產就緒的 API。
Hugging Face: 使用開放 ML 模型製作網頁應用產生器
Hugging Face 展示了如何使用 NodeJS、WizardCoder-15B 模型以及 Hugging Face Inference Endpoints API 建構 text-to-webapp 生成器。
利用 Hugging Face 處理複雜生成式 AI 用例:Writer 案例研究
Hugging Face 強調與 Writer 的合作,展示該公司如何從使用者轉變為客戶與開源貢獻者,同時利用 Hugging Face 專家加速計畫實現可擴展的 LLM 生產。
加速視覺語言模型:BridgeTower 在 Habana Gaudi2 上
Hugging Face 示範,在 Habana Gaudi2 上使用 Optimum Habana 進行 BridgeTower 視覺語言模型的微調,透過增加資料載入工作程序數以及硬體加速的圖像解碼,可達到比 Nvidia A100 快 2.5 倍、比 H100 快 1.4 倍。
Hugging Face 倫理與社會通訊 #4:文字生成圖像模型中的偏見
Hugging Face 概述了文字生成圖像模型中複雜的偏見來源,並提出結合探索工具、紅隊演練和文件記錄等多種方法來檢測並減輕這些偏見。
Hugging Face Open LLM Leaderboard MMLU 評估分析
Hugging Face 說明 MMLU 基準的不同實作細節如何導致相同 LLM 的效能分數和排名出現顯著差異。
Panel 與 Hugging Face Spaces 的整合
Hugging Face 已將 Panel 模板整合到 Hugging Face Spaces,使用戶能夠輕鬆構建和部署基於 Python 的儀表板和複雜應用程式。
Hugging Face 對美國 NTIA 關於 AI 問責制徵求意見的回應
2023 年 6 月 12 日,Hugging Face 就美國 NTIA 關於 AI 問責制的徵求意見提交了回應,建議問責機制應涵蓋完整的 ML 生命週期、將內部文件與外部透明度相結合,並納入廣泛的利益相關者。
為低資源 ASR 微調 MMS Adapter 模型
Hugging Face 宣布,在 Meta AI 的 Massive Multilingual Speech (MMS) 模型上微調 adapter 層,僅需數分鐘訓練即可在低資源語言上達到最先進的字錯率 (WER),同時比全模型微調更具記憶體效率。
Autoformer – Transformers 對時間序列預測有效
Hugging Face 宣布 Autoformer 模型現在已在 🤗 Transformers 庫中提供,顯示基於 Transformer 的模型在時間序列預測基準測試中優於如 DLinear 這樣的簡單線性基線。
Hugging Face 內容指引與政策更新
Hugging Face 已更新其內容政策,以應對審核機器學習工件的獨特挑戰,並將同意作為核心價值,以保護使用者權利與隱私。
將 Livebook 筆記本部署為應用程式至 Hugging Face Spaces
Hugging Face 現在支援將 Livebook 筆記本部署為互動式應用程式至 Hugging Face Spaces,使得基於 Elixir 的機器學習應用程式能夠輕鬆共享。
在 iPhone、iPad 和 Mac 上使用 Core ML 加速 Stable Diffusion
Hugging Face 與 Apple 在 Core ML 中引入了 6 位調色板量化和更新的注意力層優化,以顯著降低記憶體使用量並提升 Stable Diffusion 在 Apple 裝置上的推理速度。
Hugging Face 與 AMD 合作加速模型
Hugging Face 與 AMD 已經合作以優化最先進的 Transformer 模型,適用於 AMD CPU、GPU 與 AI 加速器,從而提升訓練與推理的成本效益標準。
專為美術館、圖書館、檔案館與博物館設計的 Hugging Face Hub
Hugging Face 發布了一份指南,展示美術館、圖書館、檔案館和博物館如何利用其 Hub 來分享模型、資料集和演示,從而降低 GLAM 領域使用機器學習的門檻。
基礎模型能像人類一樣標記數據嗎?Hugging Face 分析
Hugging Face 調查了 GPT-4 是否能可靠地取代人類標註者進行 LLM 偏好評估,發現其存在顯著的位置偏誤與冗長偏誤,限制了其作為人類判斷代理的準確性。
Hugging Face Hub 與 DuckDB 整合用於數據集分析
Hugging Face 現在允許使用者透過 DuckDB,對 Hub 上超過 50,000 個已自動轉換為 Parquet 格式的公開數據集執行 SQL 查詢。
fastText 與 Hugging Face Hub 整合
Hugging Face 現在託管 fastText 詞向量的官方鏡像,支援 157 種語言以及一個語言識別模型,簡化模型存取與部署。
Falcon 模型發布與 Hugging Face 生態系統整合
Hugging Face 宣布了 Falcon 系列開放 Apache‑2.0 授權的語言模型,強調 Falcon‑40B 在 Open LLM 排行榜上的首位排名,並展示如何使用 Hugging Face 工具來運行、量化和微調它們。
AI 語音辨識在 Unity 中
Hugging Face 提供了一份指南和 API,以在 Unity 遊戲中實作最先進的自動語音辨識 (ASR),從而啟用語音命令和 NPC 互動。
Hugging Face 開放原始碼 AI 遊戲 Jam 公告
Hugging Face 將於 2023 年 7 月 7 日至 9 日舉辦 開放原始碼 AI 遊戲 Jam,以鼓勵遊戲開發者將開放原始碼生成式 AI 工具整合到他們的開發工作流程和遊戲功能中。
BERTopic 與 Hugging Face Hub 的整合
Hugging Face 部落格文章中宣布 BERTopic 與 Hub 整合的貼文,除了標題之外,沒有提供可讀的詳細內容。
Hugging Face LLM 推理容器適用於 Amazon SageMaker
Hugging Face 已為 Amazon SageMaker 推出專門設計的 LLM 推理容器 (DLC),由 Text Generation Inference (TGI) 提供動力,以實現開源大型語言模型的高效能部署。
優化 Intel CPU 上的 Stable Diffusion 使用 NNCF 與 🤗 Optimum
Hugging Face 宣佈了一個使用 NNCF 與 Optimum 來對 Stable Diffusion 進行量化並應用 Token Merging 的工作流程,在 Intel CPU 上實現最高 5.1 倍的推理加速,並將模型佔用空間減少 4 倍。
Hugging Face Model Catalog 在 Azure Machine Learning 上
Hugging Face 與 Microsoft 已在 Azure Machine Learning Studio 內推出 Hugging Face Hub Model Catalog 的原生整合,以簡化在安全的 Azure 基礎設施上部署開放原始碼模型。
Hugging Face 4 位元量化與 QLoRA 發布
Hugging Face 宣布透過 bitsandbytes 支援 4 位元量化以及 QLoRA 方法,使大型語言模型能在消費級 GPU 上進行推論與適配器微調。
使用 InstructPix2Pix 進行 Stable Diffusion 的指令微調
Hugging Face 探索擴展 InstructPix2Pix,以透過多任務指令微調方法教導 Stable Diffusion 遵循特定的圖像翻譯與低階處理指令。
Hugging Face Safetensors 安全審計與預設採用
Hugging Face、EleutherAI 與 Stability AI 正在將 safetensors 轉為預設的模型保存格式,此舉是基於 Trail of Bits 的安全審計,該審計確認未發現導致任意程式碼執行的重大缺陷。
Hugging Face 與 IBM 的 watsonx.ai 合作夥伴關係
Hugging Face 與 IBM 合作,將 Hugging Face 的開源函式庫與模型整合至 watsonx.ai,這是一個用於訓練、微調與部署基礎模型的企業 AI 工作室。
Q8-Chat:在 Intel Xeon CPU 上的高效生成式 AI
Hugging Face 與 Intel 示範,使用 SmoothQuant 將大型語言模型壓縮至 8 位元整數,可在單插槽 Intel Xeon CPU 上高效執行高品質聊天體驗。
大規模近重複刪除背後的 BigCode
Hugging Face 詳細說明了使用 MinHash 與 Locality Sensitive Hashing(LSH)在 BigCode 計畫中執行大規模近重複刪除,並證明移除近重複資料可提升模型效能與訓練效率。