601

AI 語音辨識在 Unity 中

Hugging Face 提供了一份指南和 API,以在 Unity 遊戲中實作最先進的自動語音辨識 (ASR),從而啟用語音命令和 NPC 互動。

602

Hugging Face 開放原始碼 AI 遊戲 Jam 公告

Hugging Face 將於 2023 年 7 月 7 日至 9 日舉辦 開放原始碼 AI 遊戲 Jam,以鼓勵遊戲開發者將開放原始碼生成式 AI 工具整合到他們的開發工作流程和遊戲功能中。

603

Hugging Face LLM 推理容器適用於 Amazon SageMaker

Hugging Face 已為 Amazon SageMaker 推出專門設計的 LLM 推理容器 (DLC),由 Text Generation Inference (TGI) 提供動力,以實現開源大型語言模型的高效能部署。

604

優化 Intel CPU 上的 Stable Diffusion 使用 NNCF 與 🤗 Optimum

Hugging Face 宣佈了一個使用 NNCF 與 Optimum 來對 Stable Diffusion 進行量化並應用 Token Merging 的工作流程,在 Intel CPU 上實現最高 5.1 倍的推理加速,並將模型佔用空間減少 4 倍。

605

Hugging Face Model Catalog 在 Azure Machine Learning 上

Hugging Face 與 Microsoft 已在 Azure Machine Learning Studio 內推出 Hugging Face Hub Model Catalog 的原生整合,以簡化在安全的 Azure 基礎設施上部署開放原始碼模型。

606

Hugging Face 4 位元量化與 QLoRA 發布

Hugging Face 宣布透過 bitsandbytes 支援 4 位元量化以及 QLoRA 方法,使大型語言模型能在消費級 GPU 上進行推論與適配器微調。

607

使用 InstructPix2Pix 進行 Stable Diffusion 的指令微調

Hugging Face 探索擴展 InstructPix2Pix,以透過多任務指令微調方法教導 Stable Diffusion 遵循特定的圖像翻譯與低階處理指令。

608

Hugging Face Safetensors 安全審計與預設採用

Hugging Face、EleutherAI 與 Stability AI 正在將 safetensors 轉為預設的模型保存格式,此舉是基於 Trail of Bits 的安全審計,該審計確認未發現導致任意程式碼執行的重大缺陷。

609

Hugging Face 與 IBM 的 watsonx.ai 合作夥伴關係

Hugging Face 與 IBM 合作,將 Hugging Face 的開源函式庫與模型整合至 watsonx.ai,這是一個用於訓練、微調與部署基礎模型的企業 AI 工作室。

610

Q8-Chat:在 Intel Xeon CPU 上的高效生成式 AI

Hugging Face 與 Intel 示範,使用 SmoothQuant 將大型語言模型壓縮至 8 位元整數,可在單插槽 Intel Xeon CPU 上高效執行高品質聊天體驗。

611

大規模近重複刪除背後的 BigCode

Hugging Face 詳細說明了使用 MinHash 與 Locality Sensitive Hashing(LSH)在 BigCode 計畫中執行大規模近重複刪除,並證明移除近重複資料可提升模型效能與訓練效率。

612

RWKV 架構整合至 Hugging Face Transformers

Hugging Face 宣布將 RWKV RNN‑Transformer 混合模型整合至 Transformers 函式庫,讓開源的長上下文語言模型結合 RNN 的效率與 Transformer 的效能。

613

在 AMD GPU 上使用 ROCm 執行 Vicuna 13B

Hugging Face 提供了一份技術指南,說明如何在單一 AMD GPU 上使用 ROCm 與 GPTQ 4 位元量化部署 Vicuna 13B 開源聊天機器人,將記憶體需求從 28GB 降至 7.52GB。

614

Hugging Face 入選 CNIL 加強支援計畫

Hugging Face 已被法國資料保護機構(CNIL)選入其加強支援計畫,以提升在 AI 開發中資料保護與 GDPR 合規的落實。

615

Hugging Face 輔助生成以降低延遲的文字生成

Hugging Face 引入了 Assisted Generation,一種利用較小的輔助模型預測候選 token,並由較大的模型驗證的解碼方法,可在某些硬體配置下將延遲降低至最高 10 倍。

616

使用 StarCoder 創建編程助手 – 摘要

本文說明了 Hugging Face 團隊如何將 16 B 參數的 StarCoder 程式碼生成模型轉變為對話式編程助手(StarChat‑α)。透過新增特殊聊天標記、準備過濾後的 Open‑Assistant 對話資料集,並使用 DeepSpeed ZeRO‑3 進行微調,他們訓練出一個能理解使用者提示並產生可執行程式碼(例如繪圖、地圖、視覺化)的模型。文章亦涵蓋了 tokenizer 設定、使用者回合的損失遮蔽、訓練配置、評估(包括基準測試與 LLM 為基礎的評估)、限制與未來方向。最終模型已在 Hub 上公開提供。

617

深入探討文字到影片模型

Hugging Face 提供了文字到影片生成模型演變的技術概述,詳細說明了從 GAN 到 Transformer 以及 Diffusion 架構的轉變,同時突顯了時間一致性與資料稀缺的獨特挑戰。

618

StarCoder 發行說明

Hugging Face 與 ServiceNow 的 BigCode 合作發布了 StarCoder 與 StarCoderBase,這兩款 15B 參數的程式碼 LLM 以寬鬆授權的資料訓練,並在程式設計基準測試中超越多個開放與封閉模型。

619

Hugging Face Unity API 安裝與使用指南

Hugging Face Unity API 讓開發者能透過專屬套件與 API wizard,將 Hugging Face Inference API 模型整合至 Unity 專案中。

620

使用 Hugging Face Transformers、TensorFlow 與 TPU 訓練語言模型

Hugging Face 提供了一套可擴展的端對端指南,使用 TensorFlow 與 TPU pod 從頭訓練遮蔽語言模型,透過 XLA 相容性實現高效能運算。

621

Databricks 與 Hugging Face 整合 Apache Spark 加速 LLM 訓練

Databricks 透過 Dataset.from_spark() 函式在 Hugging Face Datasets 中引入了第一流的 Apache Spark 支援,將大型模型訓練與微調的資料載入時間縮短最高可達 40%。

622

在免費等級的 Google Colab 上使用 Diffusers 執行 DeepFloyd IF

Hugging Face 示範了如何在免費的 Google Colab 筆記本上執行開源的 DeepFloyd IF 文字轉圖像模型,方法包括使用 8 位元量化、模組化管線載入以及 Diffusers 整合的最佳化。

623

Hugging Face 推出中文語言部落格以支援全球 AI 社群

Hugging Face 已推出專屬中文語言部落格 (hf.co/blog/zh),提供翻譯技術資源,並促進與中文 AI 社群更深入的合作。

624

在 Hugging Face Spaces 上託管 Unity 遊戲

Hugging Face Spaces 可透過使用 Static HTML 模板與 WebGL 建置目標來託管可遊玩的 Unity 遊戲。

625

使用 AWS Inferentia2 加速 Hugging Face Transformers

Hugging Face 與 AWS 已針對 AWS Inferentia2 這款專為推論設計的加速器,優化了 Transformers,使大型模型的延遲顯著降低,吞吐量顯著提升。

626

使用 Transformers 進行圖形分類

Hugging Face 示範了如何在 Transformers 套件中使用 Graphormer 模型執行圖形分類,涵蓋資料格式化、前處理與微調。

627

使用 Substra 創建隱私保護的 AI

Hugging Face 與 Substra 強調聯邦學習如何在分散式資料來源上訓練 AI 模型,以維護隱私與安全,尤其在醫療等敏感領域。

628

Snorkel AI 與 Hugging Face 企業基礎模型整合

Snorkel AI 與 Hugging Face 合作,將 Hugging Face Inference Endpoints 整合至 Snorkel Flow,讓企業能輕鬆存取並調整超過 150,000 個開源基礎模型。

629

StackLLaMA:使用 RLHF 訓練 LLaMA 於 Stack Exchange

Hugging Face 推出 StackLLaMA,一個透過監督式微調、獎勵模型與人類回饋強化學習(RLHF)訓練,以回答 Stack Exchange 問題的模型。

630

Hugging Face 倫理與社會通訊 #3:倫理開放倡議

Hugging Face 宣布了新的倫理開放措施——包括六個倫理標籤、舉報系統以及受眾導向的元資料——以使開源機器學習更安全且更具包容性。

631

在 Intel Sapphire Rapids CPU 上加速 Stable Diffusion 推理

Hugging Face 示範了如何在 Intel Sapphire Rapids CPU 上,透過 Optimum Intel、OpenVINO、系統層級調整、IPEX BF16 與更快的排程器,將 Stable Diffusion 影像生成時間從 32 秒縮短至約 5 秒。

632

BLOOMZ 在 Habana Gaudi2 加速器上的推論

Hugging Face 示範了 Habana Gaudi2 加速器在 BLOOMZ 176B 模型上的推論速度快於 Nvidia A100 80GB,並利用 Optimum Habana 函式庫與 DeepSpeed‑inference。

633

使用 Hugging Face 與 Flower 的聯邦學習

Hugging Face 示範如何使用 Flower 框架在預訓練的 distilBERT 模型上進行聯邦學習,以對 IMDB 資料集執行情感分析。

634

使用 Hugging Face Diffusers 訓練 ControlNet

Hugging Face 透過 diffusers 函式庫提供完整的指南與訓練腳本,讓使用者能夠為 Stable Diffusion 訓練自訂的 ControlNet 模型,並以「Uncanny Faces」姿勢模型的製作作為示範。

635

Hugging Face Hub 改進的 Jupyter Notebook 支援

Hugging Face 為託管於 Hub 的 Jupyter Notebook 引入了可供人類閱讀的渲染,提升了機器學習實踐者的可重現性與可取得性。

636

使用 Informer 的多變量概率時間序列預測

Hugging Face 已將 Informer 模型整合至 Transformers 套件,實現高效的多變量概率時間序列預測,並降低計算與記憶體複雜度。

637

在 24GB 消費者 GPU 上使用 RLHF 微調 20B 大型語言模型

Hugging Face 發佈了 TRL 與 PEFT 的整合,使得能在單一 24 GB GPU 上使用 8 位元量化與低秩適配器對 200 億參數的語言模型進行強化學習微調。

638

Kakao Brain ViT 與 ALIGN 模型發布,搭配 COYO 700M 資料集

Kakao Brain 與 Hugging Face 發布了開源的 ViT 與 ALIGN 視覺語言模型,這些模型是以全新 700 M 圖文 COYO 資料集訓練的,提供了首個公開可用的 ALIGN 模型以及具備可重現訓練資料的 ViT 模型。

639

Diffusers 中的 ControlNet

Hugging Face 已將 ControlNet 整合至 Diffusers 函式庫,讓使用者能透過 Canny 邊緣、深度圖與人體姿勢等條件,對 Stable Diffusion 圖像生成進行精確的空間控制。

640

使用機器學習進行災害應變:afetharita 專案

Hugging Face 描述了志工如何利用 Hugging Face 生態系統快速部署 OCR、NER 與遙感的機器學習模型,以協助 2023 年 2 月土耳其地震的倖存者。

641

Hugging Face Diffusers 倫理指導原則

Hugging Face 為 Diffusers 函式庫推出了倫理框架,以指導技術決策與社群貢獻,同時減輕擴散模型可能帶來的社會風險。

642

Hugging Face 專家加速計畫:Witty Works 案例研究

Witty Works 利用 Hugging Face 專家加速計畫與 SetFit,構建了一個具備高準確度且僅需最少標記資料的情境依賴包容性語言分類器。

643

Swift Diffusers for Mac 1.1 發布

Hugging Face 已發布 Diffusers for Mac 1.1 版,這是一款利用 Core ML 加速 Apple Silicon 上 Stable Diffusion 的原生開源應用,於特定硬體配置下可提供最高 2 倍的生成速度提升。

644

大型語言模型的紅隊測試

Hugging Face 概述了紅隊測試在識別 LLM 弱點以防止有害輸出方面的關鍵角色,強調需要協作且具適應性的評估方法。

645

Fetch AI 基礎設施遷移:與 Hugging Face 及 AWS 整合工具

Fetch 透過從第三方 AI「黑盒」遷移至由 Hugging Face 與 AWS 支持的內部機器學習管線,將開發時間縮短 30%,處理延遲降低 50%。

646

Hugging Face 與 AWS 的 AI 可及性戰略合作夥伴關係

Hugging Face 與 AWS 擴大了戰略合作,透過將 Hugging Face 模型與 AWS 基礎設施及專用機器學習加速器整合,讓生成式 AI 更加民主化。

647

Hugging Face 推理端點案例研究

Hugging Face 正在將其基於 CPU 的機器學習模型從 AWS ECS/Fargate 遷移至 Hugging Face 推理端點,以降低運營複雜度並提升延遲表現。

648

BLIP-2:零樣本影像到文字生成

BLIP-2 是 Salesforce Research 開發的視覺語言模型,使用查詢變換器(Q-Former)在凍結的影像編碼器與凍結的大型語言模型之間搭橋,以實現高效的零樣本影像到文字生成。

649

🤗 PEFT 函式庫發布,實現千億規模模型的參數高效微調

Hugging Face 宣布了 🤗 PEFT 函式庫,讓使用者僅訓練極少量參數,即可在低資源硬體上微調千億參數模型。

650

SpeechT5:統一模態編碼器-解碼器於語音處理

Hugging Face 已整合 SpeechT5,這是一個統一的基於 Transformer 的模型,能透過共享的編碼器-解碼器骨幹執行文字轉語音、語音轉語音與語音轉文字任務。