Falcon 模型发布及 Hugging Face 生态集成
Hugging Face 宣布了 Falcon 家族的开源 Apache‑2.0 语言模型,突出 Falcon‑40B 在 Open LLM 排行榜上的顶尖排名,并展示了如何使用 Hugging Face 工具运行、量化和微调这些模型。
AI 语音识别在 Unity 中
Hugging Face 提供了一份指南和 API,用于在 Unity 游戏中实现最先进的自动语音识别(ASR),以启用语音命令和 NPC 交互。
Hugging Face 开源 AI Game Jam 公告
Hugging Face 将于 2023 年 7 月 7 日至 9 日举办开源 AI Game Jam,以鼓励游戏开发者将开源生成式 AI 工具集成到他们的开发工作流和游戏功能中。
Hugging Face LLM 推理容器 适用于 Amazon SageMaker
Hugging Face 推出了一个专门构建的 LLM 推理容器(DLC),适用于 Amazon SageMaker,由 Text Generation Inference (TGI) 提供动力,以实现开源大型语言模型的高性能部署。
使用 NNCF 和 🤗 Optimum 优化 Intel CPU 上的 稳定扩散
Hugging Face 宣布了一种使用 NNCF 和 Optimum 对 稳定扩散 进行量化并应用 令牌合并 的工作流程,在 Intel CPU 上实现了最高 5.1 倍的推理速度提升以及模型占用空间减少 4 倍。
Hugging Face 在 Azure Machine Learning 上的模型目录
Hugging Face 和 Microsoft 在 Azure Machine Learning Studio 内推出了 Hugging Face Hub 模型目录的原生集成,以简化在安全的 Azure 基础设施上部署开源模型。
Hugging Face 4 位量化与 QLoRA 发布
Hugging Face 宣布通过 bitsandbytes 支持 4 位量化,并推出 QLoRA 方法,使得在消费级 GPU 上即可进行大语言模型的推理和适配器微调。
使用 InstructPix2Pix 对 Stable Diffusion 进行指令微调
Hugging Face 探索将 InstructPix2Pix 扩展,以通过多任务指令微调方法教会 Stable Diffusion 遵循特定的图像转换和低层处理指令。
Hugging Face Safetensors 安全审计与默认采用
在 Trail of Bits 的安全审计确认未发现导致任意代码执行的关键缺陷后,Hugging Face、EleutherAI 和 Stability AI 正在将 safetensors 作为默认模型保存格式进行迁移。
Hugging Face 与 IBM 在 watsonx.ai 的合作
Hugging Face 与 IBM 合作,将 Hugging Face 开源库和模型集成到 watsonx.ai 中,watsonx.ai 是一个用于训练、调优和部署基础模型的企业 AI 工作室。
Q8-Chat:在 Intel Xeon CPU 上实现高效生成式 AI
Hugging Face 与 Intel 展示,使用 SmoothQuant 将 LLM 压缩为 8 位整数,可在单插槽 Intel Xeon CPU 上高效运行高质量的聊天体验。
大规模近似去重背后的 BigCode
Hugging Face 详细说明了在 BigCode 项目中使用 MinHash 和局部敏感哈希(LSH)进行大规模近似去重,展示了去除近似重复数据能够提升模型性能和训练效率。
RWKV 架构集成到 Hugging Face Transformers
Hugging Face 宣布将 RWKV RNN‑Transformer 混合模型集成到 Transformers 库中,使开源的长上下文语言模型能够兼具 RNN 的高效性和 Transformer 的性能。
在 AMD GPU 上使用 ROCm 运行 Vicuna 13B
Hugging Face 提供了一份技术指南,介绍如何在单个 AMD GPU 上使用 ROCm 和 GPTQ 4 位量化部署 Vicuna 13B 开源聊天机器人,将内存需求从 28GB 降至 7.52GB。
Hugging Face 入选 CNIL 增强支持计划
Hugging Face 被法国数据保护机构(CNIL)选入其增强支持计划,以提升在 AI 开发中数据保护和 GDPR 合规的实施。
Hugging Face 低延迟文本生成的辅助生成
Hugging Face 推出了辅助生成,这是一种解码方法,使用更小的助手模型预测候选标记,然后由更大的模型进行验证,从而在某些硬件配置下将延迟降低至最高 10 倍。
使用 StarCoder 创建编码助手 – 摘要
深入文本到视频模型
Hugging Face 提供了文本到视频生成模型演进的技术概览,详细阐述了从 GAN 到 Transformer 再到 Diffusion 架构的转变,并突出时间一致性和数据稀缺的独特挑战。
StarCoder 发布说明
Hugging Face 与 ServiceNow 的 BigCode 合作发布了 StarCoder 和 StarCoderBase,这两款 15B 参数的代码 LLM 在许可宽松的数据上进行训练,在多个编程基准上超越了多种开放和闭源模型。
Hugging Face Unity API 安装与使用指南
Hugging Face Unity API 允许开发者通过专用的包和 API 向导,将 Hugging Face 推理 API 模型集成到 Unity 项目中。
使用 Hugging Face Transformers、TensorFlow 和 TPU 训练语言模型
Hugging Face 提供了一套可扩展的端到端指南,使用 TensorFlow 和 TPU pod 从头训练掩码语言模型,利用 XLA 兼容性实现高性能计算。
Databricks 与 Hugging Face 集成 Apache Spark 加速 LLM 训练
Databricks 通过 Dataset.from_spark() 函数在 Hugging Face Datasets 中引入了一流的 Apache Spark 支持,将大规模模型训练和调优的数据加载时间降低了最高 40%。
在免费版 Google Colab 上使用 Diffusers 运行 DeepFloyd IF
Hugging Face 展示了如何通过 8 位量化、模块化管道加载以及 Diffusers 集成的优化,在免费 Google Colab 笔记本上运行开源的 DeepFloyd IF 文本到图像模型。
Hugging Face推出中文语言博客,支持全球AI社区
Hugging Face 已推出专门的中文语言博客(hf.co/blog/zh),提供翻译的技术资源,促进与中国 AI 社区更深入的合作。
在 Hugging Face Spaces 上托管 Unity 游戏
Hugging Face Spaces 可以通过使用 Static HTML 模板和 WebGL 构建目标来托管可玩的 Unity 游戏。
使用 AWS Inferentia2 加速 Hugging Face Transformers
Hugging Face 与 AWS 已针对 AWS Inferentia2 这一专用推理加速器对 Transformers 进行优化,显著降低延迟并提升大规模模型的吞吐量。
使用 Transformers 进行图分类
Hugging Face 演示了如何在 Transformers 库中使用 Graphormer 模型进行图分类,涵盖数据格式化、预处理和微调。
使用 Substra 创建隐私保护的 AI
Hugging Face 和 Substra 强调了联邦学习如何在去中心化的数据源上训练 AI 模型,以保持隐私和安全,尤其是在医疗等敏感领域。
Snorkel AI 与 Hugging Face 的企业基础模型集成
Snorkel AI 与 Hugging Face 合作,将 Hugging Face Inference Endpoints 集成到 Snorkel Flow 中,使企业能够轻松访问并适配超过 150,000 个开源基础模型。
StackLLaMA:使用 RLHF 训练 LLaMA 以用于 Stack Exchange
Hugging Face 推出 StackLLaMA,这是一款通过监督微调、奖励建模和人类反馈强化学习 (RLHF) 训练的模型,用于回答 Stack Exchange 的问题。
Hugging Face伦理与社会通讯 #3:伦理开放倡议
Hugging Face宣布了新的伦理开放措施——包括六个伦理标签、标记系统以及受众引导元数据——以使开源机器学习更安全、更具包容性。
在 Intel Sapphire Rapids CPU 上加速 Stable Diffusion 推理
Hugging Face 展示了如何在 Intel Sapphire Rapids CPU 上使用 Optimum Intel、OpenVINO、系统级调优、IPEX BF16 以及更快的调度器,将 Stable Diffusion 图像生成的时间从 32 秒缩短至约 5 秒。
在 Habana Gaudi2 加速器上进行 BLOOMZ 推理
Hugging Face 演示了 Habana Gaudi2 加速器在 BLOOMZ 176B 模型上的推理速度快于 Nvidia A100 80GB,利用 Optimum Habana 库和 DeepSpeed‑inference 实现。
使用 Hugging Face 与 Flower 的联邦学习
Hugging Face 演示了如何使用 Flower 框架在预训练的 distilBERT 模型上进行联邦学习,以在 IMDB 数据集上进行情感分析。
使用 Hugging Face Diffusers 训练 ControlNet
Hugging Face 通过 diffusers 库提供了完整的指南和训练脚本,使用户能够为 Stable Diffusion 训练自定义 ControlNet 模型,示例展示了如何创建一个 “Uncanny Faces” 姿态模型。
Hugging Face Hub 改进的 Jupyter Notebook 支持
Hugging Face 为托管在 Hub 上的 Jupyter Notebook 引入了可读性更强的渲染,提升了机器学习从业者的可复现性和可访问性。
使用 Informer 的多变量概率时间序列预测
Hugging Face 已将 Informer 模型集成到 Transformers 库中,实现了高效的多变量概率时间序列预测,并降低了计算和内存复杂度。
在 24GB 消费级 GPU 上对 20B LLM 进行 RLHF 微调
Hugging Face 发布了 TRL 与 PEFT 的集成,使得使用 8 位量化和低秩适配器在单个 24 GB GPU 上对 200 亿参数的语言模型进行强化学习微调。
Kakao Brain ViT 与 ALIGN 模型发布,使用 COYO 700M 数据集
Kakao Brain 与 Hugging Face 发布了在全新 700 M 图文 COYO 数据集上训练的开源 ViT 与 ALIGN 视觉语言模型,提供了首个公开可用的 ALIGN 模型以及具备可复现训练数据的 ViT 模型。
Diffusers 中的 ControlNet
Hugging Face 已将 ControlNet 集成到 Diffusers 库中,使得能够通过 Canny 边缘、深度图和人体姿态等条件,实现对 Stable Diffusion 图像生成的精确空间控制。
使用机器学习进行灾害响应:afetharita 项目
Hugging Face 介绍了志愿者如何利用 Hugging Face 生态系统快速部署 OCR、NER 和遥感的机器学习模型,以帮助 2023 年 2 月土耳其地震的幸存者。
Hugging Face Diffusers 伦理指南
Hugging Face 为 Diffusers 库推出了伦理框架,以指导技术决策和社区贡献,同时降低扩散模型可能带来的社会风险。
Hugging Face 专家加速计划:Witty Works 案例研究
Witty Works 利用 Hugging Face 专家加速计划和 SetFit,构建了一个基于上下文的包容性语言分类器,在使用极少标注数据的情况下实现了高准确率。
Swift Diffusers for Mac 1.1 发布
Hugging Face 已发布 Diffusers for Mac 1.1 版,这是一款利用 Core ML 加速 Apple Silicon 上 Stable Diffusion 的原生开源应用,在部分硬件配置下可实现最高 2 倍的生成速度提升。
大语言模型的红队测试
Hugging Face 概述了红队测试在识别 LLM 漏洞、预防有害输出方面的关键作用,强调需要协作且自适应的评估方法。
Fetch AI 基础设施迁移:使用 Hugging Face 和 AWS 整合工具
Fetch 通过从第三方 AI “黑箱”迁移到由 Hugging Face 和 AWS 支持的内部机器学习管道,将开发时间缩短了 30%,处理延迟降低了 50%。
Hugging Face 与 AWS 的 AI 可访问性战略合作伙伴关系
Hugging Face 与 AWS 扩大了战略合作,通过将 Hugging Face 模型与 AWS 基础设施及专用 ML 加速器相结合,使生成式 AI 更加民主化。
Hugging Face 推理端点案例研究
Hugging Face 正在将其基于 CPU 的机器学习模型从 AWS ECS/Fargate 迁移到 Hugging Face 推理端点,以降低运维复杂性并降低延迟。
BLIP-2:零样本图像到文本生成
BLIP-2 是 Salesforce Research 开发的视觉语言模型,使用查询变换器(Q-Former)在冻结的图像编码器和冻结的大型语言模型之间搭建桥梁,实现高效的零样本图像到文本生成。
🤗 PEFT 库发布,实现对千亿规模模型的参数高效微调
Hugging Face 宣布了 🤗 PEFT 库,用户只需训练极少量参数,即可在低资源硬件上微调千亿参数模型。