7201

大规模近似去重背后的 BigCode

Hugging Face 详细说明了在 BigCode 项目中使用 MinHash 和局部敏感哈希(LSH)进行大规模近似去重,展示了去除近似重复数据能够提升模型性能和训练效率。

7202

RWKV 架构集成到 Hugging Face Transformers

Hugging Face 宣布将 RWKV RNN‑Transformer 混合模型集成到 Transformers 库中,使开源的长上下文语言模型能够兼具 RNN 的高效性和 Transformer 的性能。

7203

在 AMD GPU 上使用 ROCm 运行 Vicuna 13B

Hugging Face 提供了一份技术指南,介绍如何在单个 AMD GPU 上使用 ROCm 和 GPTQ 4 位量化部署 Vicuna 13B 开源聊天机器人,将内存需求从 28GB 降至 7.52GB。

7204

Hugging Face 入选 CNIL 增强支持计划

Hugging Face 被法国数据保护机构(CNIL)选入其增强支持计划,以提升在 AI 开发中数据保护和 GDPR 合规的实施。

7205

Hugging Face 低延迟文本生成的辅助生成

Hugging Face 推出了辅助生成,这是一种解码方法,使用更小的助手模型预测候选标记,然后由更大的模型进行验证,从而在某些硬件配置下将延迟降低至最高 10 倍。

7206

OpenAI 使用 GPT‑4 发布 GPT‑2 自动神经元解释数据集

OpenAI 宣布了一种使用 GPT‑4 为 GPT‑2 中每个神经元生成并评分自然语言解释的方法,并向研究社区发布了相应的数据集、查看器和代码。

7207

使用 StarCoder 创建编码助手 – 摘要

7208

深入文本到视频模型

Hugging Face 提供了文本到视频生成模型演进的技术概览,详细阐述了从 GAN 到 Transformer 再到 Diffusion 架构的转变,并突出时间一致性和数据稀缺的独特挑战。

7209

StarCoder 发布说明

Hugging Face 与 ServiceNow 的 BigCode 合作发布了 StarCoder 和 StarCoderBase,这两款 15B 参数的代码 LLM 在许可宽松的数据上进行训练,在多个编程基准上超越了多种开放和闭源模型。

7210

Hugging Face Unity API 安装与使用指南

Hugging Face Unity API 允许开发者通过专用的包和 API 向导,将 Hugging Face 推理 API 模型集成到 Unity 项目中。

7211

使用 Hugging Face Transformers、TensorFlow 和 TPU 训练语言模型

Hugging Face 提供了一套可扩展的端到端指南,使用 TensorFlow 和 TPU pod 从头训练掩码语言模型,利用 XLA 兼容性实现高性能计算。

7212

Databricks 与 Hugging Face 集成 Apache Spark 加速 LLM 训练

Databricks 通过 Dataset.from_spark() 函数在 Hugging Face Datasets 中引入了一流的 Apache Spark 支持,将大规模模型训练和调优的数据加载时间降低了最高 40%。

7213

在免费版 Google Colab 上使用 Diffusers 运行 DeepFloyd IF

Hugging Face 展示了如何通过 8 位量化、模块化管道加载以及 Diffusers 集成的优化,在免费 Google Colab 笔记本上运行开源的 DeepFloyd IF 文本到图像模型。

7214

OpenAI 为 ChatGPT 引入全新数据管理控制

OpenAI 引入了一项新设置,可禁用聊天历史以防止在用户对话上进行模型训练,同时计划推出 ChatGPT Business 订阅和全新数据导出工具。

7215

Hugging Face推出中文语言博客,支持全球AI社区

Hugging Face 已推出专门的中文语言博客(hf.co/blog/zh),提供翻译的技术资源,促进与中国 AI 社区更深入的合作。

7216

在 Hugging Face Spaces 上托管 Unity 游戏

Hugging Face Spaces 可以通过使用 Static HTML 模板和 WebGL 构建目标来托管可玩的 Unity 游戏。

7217

使用 AWS Inferentia2 加速 Hugging Face Transformers

Hugging Face 与 AWS 已针对 AWS Inferentia2 这一专用推理加速器对 Transformers 进行优化,显著降低延迟并提升大规模模型的吞吐量。

7218

使用 Transformers 进行图分类

Hugging Face 演示了如何在 Transformers 库中使用 Graphormer 模型进行图分类,涵盖数据格式化、预处理和微调。

7219

使用 Substra 创建隐私保护的 AI

Hugging Face 和 Substra 强调了联邦学习如何在去中心化的数据源上训练 AI 模型,以保持隐私和安全,尤其是在医疗等敏感领域。

7220

OpenAI 漏洞赏金计划公告

OpenAI 与 Bugcrowd 合作推出了漏洞赏金计划,以奖励安全研究人员发现并修复其系统中的漏洞。

7221

Snorkel AI 与 Hugging Face 的企业基础模型集成

Snorkel AI 与 Hugging Face 合作,将 Hugging Face Inference Endpoints 集成到 Snorkel Flow 中,使企业能够轻松访问并适配超过 150,000 个开源基础模型。

7222

OpenAI 对 AI 安全的方案

OpenAI 采用多层次的安全策略,结合严格的部署前测试、迭代的真实世界部署以及持续的对齐研究,以降低强大 AI 系统带来的风险。

7223

StackLLaMA:使用 RLHF 训练 LLaMA 以用于 Stack Exchange

Hugging Face 推出 StackLLaMA,这是一款通过监督微调、奖励建模和人类反馈强化学习 (RLHF) 训练的模型,用于回答 Stack Exchange 的问题。

7224

Hugging Face伦理与社会通讯 #3:伦理开放倡议

Hugging Face宣布了新的伦理开放措施——包括六个伦理标签、标记系统以及受众引导元数据——以使开源机器学习更安全、更具包容性。

7225

在 Intel Sapphire Rapids CPU 上加速 Stable Diffusion 推理

Hugging Face 展示了如何在 Intel Sapphire Rapids CPU 上使用 Optimum Intel、OpenVINO、系统级调优、IPEX BF16 以及更快的调度器,将 Stable Diffusion 图像生成的时间从 32 秒缩短至约 5 秒。

7226

在 Habana Gaudi2 加速器上进行 BLOOMZ 推理

Hugging Face 演示了 Habana Gaudi2 加速器在 BLOOMZ 176B 模型上的推理速度快于 Nvidia A100 80GB,利用 Optimum Habana 库和 DeepSpeed‑inference 实现。

7227

使用 Hugging Face 与 Flower 的联邦学习

Hugging Face 演示了如何使用 Flower 框架在预训练的 distilBERT 模型上进行联邦学习,以在 IMDB 数据集上进行情感分析。

7228

OpenAI 3月20日 ChatGPT 中断与数据泄露分析

OpenAI 于 2023 年 3 月 20 日因开源库中的漏洞将 ChatGPT 下线,该漏洞导致部分活跃的 ChatGPT Plus 订阅者的聊天标题和付款信息被泄露。

7229

使用 Hugging Face Diffusers 训练 ControlNet

Hugging Face 通过 diffusers 库提供了完整的指南和训练脚本,使用户能够为 Stable Diffusion 训练自定义 ControlNet 模型,示例展示了如何创建一个 “Uncanny Faces” 姿态模型。

7230

ChatGPT 插件发布

OpenAI 为 ChatGPT 引入了插件,使模型能够访问实时信息、执行计算并与第三方服务集成,以扩展其功能并减少幻觉。

7231

Hugging Face Hub 改进的 Jupyter Notebook 支持

Hugging Face 为托管在 Hub 上的 Jupyter Notebook 引入了可读性更强的渲染,提升了机器学习从业者的可复现性和可访问性。

7232

GPT即GPT:大型语言模型对劳动力市场的影响

OpenAI的研究表明,约80%的美国劳动力可能至少有10%的工作任务受到大型语言模型的影响,使其成为通用技术。

7233

OpenAI GPT-4 公告及功能概述

OpenAI 宣布推出 GPT‑4,这款大型多模态模型在众多专业基准上实现了人类水平的表现,并已通过 ChatGPT、API 候补名单以及开源评估工具向外部提供。

7234

OpenAI 宣布为 Be My Eyes 推出基于 GPT‑4 的虚拟志愿者

OpenAI 将 GPT‑4 的视觉输入功能集成到 Be My Eyes 应用中,创建了一个能够描述、分析并就图像进行对话的虚拟志愿者,显著提升了盲人和低视力用户的视觉可访问性。

7235

Stripe GPT-4 集成案例研究

Stripe 在其平台上集成了 GPT-4,以自动化业务概述、通过文档分析提升开发者支持,并改进社区论坛的欺诈检测。

7236

Duolingo 整合 GPT-4 以实现高级语言学习

Duolingo 推出了 Duolingo Max,这一全新订阅层级提供基于 GPT-4 的角色扮演和“解释我的答案”功能,以实现沉浸式对话练习和情境语法反馈。

7237

可汗学院整合 GPT-4 为 Khanmigo AI 助手提供动力

可汗学院正在试点 Khanmigo,这是一款由 GPT-4 驱动的 AI 导师和教师助理,旨在提供个性化学习和教学支持。

7238

OpenAI 与冰岛政府合作,保护冰岛语

OpenAI 已与冰岛政府及私营企业合作,利用 GPT-4 和强化学习人类反馈(RLHF)在数字时代保护冰岛语。

7239

使用 Informer 的多变量概率时间序列预测

Hugging Face 已将 Informer 模型集成到 Transformers 库中,实现了高效的多变量概率时间序列预测,并降低了计算和内存复杂度。

7240

在 24GB 消费级 GPU 上对 20B LLM 进行 RLHF 微调

Hugging Face 发布了 TRL 与 PEFT 的集成,使得使用 8 位量化和低秩适配器在单个 24 GB GPU 上对 200 亿参数的语言模型进行强化学习微调。

7241

Kakao Brain ViT 与 ALIGN 模型发布,使用 COYO 700M 数据集

Kakao Brain 与 Hugging Face 发布了在全新 700 M 图文 COYO 数据集上训练的开源 ViT 与 ALIGN 视觉语言模型,提供了首个公开可用的 ALIGN 模型以及具备可复现训练数据的 ViT 模型。

7242

Diffusers 中的 ControlNet

Hugging Face 已将 ControlNet 集成到 Diffusers 库中,使得能够通过 Canny 边缘、深度图和人体姿态等条件,实现对 Stable Diffusion 图像生成的精确空间控制。

7243

使用机器学习进行灾害响应:afetharita 项目

Hugging Face 介绍了志愿者如何利用 Hugging Face 生态系统快速部署 OCR、NER 和遥感的机器学习模型,以帮助 2023 年 2 月土耳其地震的幸存者。

7244

Hugging Face Diffusers 伦理指南

Hugging Face 为 Diffusers 库推出了伦理框架,以指导技术决策和社区贡献,同时降低扩散模型可能带来的社会风险。

7245

Hugging Face 专家加速计划:Witty Works 案例研究

Witty Works 利用 Hugging Face 专家加速计划和 SetFit,构建了一个基于上下文的包容性语言分类器,在使用极少标注数据的情况下实现了高准确率。

7246

OpenAI 对 AGI 及其未来的规划

OpenAI 概述了一项逐步部署 AI 系统的策略,以便社会能够适应,强调需要加强对齐研究、全球治理以及对生存风险的审慎态度。

7247

Swift Diffusers for Mac 1.1 发布

Hugging Face 已发布 Diffusers for Mac 1.1 版,这是一款利用 Core ML 加速 Apple Silicon 上 Stable Diffusion 的原生开源应用,在部分硬件配置下可实现最高 2 倍的生成速度提升。

7248

大语言模型的红队测试

Hugging Face 概述了红队测试在识别 LLM 漏洞、预防有害输出方面的关键作用,强调需要协作且自适应的评估方法。

7249

Fetch AI 基础设施迁移:使用 Hugging Face 和 AWS 整合工具

Fetch 通过从第三方 AI “黑箱”迁移到由 Hugging Face 和 AWS 支持的内部机器学习管道,将开发时间缩短了 30%,处理延迟降低了 50%。

7250

Hugging Face 与 AWS 的 AI 可访问性战略合作伙伴关系

Hugging Face 与 AWS 扩大了战略合作,通过将 Hugging Face 模型与 AWS 基础设施及专用 ML 加速器相结合,使生成式 AI 更加民主化。