Falcon 模型发布及 Hugging Face 生态集成
Hugging Face 宣布了 Falcon 家族的开源 Apache‑2.0 语言模型,突出 Falcon‑40B 在 Open LLM 排行榜上的顶尖排名,并展示了如何使用 Hugging Face 工具运行、量化和微调这些模型。
AI 语音识别在 Unity 中
Hugging Face 提供了一份指南和 API,用于在 Unity 游戏中实现最先进的自动语音识别(ASR),以启用语音命令和 NPC 交互。
OpenAI网络安全资助计划
OpenAI 已启动 $1M 的网络安全资助计划,以赋能防御者并量化 AI 在网络安全中的作用,随后随着 GPT-5.3-Codex 的发布,演变为包含 额外 $10M 的 API 积分和面向网络的可信访问。
Hugging Face 开源 AI Game Jam 公告
Hugging Face 将于 2023 年 7 月 7 日至 9 日举办开源 AI Game Jam,以鼓励游戏开发者将开源生成式 AI 工具集成到他们的开发工作流和游戏功能中。
OpenAI 通过过程监督改进数学推理
OpenAI 通过奖励每一步正确的推理(过程监督)而不仅仅是最终答案(结果监督)来改进数学问题求解的方法,从而实现了最先进的性能和更好的 AI 对齐。
Hugging Face LLM 推理容器 适用于 Amazon SageMaker
Hugging Face 推出了一个专门构建的 LLM 推理容器(DLC),适用于 Amazon SageMaker,由 Text Generation Inference (TGI) 提供动力,以实现开源大型语言模型的高性能部署。
OpenAI 民主输入 AI 计划
OpenAI 启动了一项资助计划,资助十项每项 100,000 美元的实验,旨在开发用于决定 AI 系统应遵循规则的民主程序。
使用 NNCF 和 🤗 Optimum 优化 Intel CPU 上的 稳定扩散
Hugging Face 宣布了一种使用 NNCF 和 Optimum 对 稳定扩散 进行量化并应用 令牌合并 的工作流程,在 Intel CPU 上实现了最高 5.1 倍的推理速度提升以及模型占用空间减少 4 倍。
Hugging Face 在 Azure Machine Learning 上的模型目录
Hugging Face 和 Microsoft 在 Azure Machine Learning Studio 内推出了 Hugging Face Hub 模型目录的原生集成,以简化在安全的 Azure 基础设施上部署开源模型。
Hugging Face 4 位量化与 QLoRA 发布
Hugging Face 宣布通过 bitsandbytes 支持 4 位量化,并推出 QLoRA 方法,使得在消费级 GPU 上即可进行大语言模型的推理和适配器微调。
使用 InstructPix2Pix 对 Stable Diffusion 进行指令微调
Hugging Face 探索将 InstructPix2Pix 扩展,以通过多任务指令微调方法教会 Stable Diffusion 遵循特定的图像转换和低层处理指令。
Hugging Face Safetensors 安全审计与默认采用
在 Trail of Bits 的安全审计确认未发现导致任意代码执行的关键缺陷后,Hugging Face、EleutherAI 和 Stability AI 正在将 safetensors 作为默认模型保存格式进行迁移。
Hugging Face 与 IBM 在 watsonx.ai 的合作
Hugging Face 与 IBM 合作,将 Hugging Face 开源库和模型集成到 watsonx.ai 中,watsonx.ai 是一个用于训练、调优和部署基础模型的企业 AI 工作室。
OpenAI 超级智能治理提案
OpenAI 提出一个由国际协调、类似 IAEA 的全球监管机构以及先进安全研究组成的三大支柱框架,以管理超级智能。
Q8-Chat:在 Intel Xeon CPU 上实现高效生成式 AI
Hugging Face 与 Intel 展示,使用 SmoothQuant 将 LLM 压缩为 8 位整数,可在单插槽 Intel Xeon CPU 上高效运行高质量的聊天体验。
大规模近似去重背后的 BigCode
Hugging Face 详细说明了在 BigCode 项目中使用 MinHash 和局部敏感哈希(LSH)进行大规模近似去重,展示了去除近似重复数据能够提升模型性能和训练效率。
RWKV 架构集成到 Hugging Face Transformers
Hugging Face 宣布将 RWKV RNN‑Transformer 混合模型集成到 Transformers 库中,使开源的长上下文语言模型能够兼具 RNN 的高效性和 Transformer 的性能。
在 AMD GPU 上使用 ROCm 运行 Vicuna 13B
Hugging Face 提供了一份技术指南,介绍如何在单个 AMD GPU 上使用 ROCm 和 GPTQ 4 位量化部署 Vicuna 13B 开源聊天机器人,将内存需求从 28GB 降至 7.52GB。
Hugging Face 入选 CNIL 增强支持计划
Hugging Face 被法国数据保护机构(CNIL)选入其增强支持计划,以提升在 AI 开发中数据保护和 GDPR 合规的实施。
Hugging Face 低延迟文本生成的辅助生成
Hugging Face 推出了辅助生成,这是一种解码方法,使用更小的助手模型预测候选标记,然后由更大的模型进行验证,从而在某些硬件配置下将延迟降低至最高 10 倍。
OpenAI 使用 GPT‑4 发布 GPT‑2 自动神经元解释数据集
OpenAI 宣布了一种使用 GPT‑4 为 GPT‑2 中每个神经元生成并评分自然语言解释的方法,并向研究社区发布了相应的数据集、查看器和代码。
使用 StarCoder 创建编码助手 – 摘要
深入文本到视频模型
Hugging Face 提供了文本到视频生成模型演进的技术概览,详细阐述了从 GAN 到 Transformer 再到 Diffusion 架构的转变,并突出时间一致性和数据稀缺的独特挑战。
StarCoder 发布说明
Hugging Face 与 ServiceNow 的 BigCode 合作发布了 StarCoder 和 StarCoderBase,这两款 15B 参数的代码 LLM 在许可宽松的数据上进行训练,在多个编程基准上超越了多种开放和闭源模型。
Hugging Face Unity API 安装与使用指南
Hugging Face Unity API 允许开发者通过专用的包和 API 向导,将 Hugging Face 推理 API 模型集成到 Unity 项目中。
使用 Hugging Face Transformers、TensorFlow 和 TPU 训练语言模型
Hugging Face 提供了一套可扩展的端到端指南,使用 TensorFlow 和 TPU pod 从头训练掩码语言模型,利用 XLA 兼容性实现高性能计算。
Databricks 与 Hugging Face 集成 Apache Spark 加速 LLM 训练
Databricks 通过 Dataset.from_spark() 函数在 Hugging Face Datasets 中引入了一流的 Apache Spark 支持,将大规模模型训练和调优的数据加载时间降低了最高 40%。
在免费版 Google Colab 上使用 Diffusers 运行 DeepFloyd IF
Hugging Face 展示了如何通过 8 位量化、模块化管道加载以及 Diffusers 集成的优化,在免费 Google Colab 笔记本上运行开源的 DeepFloyd IF 文本到图像模型。
OpenAI 为 ChatGPT 引入全新数据管理控制
OpenAI 引入了一项新设置,可禁用聊天历史以防止在用户对话上进行模型训练,同时计划推出 ChatGPT Business 订阅和全新数据导出工具。
Hugging Face推出中文语言博客,支持全球AI社区
Hugging Face 已推出专门的中文语言博客(hf.co/blog/zh),提供翻译的技术资源,促进与中国 AI 社区更深入的合作。
在 Hugging Face Spaces 上托管 Unity 游戏
Hugging Face Spaces 可以通过使用 Static HTML 模板和 WebGL 构建目标来托管可玩的 Unity 游戏。
使用 AWS Inferentia2 加速 Hugging Face Transformers
Hugging Face 与 AWS 已针对 AWS Inferentia2 这一专用推理加速器对 Transformers 进行优化,显著降低延迟并提升大规模模型的吞吐量。
使用 Transformers 进行图分类
Hugging Face 演示了如何在 Transformers 库中使用 Graphormer 模型进行图分类,涵盖数据格式化、预处理和微调。
使用 Substra 创建隐私保护的 AI
Hugging Face 和 Substra 强调了联邦学习如何在去中心化的数据源上训练 AI 模型,以保持隐私和安全,尤其是在医疗等敏感领域。
OpenAI 漏洞赏金计划公告
OpenAI 与 Bugcrowd 合作推出了漏洞赏金计划,以奖励安全研究人员发现并修复其系统中的漏洞。
Snorkel AI 与 Hugging Face 的企业基础模型集成
Snorkel AI 与 Hugging Face 合作,将 Hugging Face Inference Endpoints 集成到 Snorkel Flow 中,使企业能够轻松访问并适配超过 150,000 个开源基础模型。
OpenAI 对 AI 安全的方案
OpenAI 采用多层次的安全策略,结合严格的部署前测试、迭代的真实世界部署以及持续的对齐研究,以降低强大 AI 系统带来的风险。
StackLLaMA:使用 RLHF 训练 LLaMA 以用于 Stack Exchange
Hugging Face 推出 StackLLaMA,这是一款通过监督微调、奖励建模和人类反馈强化学习 (RLHF) 训练的模型,用于回答 Stack Exchange 的问题。
Hugging Face伦理与社会通讯 #3:伦理开放倡议
Hugging Face宣布了新的伦理开放措施——包括六个伦理标签、标记系统以及受众引导元数据——以使开源机器学习更安全、更具包容性。
在 Intel Sapphire Rapids CPU 上加速 Stable Diffusion 推理
Hugging Face 展示了如何在 Intel Sapphire Rapids CPU 上使用 Optimum Intel、OpenVINO、系统级调优、IPEX BF16 以及更快的调度器,将 Stable Diffusion 图像生成的时间从 32 秒缩短至约 5 秒。
在 Habana Gaudi2 加速器上进行 BLOOMZ 推理
Hugging Face 演示了 Habana Gaudi2 加速器在 BLOOMZ 176B 模型上的推理速度快于 Nvidia A100 80GB,利用 Optimum Habana 库和 DeepSpeed‑inference 实现。
使用 Hugging Face 与 Flower 的联邦学习
Hugging Face 演示了如何使用 Flower 框架在预训练的 distilBERT 模型上进行联邦学习,以在 IMDB 数据集上进行情感分析。
OpenAI 3月20日 ChatGPT 中断与数据泄露分析
OpenAI 于 2023 年 3 月 20 日因开源库中的漏洞将 ChatGPT 下线,该漏洞导致部分活跃的 ChatGPT Plus 订阅者的聊天标题和付款信息被泄露。
使用 Hugging Face Diffusers 训练 ControlNet
Hugging Face 通过 diffusers 库提供了完整的指南和训练脚本,使用户能够为 Stable Diffusion 训练自定义 ControlNet 模型,示例展示了如何创建一个 “Uncanny Faces” 姿态模型。
ChatGPT 插件发布
OpenAI 为 ChatGPT 引入了插件,使模型能够访问实时信息、执行计算并与第三方服务集成,以扩展其功能并减少幻觉。
Hugging Face Hub 改进的 Jupyter Notebook 支持
Hugging Face 为托管在 Hub 上的 Jupyter Notebook 引入了可读性更强的渲染,提升了机器学习从业者的可复现性和可访问性。
GPT即GPT:大型语言模型对劳动力市场的影响
OpenAI的研究表明,约80%的美国劳动力可能至少有10%的工作任务受到大型语言模型的影响,使其成为通用技术。
OpenAI GPT-4 公告及功能概述
OpenAI 宣布推出 GPT‑4,这款大型多模态模型在众多专业基准上实现了人类水平的表现,并已通过 ChatGPT、API 候补名单以及开源评估工具向外部提供。
OpenAI 宣布为 Be My Eyes 推出基于 GPT‑4 的虚拟志愿者
OpenAI 将 GPT‑4 的视觉输入功能集成到 Be My Eyes 应用中,创建了一个能够描述、分析并就图像进行对话的虚拟志愿者,显著提升了盲人和低视力用户的视觉可访问性。
Stripe GPT-4 集成案例研究
Stripe 在其平台上集成了 GPT-4,以自动化业务概述、通过文档分析提升开发者支持,并改进社区论坛的欺诈检测。