归档 · 11 个实验室 · 3,060 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

2551

Hugging Face LLM 推理容器 适用于 Amazon SageMaker

Hugging Face 推出了一个专门构建的 LLM 推理容器(DLC),适用于 Amazon SageMaker,由 Text Generation Inference (TGI) 提供动力,以实现开源大型语言模型的高性能部署。

2552

OpenAI 民主输入 AI 计划

OpenAI 启动了一项资助计划,资助十项每项 100,000 美元的实验,旨在开发用于决定 AI 系统应遵循规则的民主程序。

2553

使用 NNCF 和 🤗 Optimum 优化 Intel CPU 上的 稳定扩散

Hugging Face 宣布了一种使用 NNCF 和 Optimum 对 稳定扩散 进行量化并应用 令牌合并 的工作流程,在 Intel CPU 上实现了最高 5.1 倍的推理速度提升以及模型占用空间减少 4 倍。

2554

Hugging Face 在 Azure Machine Learning 上的模型目录

Hugging Face 和 Microsoft 在 Azure Machine Learning Studio 内推出了 Hugging Face Hub 模型目录的原生集成,以简化在安全的 Azure 基础设施上部署开源模型。

2555

Hugging Face 4 位量化与 QLoRA 发布

Hugging Face 宣布通过 bitsandbytes 支持 4 位量化,并推出 QLoRA 方法,使得在消费级 GPU 上即可进行大语言模型的推理和适配器微调。

2556

Anthropic 可解释性愿景研究计划

Anthropic概述了其在机械可解释性方面的长期愿景,重点是通过解决叠加挑战来实现对大规模神经网络的分析。

2557

Anthropic Circuits Updates May 2023

Anthropic 2023 年 5 月的可解释性更新涵盖了对多智能体系统故障、工人再培训计划证据以及 Claude 研究版本在 Riemann zeta function 上的进展的研究。

2558

使用 InstructPix2Pix 对 Stable Diffusion 进行指令微调

Hugging Face 探索将 InstructPix2Pix 扩展,以通过多任务指令微调方法教会 Stable Diffusion 遵循特定的图像转换和低层处理指令。

2559

Hugging Face Safetensors 安全审计与默认采用

在 Trail of Bits 的安全审计确认未发现导致任意代码执行的关键缺陷后,Hugging Face、EleutherAI 和 Stability AI 正在将 safetensors 作为默认模型保存格式进行迁移。

2560

Hugging Face 与 IBM 在 watsonx.ai 的合作

Hugging Face 与 IBM 合作,将 Hugging Face 开源库和模型集成到 watsonx.ai 中,watsonx.ai 是一个用于训练、调优和部署基础模型的企业 AI 工作室。

2561

Anthropic 融资 4.5 亿美元完成 C 轮,旨在扩大可靠 AI 产品的规模

Anthropic 宣布完成由 Spark Capital 领投的 4.5 亿美元 C 轮融资,旨在加速 Claude 助手的开发,扩大产品阵容,并为 AI 安全研究提供资金。

2562

OpenAI 超级智能治理提案

OpenAI 提出一个由国际协调、类似 IAEA 的全球监管机构以及先进安全研究组成的三大支柱框架,以管理超级智能。

2563

Q8-Chat:在 Intel Xeon CPU 上实现高效生成式 AI

Hugging Face 与 Intel 展示,使用 SmoothQuant 将 LLM 压缩为 8 位整数,可在单插槽 Intel Xeon CPU 上高效运行高质量的聊天体验。

2564

大规模近似去重背后的 BigCode

Hugging Face 详细说明了在 BigCode 项目中使用 MinHash 和局部敏感哈希(LSH)进行大规模近似去重,展示了去除近似重复数据能够提升模型性能和训练效率。

2565

Anthropic 与 Zoom 的合作伙伴关系与投资

Anthropic 与 Zoom 已达成合作伙伴关系,将 Claude AI 集成到 Zoom 的企业协作产品中,且 Zoom Ventures 已投资 Anthropic。

2566

RWKV 架构集成到 Hugging Face Transformers

Hugging Face 宣布将 RWKV RNN‑Transformer 混合模型集成到 Transformers 库中,使开源的长上下文语言模型能够兼具 RNN 的高效性和 Transformer 的性能。

2567

在 AMD GPU 上使用 ROCm 运行 Vicuna 13B

Hugging Face 提供了一份技术指南,介绍如何在单个 AMD GPU 上使用 ROCm 和 GPTQ 4 位量化部署 Vicuna 13B 开源聊天机器人,将内存需求从 28GB 降至 7.52GB。

2568

Hugging Face 入选 CNIL 增强支持计划

Hugging Face 被法国数据保护机构(CNIL)选入其增强支持计划,以提升在 AI 开发中数据保护和 GDPR 合规的实施。

2569

Hugging Face 低延迟文本生成的辅助生成

Hugging Face 推出了辅助生成,这是一种解码方法,使用更小的助手模型预测候选标记,然后由更大的模型进行验证,从而在某些硬件配置下将延迟降低至最高 10 倍。

2570

Anthropic 宣布为 Claude 提供 100K Token 上下文窗口

Anthropic 将 Claude 的上下文窗口从 9K 扩展到 100K tokens,使模型能够在不到一分钟的时间内摄取并分析数百页的文本。

2571

OpenAI 使用 GPT‑4 发布 GPT‑2 自动神经元解释数据集

OpenAI 宣布了一种使用 GPT‑4 为 GPT‑2 中每个神经元生成并评分自然语言解释的方法,并向研究社区发布了相应的数据集、查看器和代码。

2572

使用 StarCoder 创建编码助手 – 摘要

2573

Claude 的宪法:通过实现宪法 AI 进行模型对齐

Anthropic 介绍了宪法 AI,这是一种通过使用一套明确的书面原则而非仅仅依赖隐式人类反馈来训练 Claude 变得有用、诚实且无害的方法。

2574

深入文本到视频模型

Hugging Face 提供了文本到视频生成模型演进的技术概览,详细阐述了从 GAN 到 Transformer 再到 Diffusion 架构的转变,并突出时间一致性和数据稀缺的独特挑战。

2575

StarCoder 发布说明

Hugging Face 与 ServiceNow 的 BigCode 合作发布了 StarCoder 和 StarCoderBase,这两款 15B 参数的代码 LLM 在许可宽松的数据上进行训练,在多个编程基准上超越了多种开放和闭源模型。

2576

Anthropic 研究:分布式表示、组合与叠加

Anthropic 阐明了分布式表示中组合与叠加之间的区别,解释了这两种机制如何影响神经网络中的泛化能力和线性可计算性。

2577

Hugging Face Unity API 安装与使用指南

Hugging Face Unity API 允许开发者通过专用的包和 API 向导,将 Hugging Face 推理 API 模型集成到 Unity 项目中。

2578

使用 Hugging Face Transformers、TensorFlow 和 TPU 训练语言模型

Hugging Face 提供了一套可扩展的端到端指南,使用 TensorFlow 和 TPU pod 从头训练掩码语言模型,利用 XLA 兼容性实现高性能计算。

2579

Databricks 与 Hugging Face 集成 Apache Spark 加速 LLM 训练

Databricks 通过 Dataset.from_spark() 函数在 Hugging Face Datasets 中引入了一流的 Apache Spark 支持,将大规模模型训练和调优的数据加载时间降低了最高 40%。

2580

在免费版 Google Colab 上使用 Diffusers 运行 DeepFloyd IF

Hugging Face 展示了如何通过 8 位量化、模块化管道加载以及 Diffusers 集成的优化,在免费 Google Colab 笔记本上运行开源的 DeepFloyd IF 文本到图像模型。

2581

Anthropic 与 Scale 合作伙伴关系,助力企业级生成式 AI

Anthropic 已与 Scale 合作,将 Claude AI 助手集成到 Scale 的平台中,为企业提供部署工具、提示工程和安全的数据集成。

2582

OpenAI 为 ChatGPT 引入全新数据管理控制

OpenAI 引入了一项新设置,可禁用聊天历史以防止在用户对话上进行模型训练,同时计划推出 ChatGPT Business 订阅和全新数据导出工具。

2583

Hugging Face推出中文语言博客,支持全球AI社区

Hugging Face 已推出专门的中文语言博客(hf.co/blog/zh),提供翻译的技术资源,促进与中国 AI 社区更深入的合作。

2584

在 Hugging Face Spaces 上托管 Unity 游戏

Hugging Face Spaces 可以通过使用 Static HTML 模板和 WebGL 构建目标来托管可玩的 Unity 游戏。

2585

Anthropic 关于增加 NIST AI 测量资金的提案

Anthropic 建议雄心勃勃地为美国国家标准与技术研究院 (NIST) 提供资金,以开发标准化的 AI 测量工具和安全阈值,他们认为这是有效 AI 监管的前提条件。

2586

使用 AWS Inferentia2 加速 Hugging Face Transformers

Hugging Face 与 AWS 已针对 AWS Inferentia2 这一专用推理加速器对 Transformers 进行优化,显著降低延迟并提升大规模模型的吞吐量。

2587

使用 Transformers 进行图分类

Hugging Face 演示了如何在 Transformers 库中使用 Graphormer 模型进行图分类,涵盖数据格式化、预处理和微调。

2588

使用 Substra 创建隐私保护的 AI

Hugging Face 和 Substra 强调了联邦学习如何在去中心化的数据源上训练 AI 模型,以保持隐私和安全,尤其是在医疗等敏感领域。

2589

OpenAI 漏洞赏金计划公告

OpenAI 与 Bugcrowd 合作推出了漏洞赏金计划,以奖励安全研究人员发现并修复其系统中的漏洞。

2590

Snorkel AI 与 Hugging Face 的企业基础模型集成

Snorkel AI 与 Hugging Face 合作,将 Hugging Face Inference Endpoints 集成到 Snorkel Flow 中,使企业能够轻松访问并适配超过 150,000 个开源基础模型。

2591

OpenAI 对 AI 安全的方案

OpenAI 采用多层次的安全策略,结合严格的部署前测试、迭代的真实世界部署以及持续的对齐研究,以降低强大 AI 系统带来的风险。

2592

StackLLaMA:使用 RLHF 训练 LLaMA 以用于 Stack Exchange

Hugging Face 推出 StackLLaMA,这是一款通过监督微调、奖励建模和人类反馈强化学习 (RLHF) 训练的模型,用于回答 Stack Exchange 的问题。

2593

Hugging Face伦理与社会通讯 #3:伦理开放倡议

Hugging Face宣布了新的伦理开放措施——包括六个伦理标签、标记系统以及受众引导元数据——以使开源机器学习更安全、更具包容性。

2594

在 Intel Sapphire Rapids CPU 上加速 Stable Diffusion 推理

Hugging Face 展示了如何在 Intel Sapphire Rapids CPU 上使用 Optimum Intel、OpenVINO、系统级调优、IPEX BF16 以及更快的调度器,将 Stable Diffusion 图像生成的时间从 32 秒缩短至约 5 秒。

2595

在 Habana Gaudi2 加速器上进行 BLOOMZ 推理

Hugging Face 演示了 Habana Gaudi2 加速器在 BLOOMZ 176B 模型上的推理速度快于 Nvidia A100 80GB,利用 Optimum Habana 库和 DeepSpeed‑inference 实现。

2596

使用 Hugging Face 与 Flower 的联邦学习

Hugging Face 演示了如何使用 Flower 框架在预训练的 distilBERT 模型上进行联邦学习,以在 IMDB 数据集上进行情感分析。

2597

OpenAI 3月20日 ChatGPT 中断与数据泄露分析

OpenAI 于 2023 年 3 月 20 日因开源库中的漏洞将 ChatGPT 下线,该漏洞导致部分活跃的 ChatGPT Plus 订阅者的聊天标题和付款信息被泄露。

2598

使用 Hugging Face Diffusers 训练 ControlNet

Hugging Face 通过 diffusers 库提供了完整的指南和训练脚本,使用户能够为 Stable Diffusion 训练自定义 ControlNet 模型,示例展示了如何创建一个 “Uncanny Faces” 姿态模型。

2599

ChatGPT 插件发布

OpenAI 为 ChatGPT 引入了插件,使模型能够访问实时信息、执行计算并与第三方服务集成,以扩展其功能并减少幻觉。

2600

Hugging Face Hub 改进的 Jupyter Notebook 支持

Hugging Face 为托管在 Hub 上的 Jupyter Notebook 引入了可读性更强的渲染,提升了机器学习从业者的可复现性和可访问性。