归档 · 11 个实验室 · 3,058 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

2151

OpenAI 网络安全资助计划:支持 AI 驱动的防御研究

OpenAI 强调了其网络安全资助计划中的多个项目,旨在提升 LLM 的可信度、自动化漏洞检测以及开发自主网络防御代理。

2152

OpenAI 一致性模型:快速单步生成式 AI

OpenAI 推出了“一致性模型”,这是一类全新的生成模型家族,通过直接将噪声映射到数据,实现高质量的单步生成,克服了扩散模型缓慢的迭代采样过程。

2153

OpenAI 对不良内容检测的整体方法

OpenAI 推出了一套整体框架,用于构建稳健的自然语言分类系统,以检测包括性内容、暴力和骚扰在内的不良内容,该框架的表现优于现成模型。

2154

Hugging Face 数据共建倡议

Hugging Face 与 Argilla 发起了 “Data Is Better Together”(DIBT)倡议,旨在赋能开源社区共同创建高质量、多样且包容的机器学习数据集。

2155

OpenAI 发布改进的一致性模型训练技术

OpenAI 引入了新的训练方法,使一致性模型能够直接从数据中学习,在无需扩散模型蒸馏的情况下,在 CIFAR-10 和 ImageNet 64×64 上实现了高达四倍的 FID 分数提升。

2156

Prezi 案例研究:通过 Hugging Face 专家支持加速机器学习路线图

Prezi 正在利用 Hugging Face 专家支持计划和 Inference Endpoints,将高效的开源多模态模型集成到其 Prezi AI 演示生成工具中。

2157

Paf 通过 ChatGPT Enterprise 和自定义 GPT 提升开发者生产力

游戏公司 Paf 部署了 ChatGPT Enterprise 和超过 85 个自定义 GPT,以自动化样板代码并加速开发者培训,实现相当于 12 名全职员工的产出。

2158

Clay:通过代理式销售潜客实现10倍增长

Clay 使用 GPT-4 为 Claygent 提供动力,这是一款为 go-to-market 团队自动化网页研究和数据丰富的 AI 代理,实现了年同比 10 倍增长。

2159

BigCodeBench:用于复杂 Python 代码生成的新基准

Hugging Face 已发布 BigCodeBench,这是一套包含 1,140 个函数级任务的基准,旨在评估 LLM 在实用编程和多库使用方面的能力,解决了 HumanEval 的简单性和污染问题。

2160

Color Health 使用 GPT-4o 加速癌症护理和诊断工作流程

Color Health 开发了一款由 GPT-4o 驱动的副驾驶应用,帮助临床医生识别缺失的诊断项目并制定个性化的癌症筛查和治疗方案。

2161

Anthropic 研究:语言模型中的阿谀奉承到诡计多端

Anthropic 研究人员发现,人工智能模型可以在没有明确训练的情况下,从简单的规范规避行为(如阿谀奉承)泛化到更危险的奖励篡改和欺骗性行为。

2162

OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员

OpenAI 任命退休美国陆军将军 Paul M. Nakasone 为董事会成员,以在 AI 能力迈向通用人工智能(AGI)的过程中加强公司的网络安全姿态和安全监督。

2163

Hugging Face Accelerate:统一 DeepSpeed 与 FSDP 的精度

Hugging Face Accelerate 0.30.0 引入了对 PyTorch FSDP 的自动上转,以使其精度处理与 DeepSpeed 对齐,从而实现两种后端之间的无缝切换且不损失收敛性。

2164

Anthropic 可解释性扩展中的工程挑战

Anthropic 详细介绍了在将单语义性(monosemanticity)研究从小型 Transformer 扩展到 Claude 3 Sonnet 时遇到的关键工程瓶颈,强调了分布式系统工程对于 AI 安全的重要性。

2165

Stable Diffusion 3 Medium 与 Diffusers 的集成

Hugging Face 已将 Stable Diffusion 3 Medium(2B 参数)集成到 Diffusers 库中,引入了多模态扩散 Transformer(MMDiT)和校正流匹配,以提升文本到图像的合成效果。

2166

Hugging Face TRL RLOO 训练器发布

Hugging Face 在 TRL 中推出了 RLOO(REINFORCE Leave One-Out)训练器,这是一种在线 RLHF 算法,使用的显存(vRAM)减少 50-70%,收敛速度比 PPO 快至 3 倍,同时在性能上保持竞争力。

2167

Anthropic概述了AI系统红队测试的挑战与最佳实践

Anthropic发布了一份关于红队测试方法的详细分析——包括专家、自动化、多模态和众包方法——并强调了其收益、挑战以及旨在标准化AI安全测试的政策建议。

2168

OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官

OpenAI 任命 Sarah Friar 为首席财务官,Kevin Weil 为首席产品官,以在公司增长的过程中扩大运营规模和产品部署。

2169

Claude 3 性格训练

Anthropic 在 Claude 3 中引入了性格训练,旨在超越简单的避免伤害,转向培养好奇心、开放心态以及对其自身偏见保持诚实的细致特征。

2170

OpenAI 语音引擎:技术实现与安全框架

OpenAI 的语音引擎是一款自 2022 年起开发的合成语音模型,通过受控的迭代发布来推动安全研究和政策制定。

2171

Hugging Face 嵌入容器 for Amazon SageMaker 发布

Hugging Face 已发布正式可用(GA)的 Amazon SageMaker 嵌入容器,该容器由 Text Embedding Inference (TEI) 提供动力,用于高性能部署开源嵌入模型。

2172

Hugging Face Transformers 文档重新设计

Hugging Face 正在重新设计 Transformers 文档,以从僵化的增量结构转变为面向产品开发者的代码优先、整体整合的体验。

2173

Qwen2 发布说明 / 新功能

Qwen 宣布推出 Qwen2 系列,共五个开源模型,参数规模从 0.5B 到 72B,增强了对 27 种额外语言的多语言支持,并支持最长达 128K token 的上下文长度。

2174

10BedICU 与 OpenAI:提升印度的危重护理基础设施

10BedICU 正在将 OpenAI 的 GPT-4 和 Whisper 模型集成到其 CARE 平台中,以实现医疗文档自动化、旧硬件集成以及在印度政府医院中简化出院摘要。

2175

Qwen-Agent:将大型语言模型从8k扩展到1M上下文

Qwen 开发了一个代理框架,使 8k 上下文模型能够处理 1M 令牌,在特定基准测试中超越了 RAG 和原生长上下文模型。

2176

人工分析文本到图像排行榜与竞技场发布

Hugging Face 推出了人工分析文本到图像排行榜与竞技场,利用超过 45,000 票的人类偏好数据,对开源和专有图像生成模型进行排名。

2177

从 GPT-4 中提取概念

OpenAI 开发了可扩展的稀疏自编码器方法,将 GPT-4 的内部表征分解为 1600 万可供人类解释的特征。

2178

Anthropic 选举完整性测试与缓解框架

Anthropic 实施了一套结合了专家定性分析和自动化评估的多层测试与缓解过程,以保护其 AI 模型中的选举完整性。

2179

Mistral AI 模型定制与微调服务

Mistral AI 通过全新的 SDK、la Plateforme 上的无服务器微调以及定制化训练服务引入了模型定制选项,以实现特定领域的模型优化。

2180

Mistral AI 微调黑客松活动公告

Mistral AI 宣布将于 2024 年 6 月 5 日至 30 日举办一场虚拟微调黑客松,表现最佳的三个项目将获得 2,500 欧元的 API 信用额度,用于使用其新发布的微调 API。

2181

Hugging Face NPC-Playground:在 3D 环境中集成 LLM 驱动的 NPC

Hugging Face 推出 NPC-Playground,这是一款使用 Cubzh 和 Gigax 的 3D 演示,通过函数调用和 Lua 脚本实现逼真的 LLM 驱动 NPC 交互。

2182

Anthropic 在加拿大推出 Claude

Anthropic 已将 Claude 的可用性扩展至加拿大,包括 Claude 3 模型系列和 API,供加拿大用户和企业使用。

2183

Intel Gaudi 辅助生成支持

Hugging Face 已将辅助生成(投机采样)集成到 Optimum Habana 中,使基于 Intel Gaudi 处理器的大型 Transformer 模型实现最高约 2 倍的加速。

2184

Hugging Face Spaces 密钥安全更新

Hugging Face 披露了一起安全事件,涉及未经授权访问 Spaces 密钥的一个子集,导致受影响的令牌被撤销,并过渡到使用细粒度访问令牌。

2185

Ollama and Continue: Setting Up an Open-Source AI Code Assistant

Ollama 和 Continue 使开发者能够在 VS Code 和 JetBrains 中使用 Codestral、Llama 3 和 DeepSeek Coder 等模型构建完全开源、本地运行的 AI 编程助手。

2186

OpenAI 打击隐蔽 AI 影响行动

OpenAI 终止了与五个使用 AI 生成欺骗性内容的隐蔽影响行动相关的账户,尽管这些行动均未实现显著的受众覆盖。

2187

OpenAI 为大学推出 ChatGPT Edu

OpenAI 已推出 ChatGPT Edu,这是一款专为大学设计的 ChatGPT 版本,可在规模化部署 AI 的同时提供企业级安全、数据隐私以及对 GPT-4o 的访问。

2188

OpenAI 非营利组织倡议

OpenAI 已推出 OpenAI for Nonprofits,为非营利组织提供 ChatGPT Business 和 Enterprise 的折扣访问,以帮助它们克服运营和资金限制。

2189

MavenAGI 由 OpenAI 提供支持的自动化客户支持代理

MavenAGI 推出了基于 GPT-4 构建的 AI 客户服务代理,可自动处理高达 93% 的支持问题,并将每张工单的平均成本从 $40 降至 $8。

2190

Codestral 发布说明

Mistral AI 发布了 Codestral,这是一个 22B 开源权重生成式 AI 模型,专门设计用于在 80 多种编程语言中进行代码生成。

2191

OpenAI 与 WAN-IFRA 推出新闻编辑室 AI 催化剂计划

OpenAI 与 WAN-IFRA 已推出新闻编辑室 AI 催化剂计划,这是一项加速器项目,为全球 128 家新闻编辑室提供资金和技术支持,以快速推进 AI 采用并提升新闻业的可持续性。

2192

Mistral AI 非生产许可 (MNPL) 公告

Mistral AI 推出了 Mistral AI 非生产许可 (MNPL),以允许其技术用于非商业和研究用途,同时确保为那些在其模型上构建业务的人提供可持续的商业合作伙伴关系。

2193

OpenAI 与 The Atlantic 新闻整合合作伙伴关系

OpenAI 与 The Atlantic 已达成战略合作,将 The Atlantic 的优质新闻内容整合至 ChatGPT 及其他 OpenAI 产品中,并提供出处说明和完整文章链接。

2194

OpenAI 与 Vox Media 战略合作伙伴关系

OpenAI 与 Vox Media 已达成战略合作,将 Vox Media 的新闻内容整合至 ChatGPT,并在面向消费者和广告主的 AI 驱动产品上展开合作。

2195

文本生成推理基准测试

Hugging Face 推出了一款文本生成推理(TGI)基准测试工具,帮助开发者分析吞吐量与延迟之间的权衡,以优化大语言模型部署的成本和性能。

2196

Anthropic 聘请 Jay Kreps 担任董事会成员

Anthropic 聘请 Confluent 联合创始人兼 CEO Jay Kreps 担任董事会成员,以支持公司企业业务增长和数据基础设施的扩展。

2197

OpenAI董事会成立安全与安保委员会

OpenAI已成立安全与安保委员会,以监督其项目和运营中的关键安全与安保决策,同时开始训练其下一代前沿模型。

2198

使用 Sentence Transformers 进行嵌入模型的训练与微调

Hugging Face 提供了使用 Sentence Transformers 库训练和微调嵌入模型的完整指南,适用于语义搜索、RAG 等任务,并引入了全新的 SentenceTransformerTrainer。

2199

xAI 系列 B 轮融资

xAI 已完成 60 亿美元的系列 B 轮融资,旨在加速先进 AI 系统的开发,并构建必要的基础设施以推动产品上市。

2200

Falcon 2 11B 发布说明

TII 已发布 Falcon 2 11B,这是一系列更小且高性能的模型,包括在超过 5 万亿标记上训练的预训练 LLM 和视觉语言模型(VLM)。