归档 · 11 个实验室 · 3,058 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

2201

CyberSecEval 2:评估大型语言模型的网络安全风险

Hugging Face 和 Meta 推出了 CyberSecEval 2,这是一套用于评估 LLM 对代码解释器滥用、攻击性网络安全能力以及提示注入攻击易感性的综合框架。

2202

OpenAI 与 News Corp 多年全球合作伙伴关系

OpenAI 与 News Corp 已签署多年协议,允许 OpenAI 将 News Corp 来自《华尔街日报》和《泰晤士报》等主要出版物的当前及存档内容整合到其产品中,以提升信息可靠性。

2203

Hugging Face AWS Inferentia2 集成

Hugging Face 已扩展对 AWS Inferentia2 的支持,使得可以通过 Amazon SageMaker 部署超过 100,000 个模型,并为 Hugging Face 推理端点引入了新的 Inf2 实例选项。

2204

OpenAI 安全实践

OpenAI 详细阐述了用于开发和部署前沿 AI 模型的十项核心安全实践,强调以科学方法将安全融入模型生命周期的每个阶段。

2205

Hugging Face 与 Microsoft 战略合作更新(2024年5月)

Hugging Face 与 Microsoft 扩大了战略合作,将流行的开源模型集成到 Azure 模型目录,支持 Azure 上的 AMD MI300X GPU,并为 Hugging Face Spaces 引入了 VS Code 集成。

2206

Hugging Face 对 AMD Instinct MI300 GPU 的集成

Hugging Face 为 AMD Instinct MI300 GPU 提供了一流的集成,使 Llama 3 70B 的推理速度提升至最高 3 倍,微调速度提升至 2 倍,相较于 MI250。

2207

Dell Enterprise Hub:本地 AI 部署与训练

Hugging Face 与 Dell 联手推出 Dell Enterprise Hub,这是一套简化在 Dell 硬件上本地训练和部署开源大型语言模型的平台。

2208

Hugging Face Spaces 开发模式发布

Hugging Face 推出了 Spaces 开发模式,允许 PRO 订阅者通过 VS Code 或 SSH 进行实时代码编辑,无需为每一次更改进行 git 推送。

2209

Anthropic 使用大规模字典学习技术绘制 Claude 3 Sonnet 的内部概念图谱

Anthropic 公布其从 Claude 3 Sonnet 中提取出数百万个可解释特征,揭示了概念在生产级大语言模型内部的表征方式,并证明操控这些特征可改变模型行为,这是迈向更安全人工智能的重要一步。

2210

Krishna Rao 担任 Anthropic 首席财务官

Anthropic 已任命 Krishna Rao 为首席财务官,以在企业增长和国际化扩张的关键时期引领财务战略与运营。

2211

Anthropic 负责任缩放政策反思

Anthropic 提供其负责任缩放政策 (RSP) 的运营更新,详细说明了 AI 安全等级 (ASL) 的实施情况以及用于缓解前沿模型灾难性风险的框架。

2212

支持 Ollama 的 Firebase Genkit

Google 发布了 Firebase Genkit,这是一个用于构建 AI 驱动应用的开源框架,其特点是原生支持 Ollama,可以在本地运行 Google 的 Gemma 模型。

2213

OpenAI ChatGPT 语音选择流程

OpenAI 详细说明了为 ChatGPT 选拔五位专业配音演员的五个月配音过程,并澄清语音 “Sky” 并非旨在模仿 Scarlett Johansson。

2214

ChatGPT 数据分析改进 2024年5月

OpenAI 在 ChatGPT 中推出了数据分析的增强功能,包括直接云存储集成、交互式表格和可定制图表,基于 GPT-4o 提供支持。

2215

OpenAI 与 Reddit 合作伙伴关系

OpenAI 与 Reddit 已合作,将实时 Reddit 内容集成到 ChatGPT 中,并实现 OpenAI 的 AI 模型,以提升 Reddit 的用户和版主功能。

2216

Hugging Face KV 缓存量化

Hugging Face 在 Transformers 库中引入了 KV 缓存量化,以在对模型质量影响最小的情况下降低长上下文文本生成的内存使用。

2217

Canva Magic Studio 与 OpenAI 的集成

Canva 已集成 OpenAI 的 GPT-4 和 API,为其 Magic Studio AI 套件提供动力,该套件已被使用超过 50 亿次,以简化非专业创作者的设计。

2218

Mike Krieger 担任 Anthropic 首席产品官

Anthropic 已任命 Instagram 联合创始人兼前 CTO Mike Krieger 为首席产品官,负责领导产品工程、管理和设计。

2219

OpenAI 领导层变动:Ilya Sutskever 离职,Jakub Pachocki 任命为首席科学家

OpenAI 宣布联合创始人 Ilya Sutskever 将离开公司,Jakub Pachocki 被任命为新任首席科学家,负责领导面向 AGI 的研究工作。

2220

介绍开放阿拉伯语大型语言模型排行榜

Hugging Face 与技术创新研究所推出了开放阿拉伯语大型语言模型排行榜(OALL),为阿拉伯语大型语言模型提供了一个专门的、开放的评估平台。

2221

PaliGemma 视觉语言模型发布

Google 已发布 PaliGemma,这是一系列结合 SigLIP-So400m 和 Gemma-2B 的开源视觉语言模型,可实现图像字幕、视觉问答和目标检测等任务。

2222

Hugging Face 与 LangChain 推出 langchain_huggingface 合作包

Hugging Face 与 LangChain 已发布 langchain_huggingface,这是一个共同维护的合作包,旨在简化 Hugging Face 模型在 LangChain 生态系统中的集成。

2223

Claude 现已在欧盟可用 – Anthropic 扩大了其 AI 助手的访问权限

Anthropic 宣布,其 AI 助手 Claude 现在可以通过 Claude.ai、iOS 应用和 Team 计划面向欧洲的个人和企业提供,将 Claude 3 模型系列扩展到了欧盟市场。

2224

OpenAI GPT-4o 发布说明

OpenAI 已发布 GPT-4o,这是一款在文本、视觉和音频上端到端训练的全能模型,能够实现自然的人机交互,并具有人类般的响应延迟。

2225

OpenAI 春季更新:推出 GPT-4o

OpenAI 已发布 GPT-4o,这款能够在音频、视觉和文本之间进行实时推理的新旗舰模型,同时向 ChatGPT 免费用户扩展了高级功能。

2226

OpenAI GPT-4o 发布及 ChatGPT 免费层增强

OpenAI 已推出 GPT-4o,这款旗舰模型提供 GPT-4 级别的智能,具备更快的速度和跨文本、语音、视觉的多模态能力,现已对免费和付费用户均可使用。

2227

Transformers Agents 2.0 release notes / what's new

Hugging Face 推出了 Transformers Agents 2.0,这是一个模块化智能体框架,其特点是具备迭代式问题解决智能体,并且使用 Llama-3-70B-Instruct 在 GAIA 基准测试中表现出高性能。

2228

Qwen-Max-0428 发布说明

Qwen 已发布 Qwen-Max-0428,这是一款指令微调的聊天模型,在 MT-Bench 上优于 Qwen1.5-110B-Chat,并在 Chatbot Arena 排行榜中位列前十。

2229

Anthropic 使用政策更新 2024年6月

Anthropic 已将其《可接受使用政策》更新为新的《使用政策》,并于 2024年6月6日生效,针对选举完整性、高风险使用案例和生物识别数据分析引入了更严格的指南。

2230

使用 Intel Gaudi 2 和 Intel Xeon 构建成本高效的企业 RAG 应用

Hugging Face 演示了通过 OPEA 框架将 Intel Gaudi 2 加速器与 Intel Xeon CPU 结合使用,如何使企业能够构建相较于基于 H100 系统具有更高性价比的 RAG 应用。

2231

Hugging Face 企业中心现已在 AWS Marketplace 上提供

Hugging Face 已将 Enterprise Hub 与 AWS Marketplace 集成,使组织能够升级其账户并通过 AWS 账户直接管理计费。

2232

OpenAI 模型规范

OpenAI 推出了模型规范,这是一套由目标、规则和默认行为组成的框架,旨在标准化并透明地塑造 AI 模型在 OpenAI API 和 ChatGPT 中的行为。

2233

OpenAI 对数据和 AI 的方法

OpenAI 正在推出 Media Manager,让创作者能够控制其内容在 AI 训练中的使用,并详细阐述其多管齐下的数据来源策略,以在模型多样性与创作者权益之间取得平衡。

2234

OpenAI 内容来源与真实性倡议

OpenAI 正在采用 C2PA 开放标准进行数字内容认证,并开发内部工具,如图像检测分类器和音频水印,以帮助用户识别 AI 生成的内容。

2235

OpenAI 与 Stack Overflow API 合作伙伴关系

OpenAI 与 Stack Overflow 已合作,通过 OverflowAPI 将经过审查的技术数据集成到 OpenAI 模型和 ChatGPT 中,同时 Stack Overflow 将使用 OpenAI 模型开发 OverflowAI。

2236

Hugging Face 开放排行榜(针对希伯来语 LLM)

Hugging Face 推出了专门用于评估和提升希伯来语大型语言模型(LLM)的开放排行榜,旨在应对资源匮乏和形态复杂语言的挑战。

2237

人工分析 LLM 性能排行榜 在 Hugging Face

Hugging Face 已集成 Artificial Analysis LLM Performance Leaderboard,为 AI 工程师提供统一的度量体系,以比较 100 多个无服务器 LLM API 端点的质量、价格和速度。

2238

Hugging Face 推理端点 ASR 与说话人分离流水线

Hugging Face 推出了一款自定义推理处理程序,用于在推理端点上部署结合 Whisper ASR、Pyannote 分离和推测解码的模块化流水线。

2239

OpenAI 打击“Bad Grammar”俄罗斯关联的影响行动

OpenAI 禁止了一个名为“Bad Grammar”的俄罗斯关联网络,该网络使用 AI 模型自动生成跨多个国家的政治评论垃圾信息并在 Telegram 上发布。

2240

OpenAI 打击与中国有关的影响行动 “Spamouflage”

OpenAI 禁用了与名为 Spamouflage 的行动相关的账户,该行动是一个与中国有关的影响力宣传活动,利用 AI 生成内容并进行研究,以针对中国政府的批评者。

2241

OpenAI 打击俄罗斯‘Doppelganger’影响行动

OpenAI 禁止了四个与俄罗斯‘Doppelganger’影响行动相关的账户群组,这些账户使用 AI 生成多语言内容,针对欧洲和北美。

2242

OpenAI 零 Zeno 行动:与以色列关联的影响活动

OpenAI 禁止了由以色列政治宣传公司 STOIC 运营的一批账户,以阻止针对多个国家的 AI 生成影响行动。

2243

OpenAI 打击伊朗关联的影响行动 IUVM

OpenAI 封禁了与 IUVM 相关的账户,IUVM 是一个伊朗关联的影响网络,使用 AI 生成并翻译亲伊朗、反美和反以色列的内容。

2244

通过结构化生成提升提示一致性

Hugging Face 与 Dottxt 的研究表明,使用结构化生成来约束 LLM 输出可以降低性能差异,并提升在不同提示格式和示例顺序下的排名一致性。

2245

StarCoder2-15B-Instruct-v0.1 发布说明 / 新功能

Hugging Face 推出 StarCoder2-15B-Instruct-v0.1,这是首个使用完全透明且宽松的流水线进行全自我对齐的代码大语言模型,在 HumanEval 上超越了 CodeLlama-70B-Instruct。

2246

OpenAI 与《金融时报》战略合作伙伴关系

OpenAI 与《金融时报》已达成战略合作伙伴关系和许可协议,将归属的 FT 新闻内容整合到 ChatGPT 中,并为 FT 员工提供 ChatGPT Enterprise 访问权限。

2247

Anthropic Circuits Updates April 2024

Anthropic 2024 年 4 月的 Circuits 更新提供了关于可解释性、多智能体系统故障以及黎曼 zeta 函数下界突破的初步研究结果。

2248

Qwen1.5-110B 发布说明 / 新功能

Qwen 已发布 Qwen1.5-110B,这是 Qwen1.5 系列中首个参数量超过 1000 亿的模型,提供了与 Llama-3-70B 竞争的性能,并相较 Qwen1.5-72B 有显著提升。

2249

Moderna 与 OpenAI 的 AI 驱动药物研发合作

Moderna 已在整个组织内部署了 ChatGPT Enterprise,以加速 mRNA 药物的研发,并通过定制 GPT 优化业务运营。

2250

OpenAI 推出 ChatGPT 与 Whisper API

OpenAI 已发布 GPT-3.5 Turbo 和 Whisper API,为开发者提供显著的成本降低和高性能的语音转文本能力。