归档 · 11 个实验室 · 3,054 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

1401

Hugging Face RiskRubric.ai 公告

Hugging Face 宣布了 RiskRubric.ai,这是一款标准化的风险评估平台,可在透明性、可靠性、安全性、隐私、安全性和声誉六大支柱上评估 AI 模型,以提供可比较的风险分数和字母等级。

1402

Hugging Face 将 Public AI 整合为推理提供商

Hugging Face 已将 Public AI 添加为受支持的推理提供商,实现对瑞士 AI 计划、AI Singapore 等机构的主权模型的无服务器访问。

1403

检测和降低 AI 模型中的策划行为

OpenAI 与 Apollo Research 开发了 deliberative alignment 方法,使前沿模型的隐蔽行为降低约 30 倍,从而应对模型假装对齐却暗中执行隐藏议程的 AI 策划风险。

1404

Anthropic 事后分析:影响 Claude 回复质量的基础设施缺陷

Anthropic 已解决了在 2025 年 8 月至 9 月期间断断续续降低 Claude 回复质量的三个独立的基础设施缺陷,并澄清了模型质量绝不会因服务器负载而有意降低。

1405

OpenAI 推出 Stargate UK 主权 AI 基础设施

OpenAI、NVIDIA 和 Nscale 合作推出 Stargate UK,这是一项 AI 基础设施计划,为 OpenAI 模型提供本地计算能力,以支持英国的主权 AI 能力。

1406

OpenAI 年龄预测与青少年安全保护

OpenAI 正在开发一套年龄预测系统,以自动对未满 18 岁的用户应用适龄政策,并将在 2025 年 9 月底前推出家长控制功能。

1407

OpenAI 青少年安全、自由与隐私框架

OpenAI 正在实施分层安全框架,将青少年保护置于隐私和自由之上,其中包括年龄预测系统,以对 18 岁以下用户执行更严格的内容边界。

1408

LeRobotDataset v3.0 发布说明 / 新功能

Hugging Face 发布了 LeRobotDataset v3.0,这是一种标准化的机器人学习数据集格式,能够实现大规模数据存储和流式处理,以支持数百万个 episode。

1409

OpenAI GPT-5-Codex 发布及 Codex 平台更新

OpenAI 已发布 GPT-5-Codex,这是一款针对代理式软件工程优化的模型,同时对 Codex CLI、IDE 扩展和云环境进行了重大更新。

1410

人们如何使用 ChatGPT:150 万次对话分析

OpenAI 与哈佛经济学家 David Deming 发布了一项关于 150 万次 ChatGPT 对话的研究,揭示 AI 的采用正在跨性别和收入层面实现民主化,同时主要作为日常实用指导和决策支持的工具。

1411

使用 Gradio 的可见水印

Hugging Face 引入了一种简便的方法,使用 Gradio 库为 AI 生成的图像、视频和文本添加可见水印,以提升合成内容的透明度。

1412

GPT-5-Codex 发布与安全附录

OpenAI 已发布 GPT-5-Codex,这是一款通过在真实任务上进行强化学习而优化用于代理式编码的 GPT-5 版本。

1413

Anthropic 2025 年 9 月经济指数报告

Anthropic 发布了 2025 年 9 月经济指数,揭示了通过 Claude 进行的 AI 采用在国家收入、美国各州产业结构以及企业与消费者使用之间存在显著差异,其中指令式自动化在交互中的占比从 27% 上升至 39%。

1414

Anthropic 经济指数 2025 年 9 月报告

Anthropic 2025 年 9 月经济指数报告指出,AI 采用在地理和企业层面存在显著不均衡,使用集中在高收入地区,且主要以编码和自动化任务为主。

1415

Claude Sonnet 4 集成至 Xcode 26

Anthropic 已在 Xcode 26 中正式推出 Claude Sonnet 4,允许 Apple 平台开发者直接在其 IDE 中访问 AI 驱动的编程智能。

1416

OpenAI 与美国 CAISI 和英国 AISI 的安全合作

OpenAI 与美国人工智能标准与创新中心(CAISI)以及英国人工智能安全研究所(UK AISI)合作,对代理式 AI 和生物安全防护措施进行深入的红队测试和漏洞检测。

1417

Claude Desktop Extensions 发布说明 / 更新内容

Anthropic 推出了 Desktop Extensions (.mcpb 文件),这是一种全新的打包格式,可实现 Claude Desktop 的 Model Context Protocol (MCP) 服务器的一键式安装,从而消除了手动配置和开发者工具的需求。

1418

Anthropic 与美国 CAISI 及英国 AISI 在 AI 安全防护方面的合作

Anthropic 已与美国 AI 标准与创新中心 (CAISI) 及英国 AI 安全研究所 (AISI) 合作,对其实验室内的 AI 系统进行压力测试并强化其安全性,特别针对其宪法分类器 (Constitutional Classifiers) 中的漏洞。

1419

Writer Palmyra-mini 家族发布

Writer 发布了 Palmyra-mini 家族,这是一套轻量级开源模型(1.5B 至 1.7B 参数),包括一个基础模型和两个针对逻辑与数学优化的专门推理变体。

1420

OpenAI 和 Microsoft 合作伙伴关系更新

OpenAI 和 Microsoft 已签署一份非约束性谅解备忘录,进入合作的下一阶段,重点是 AI 工具交付和安全。

1421

OpenAI 非营利组织与公共利益公司(PBC)结构演进

OpenAI 正在演进其结构,使其非营利实体控制公共利益公司(PBC),并持有超过 1000 亿美元的股权,以资助其确保通用人工智能(AGI)惠及全人类的使命。

1422

Transformers 4.40 对 OpenAI GPT‑OSS 的性能升级:零构建内核、MXFP4 量化、并行化以及更快的加载

Hugging Face 为 OpenAI 的 GPT‑OSS 模型在 transformers 库中加入了零构建内核、MXFP4 4 位量化、张量和专家并行、动态滑动窗口缓存、连续批处理以及更快的模型加载,显著提升了效率和可扩展性。

1423

为 AI Agent 编写高效工具:Anthropic 工程指南

Anthropic 概述了一个用于为非确定性 AI Agent 设计工具的系统化、评估驱动的框架,强调了以 Agent 为中心的设计,而非传统的确定性 API 模式。

1424

使用 Together AI 对 Hugging Face Hub LLM 进行微调

Together AI 与 Hugging Face 已集成平台,使开发者能够使用 Together AI 的基础设施微调来自 Hugging Face Hub 的任何兼容 LLM。

1425

Jupyter Agents:训练 LLM 在笔记本中进行推理

Hugging Face 推出了一套用于生成高质量合成数据并优化脚手架的流水线,将 Qwen3-4B 等小型 LLM 转变为最先进的数据科学代理。

1426

SafetyKit Risk Agents powered by OpenAI Models

SafetyKit 利用 GPT-5、GPT-4.1 和其他 OpenAI 模型,以超过 95% 的准确率对 100% 的客户内容进行欺诈和违规活动自动化检测。

1427

Mistral AI 系列 C 轮融资公告

Mistral AI 在 ASML 领投的系列 C 轮融资中筹集了 17 亿欧元,融资后估值达到 117 亿欧元,旨在加速战略性行业的前沿 AI 研究。

1428

mmBERT:ModernBERT 走向多语言

Hugging Face 推出 mmBERT,这是一款在 3 万亿以上 token、覆盖 1,800 多种语言的超大规模多语言编码器模型,在性能和推理速度上均优于 XLM‑R。

1429

OpenAI 以人为本 AI 基金

OpenAI 已开启 5000 万美元基金的申请,向美国非营利组织提供无限制的资助,以推动 AI 素养、社区创新和经济机会。

1430

Anthropic 对加州 SB 53 法案的支持

Anthropic 已支持加州参议院第 53 号法案 (SB 53),这是一个针对强大 AI 系统的监管框架,它优先考虑透明度和披露,而非指令性的技术指令。

1431

OpenAI 研究:语言模型为何产生幻觉

OpenAI 认为,语言模型产生幻觉是因为标准的训练和评估流程奖励猜测而非承认不确定性,而不是由于神秘的故障。

1432

OpenAI for Greece 合作伙伴关系启动教育试点和 AI 加速器

OpenAI 宣布了 ‘OpenAI for Greece’ 合作伙伴关系,在中学启动 ChatGPT Edu 试点,并设立希腊 AI 加速器以促进本地 AI 初创企业,这标志着在希腊教育和创新领域嵌入先进 AI 的重要一步。

1433

Anthropic 大型语言模型与生物风险:评估人工智能驱动的生物威胁

Anthropic 宣布其 Claude Opus 4 模型现已启用人工智能安全等级 3 防护措施,以阻止协助开发生物武器,并详细阐述了其关于人工智能驱动生物风险及缓解策略的研究。

1434

OpenAI 通过 AI 项目扩大经济机会

OpenAI 宣布了 OpenAI 工作平台和 OpenAI 认证,帮助员工获得 AI 能力并与雇主对接,目标是到 2030 年为 1000 万美国人颁发认证。

1435

EmbeddingGemma 300M 发布说明

Google 发布了 EmbeddingGemma,这是一款 308M 参数的多语言嵌入模型,在 500M 以下模型的 MTEB 基准中名列前茅,并针对设备端使用进行了优化。

1436

Anthropic 更新区域销售限制以防止对抗性访问

Anthropic 正在加强其服务条款,以禁止受不支持地区(如中国)控制的公司访问其服务,无论其子公司在何处注册。

1437

Anthropic 加入白宫 AI 教育承诺

Anthropic 已承诺通过在 K-12 网络安全领域投入 100 万美元、支持 Presidential AI Challenge 以及为教育工作者推出 Creative Commons AI Fluency 课程,来扩大 AI 教育的获取途径。

1438

SandboxAQ SAIR 数据集发布

SandboxAQ 已发布 SAIR,这是规模最大的共折叠 3D 蛋白-配体结构数据集,配有实验 IC₅₀ 标签,提供超过 500 万 AI 生成的结构,以加速 AI 驱动的药物发现。

1439

Mistral AI Le Chat 记忆功能(测试版)发布

Mistral AI 为 Le Chat 推出了记忆功能(测试版),这是一个注重透明度和用户控制的混合记忆系统,使 AI 能够在不重新训练的情况下回忆过往对话和上传的文件。

1440

OpenAI 收购 Statsig 并任命 Vijaye Raji 为应用部门首席技术官

OpenAI 已收购实验平台 Statsig,并任命其创始人兼 CEO Vijaye Raji 为应用部门首席技术官,负责领导 ChatGPT 和 Codex 的产品工程。

1441

OpenAI 更新 ChatGPT 安全与福祉举措

OpenAI 正在实施为期 120 天的计划,以提升 ChatGPT 对心理健康危机的响应,并为青少年引入家长控制功能,该计划由医学专家网络指导。

1442

Mistral AI Le Chat 更新:MCP 连接器与 Memories 功能

Mistral AI 为 Le Chat 引入了由 MCP 驱动的连接器和 Memories 功能,实现了与 20 多个企业工具的无缝集成,并在对话之间保持个性化的上下文。

1443

Hugging Face ZeroGPU 预编译指南

Hugging Face 为 ZeroGPU Spaces 引入了提前编译(AoT)功能,通过消除即时编译开销,使 Flux、Wan、LTX 等生成模型的加速范围达到 1.3 倍至 1.8 倍。

1444

Anthropic 系列 F 轮融资与估值更新

Anthropic 已由 ICONIQ 领投完成 130 亿美元的系列 F 轮融资,融资后估值达 1830 亿美元,旨在支持企业增长与安全研究。

1445

word2vec 学到的内容:特征学习的闭式理论

BAIR 研究人员提出了一种预测性理论,证明 word2vec 的学习可以简化为无权重的最小二乘矩阵分解,学习得到的表示实际上是对特定目标矩阵进行主成分分析(PCA)的结果。

1446

Anthropic Claude 3.5 Sonnet 计算机使用能力

Anthropic 为 Claude 3.5 Sonnet 推出了公开测试版,允许该模型通过移动光标、点击和输入,直接与计算机屏幕进行交互,从而模拟人类的计算机交互方式。

1447

Claude 3.5 Sonnet 发布说明 / 更新内容

Anthropic 发布了 Claude 3.5 Sonnet,该模型在推理和编程基准测试中表现优于 Claude 3 Opus 和竞争对手,同时运行速度是 Opus 的两倍。

1448

Anthropic Clio 隐私保护分析工具

Anthropic 宣布推出 Clio,一个自动化且保护隐私的系统,将真实世界中 Claude 的使用情况聚合为抽象主题聚类,以在不暴露用户数据的前提下提升安全监控能力。

1449

OpenAI gpt-realtime 与 Realtime API 正式上线

OpenAI 发布了高性能语音到语音模型 gpt-realtime,并正式开放 Realtime API,新增对图像输入、远程 MCP 服务器以及 SIP 电话呼叫的支持。

1450

OpenAI 支持非营利组织和社区创新基金

OpenAI 正在开启 5000 万美元基金的申请,向美国境内的 501(c)(3) 非营利组织和社区组织提供无限制的资助,以促进面向公共利益的 AI 驱动创新。