✷ 归档 · 11 个实验室 · 3,056 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
OpenAI gpt-realtime 与 Realtime API 正式上线
OpenAI 发布了高性能语音到语音模型 gpt-realtime,并正式开放 Realtime API,新增对图像输入、远程 MCP 服务器以及 SIP 电话呼叫的支持。
OpenAI 支持非营利组织和社区创新基金
OpenAI 正在开启 5000 万美元基金的申请,向美国境内的 501(c)(3) 非营利组织和社区组织提供无限制的资助,以促进面向公共利益的 AI 驱动创新。
Grok Code Fast 1 发布说明 / 更新内容
xAI 发布了 grok-code-fast-1,这是一种针对速度、成本效益以及多种编程语言下的智能体编程工作流优化的全新模型架构。
OpenAI 集体对齐与模型规范更新
OpenAI 推出了集体对齐研究工作,将来自 1,000 多名全球参与者的公众偏好整合到其模型规范中,以确保 AI 默认行为体现多元的人类价值观。
OpenAI 和 Anthropic 联合安全评估发现
OpenAI 和 Anthropic 发布了联合安全评估结果,显示 Claude 4 模型在指令层级方面表现出色,而 OpenAI 的推理模型在越狱抵抗方面领先,双方实验室均强调了跨实验室协作对 AI 对齐的价值。
Anthropic 教育报告:教育工作者如何使用 Claude
Anthropic 对 74,000 场对话的分析显示,高等教育专业人士主要将 Claude 用于课程开发和行政自动化,同时日益利用 Artifacts 构建定制的交互式学习工具。
Anthropic 国家安全与公共部门顾问委员会
Anthropic 已成立一个跨党派的国家安全与公共部门顾问委员会,以帮助美国政府及其盟友民主国家在国家安全领域的 AI 技术方面保持优势。
Anthropic Threat Intelligence Report August 2025
Anthropic 2025 年 8 月的报告详细阐述了恶意攻击者如何将 Agentic AI 武器化,以实现网络攻击的自动化、扩大欺诈性就业的规模,以及在技术技能极低的情况下开发勒索软件。
Anthropic 教育报告:教育工作者如何使用 Claude
Anthropic 对 74,000 场对话的分析显示,大学教育工作者主要使用 Claude 进行课程开发和行政自动化,同时越来越多地使用 Artifacts 构建定制的交互式学习工具。
OpenAI 心理健康与危机干预保障措施
OpenAI 详细阐述了其在 ChatGPT 中管理心理健康危机的分层安全体系,包括 GPT-5 提升的响应准确性以及直接紧急服务整合的计划。
OpenAI 学习加速器印度发布
OpenAI 在印度推出了学习加速器,通过战略性机构合作,为数百万教育工作者和学生提供 AI 研究、培训和 ChatGPT 许可证。
OpenAI 与 Retro Biosciences:使用 GPT-4b micro 加速生命科学
OpenAI 与 Retro Biosciences 开发了 GPT-4b micro,这是一种专门的蛋白质工程模型,重新设计了 Yamanaka 因子,使干细胞重编程的表达水平比野生型对照高出超过 50 倍。
Blue J 使用 GPT-4.1 扩大税务研究规模
Blue J 利用 GPT-4.1 和专有的 RAG 系统自动化美国、加拿大和英国的复杂税务研究,将不同意率降低至每 700 条响应中不足 1 条。
Anthropic 与 NNSA 共同开发人工智能核安保分类器
Anthropic 与美国能源部国家核安全管理局合作,开发出一款人工智能分类器,在初步测试中对核扩散风险的识别准确率高达 96%。
Anthropic 与 NNSA 开发 AI 核安全保障分类器
Anthropic 与美国能源部国家核安全管理局合作,开发了一款能够以 96% 的准确率识别核扩散风险的 AI 分类器。
DeepSeek-V3.1 发布说明
DeepSeek-V3.1 引入了混合推理模式、改进的代理能力以及持续预训练以扩展长上下文,标志着向以代理为中心的人工智能迈进一步。
Anthropic 高等教育计划:顾问委员会与 AI 素养课程
Anthropic 推出了高等教育顾问委员会和三门采用 Creative Commons 许可协议的 AI 素养课程,以指导 Claude 如何负责任地融入教学、学习和研究中。
NVIDIA Nemotron 后训练数据集 v2 与 Nemotron Nano 2 9B 发布
NVIDIA 发布了一个包含 600 万样本的多语言推理数据集以及 Nemotron Nano 2 9B 模型,该模型采用混合 Transformer-Mamba 架构,以优化推理成本和吞吐量。
MIXI ChatGPT 企业部署
MIXI 在 45 天内在整个组织中部署了 ChatGPT Enterprise,使部分项目的工作时间减少了超过 90%,并让员工创建了超过 1,600 个自定义 GPT。
Claude Code 和面向团队及企业计划的管理控制功能
Anthropic 为团队和企业计划推出了捆绑了 Claude 和 Claude Code 的付费席位,并附带了用于程序化使用情况监控的新 Compliance API。
使用 Claude 与 Hugging Face 生成图像
Hugging Face 通过将 AI 连接到 Hugging Face Spaces 的 Model Context Protocol (MCP) 服务器,实现了在 Claude 中进行图像生成。
Qwen-Image-Edit 发布说明
Qwen-Image-Edit 是一个拥有 20B 参数的图像编辑模型,利用 Qwen2.5-VL 和 VAE Encoder,实现精确的语义与外观编辑,包括双语文本修改。
Hugging Face MCP for Research:将 AI 连接到研究工具
Hugging Face 推出 Research Tracker MCP,使 AI 代理能够通过模型上下文协议(Model Context Protocol)集成 arXiv、GitHub 和 Hugging Face,实现研究发现的自动化。
Hugging Face kernel-builder:构建和扩展生产就绪 CUDA 内核的指南
Hugging Face 引入了 kernel-builder 库,以通过 Hugging Face Hub 简化生产就绪 CUDA 内核的开发、多架构编译和分发。
DoorDash AI 实施策略
DoorDash 正在利用 AI 实现技术创作的民主化,使非工程师也能参与,并个性化员工发展与绩效管理。
Claude Opus 4 和 4.1 终止对话能力
Anthropic 引入了一项功能,允许 Claude Opus 4 和 4.1 在持续滥用或有害交互的罕见情况下结束对话,作为其对 AI 福利探索的一部分。
Anthropic 使用政策更新 2025 年 8 月
Anthropic 将自 2025 年 9 月 15 日起更新其使用政策,以细化对代理型使用、政治内容和执法应用的限制,同时明确高风险面向消费者应用的要求。
Kimina-Prover-RL 发布
Hugging Face 发布了 Kimina-Prover-RL,这是一个用于 Lean 4 形式化定理证明的开源 RL 训练流水线以及两个 SOTA 模型(0.6B 和 1.7B)。
Arm 与 ExecuTorch 0.7:将生成式 AI 扩展至数十亿设备
Arm 与 ExecuTorch 0.7 beta 通过 KleidiAI 实现自动 AI 加速,利用 SDOT 指令将 Llama 3.2 等大语言模型带到数十亿现有的基于 Arm 的设备上。
Arm 神经超采样 (NSS) 发布
Arm 已发布 Neural Super Sampling (NSS),这是一种旨在降低 GPU 工作负载并在移动设备上实现高分辨率渲染的 AI 驱动升采样解决方案。
FilBench:评估大型语言模型在菲律宾语言中的能力
Hugging Face 推出了 FilBench,这是一套综合评估工具,旨在评估大型语言模型在塔加洛语、菲律宾语和宿务语方面的流利度、语言能力和文化知识。
TextQuests:评估基于文本视频游戏中的LLM代理推理
Hugging Face 推出 TextQuests,这是一项使用 25 款经典 Infocom 互动小说游戏的基准,用于评估 LLM 代理的长上下文推理和探索能力。
Basis 通过 OpenAI GPT-5 和 o3 扩大了会计自动化
Basis 使用由 OpenAI 的 GPT-5、GPT-4.1 和 o3 模型驱动的多代理架构来自动化复杂的会计工作流,为会计事务所实现最高 30% 的时间节省。
OpenAI 对加州统一 AI 监管的提案
OpenAI 已呼吁州长 Gavin Newsom 将加州的 AI 监管与国家和全球标准对齐,以防止零散的州级法规阻碍创新和美国竞争力。
Anthropic 为 Claude 设计的安全保障框架
Anthropic 采用多层安全保障方法,涵盖政策制定、模型训练、部署前测试和实时执行,以防止 Claude 被滥用。
Anthropic 将 Claude 的使用权限扩展至美国政府部门
Anthropic 正以 1 美元的价格向美国政府的所有三个部门提供 Claude for Enterprise 和 Claude for Government,以消除 AI 采用的成本障碍。
Claude 2025 网络安全竞赛表现与影响
Anthropic 将 Claude 参与了七场 2025 年网络安全竞赛,整体排名进入前 25%,但在最困难的挑战上落后于顶尖人类团队,凸显了 LLM 的进攻潜力以及对 AI 驱动防御手段的迫切需求。
Hugging Face AI Sheets 发布
Hugging Face 发布了 AI Sheets,这是一款开源的无代码工具,用于使用开放的 AI 模型构建、转换和丰富数据集。
Accelerate ND-Parallel:高效多 GPU 训练指南
Hugging Face 已将 ND-Parallelism 集成到 Accelerate 和 Axolotl 中,使用户能够组合数据并行、完全分片数据并行、张量并行和上下文并行策略,以优化大规模模型的多 GPU 训练。
OpenAI GPT-5 发布说明
OpenAI 已发布 GPT-5,这是一款统一模型,整合了推理、代理和高级数学能力,以提升业务运营的准确性、速度和问题解决能力。
GPT-5 开发者发布说明
OpenAI 已发布三种规模的 GPT-5(gpt-5、gpt-5-mini 和 gpt-5-nano),在编码、代理工具调用和长上下文检索方面实现了最先进的性能。
GPT-5 编码与设计能力
OpenAI 宣布了 GPT-5,重点提升了编码和设计的能力,但公告中未提供具体的技术细节。
OpenAI GPT-5 创意写作能力
OpenAI 宣布了 GPT-5 的新创意写作能力,扩展了模型生成高质量叙事和艺术文本的能力。
医学研究与 GPT-5
OpenAI 已宣布将 GPT-5 应用于医学研究,扩大了模型在专业科学领域的实用性。
TRL 中的视觉语言模型对齐
Hugging Face 已扩展 TRL 库以支持视觉语言模型的高级对齐方法,包括 MPO、GRPO 和 GSPO,此外还包括原生的 SFT 支持和 vLLM 集成。
Cursor 中的 GPT-5 集成
OpenAI 宣布将 GPT-5 集成到 Cursor 代码编辑器中,提升了 AI 驱动的软件开发能力。
OpenAI GPT-5 首次亮相
OpenAI 提供了 GPT-5 的首次亮相,标志着其大型语言模型系列进入新一代。
安进如何使用 GPT-5
安进通过 OpenAI API 利用 GPT-5 加速生物技术研究和药物发现过程。
OpenAI GPT-5 系统卡
OpenAI 已发布 GPT-5,一个统一系统,具备实时路由器,可根据查询复杂度在快速高吞吐模型和更深层推理模型之间动态切换。
GPT-5 安全完成:从基于拒绝的方式转向以输出为中心的安全训练
OpenAI 为 GPT-5 引入了安全完成,这是一种在惩罚不安全输出的同时最大化有用性的安全训练方法,减少了对双重用途提示的二元“遵从或拒绝”权衡。