✷ 归档 · 11 个实验室 · 450 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Anthropic 开设悉尼办事处并任命 Theo Hourmouzis 为澳大利亚和新西兰总经理
Anthropic 已正式开设其悉尼办事处,并任命 Theo Hourmouzis 为澳大利亚和新西兰总经理,以扩大其在区域内的影响力并推动企业级 AI 的采用。
Anthropic Claude 在不同模型与语言中的价值观
Anthropic 发布了一项研究,表明 Claude 表达的价值观可以简化为四个维度,这些维度在不同模型版本和前 20 种语言之间存在系统性差异,揭示了在顺从度、热情度、深度和坦诚度方面的可衡量变化。
Anthropic 与 UST 合作推动物理 AI 与企业集成
Anthropic 与 UST 合作,将 Claude 集成到物理 AI 工程流程以及半导体、汽车、医疗、电信和银行领域的企业系统中。
Anthropic Golden Gate Claude 可解释性演示
Anthropic 展示了通过手术式地改变模型内部激活值来创建 Golden Gate Claude 的能力,这是 Claude 3 Sonnet 的一个版本,它对金门大桥非常痴迷。
Anthropic 长期利益信托治理结构
Anthropic 引入了长期利益信托 (Long-Term Benefit Trust, LTBT),这是一个独立的机构,旨在确保随着 AI 能力的进步,公司的治理结构与人类的长期利益保持一致。
Anthropic 任命 Ben Bernanke 加入长期利益信托 (Long-Term Benefit Trust)
Anthropic 已任命前美联储主席、诺贝尔奖得主 Ben Bernanke 博士加入其长期利益信托 (Long-Term Benefit Trust),以就先进 AI 对社会的影响提供经济专业知识。
Anthropic 启动“难题计划”以应对 AI 对社会的影响
Anthropic 发起了一项新计划,旨在征集并公开追踪公众针对先进 AI 在社会、经济和伦理影响方面提出的最困难问题的回答。
Anthropic 推出 Reflect with Claude beta 版
Anthropic 推出了名为 Reflect with Claude 的 beta 功能,允许用户追踪、可视化并优化其 AI 使用模式,从而更好地将 AI 集成到日常生活中。
Anthropic Claude 机器人评估显示高层控制快速进步,但直接扭矩控制能力有限
Anthropic 2026年7月的研究发现,新版本 Claude 模型能够可靠地监督预训练的运动和操作策略,而直接低层电机控制在各类机器人平台上仍不可靠。
Anthropic 宪法分类器:防御通用越狱攻击
Anthropic 宣布推出宪法分类器,这是一种新的输入-输出过滤系统,在仅增加适度计算开销和 0.38% 的无害拒绝率的情况下,将通用越狱成功率降至 5% 以下。
Anthropic 和 AE Studio 推出用于双重用途知识控制的 GRAM
Anthropic 和 AE Studio 开发了梯度路由辅助模块 (GRAM),这是一种将双重用途知识隔离到可移除的分隔区中的方法,旨在防止滥用而不牺牲通用模型的性能。
Anthropic 在 Claude 语言模型中发现了一个全局工作空间 (J-space)
Anthropic 宣布在 Claude 中发现了一个涌现的“J-space”,其功能作为内部、可报告推理的全局工作空间,从而实现了沉默思想的监控以及新的安全工具。
Alberta Government Uses Claude Code to Scan and Fix 466M Lines of Code in Hours
阿尔伯塔省政府部署了 Anthropic 的 Claude Code (Opus and Sonnet) 在 20 小时内扫描了 3,400 个仓库中的 4.66 亿行代码,自动生成修复方案,并建立了持续的 AI 驱动安全审查,大幅缩短了原本需要数年的任务时间。
Claude Fable 5 网络安全防护措施与越狱框架
Anthropic 详细说明了 Claude Fable 5 中用于防止网络安全误用的安全分类器,并提出了一个新的网络越狱严重程度 (CJS) 框架,以标准化 AI 越狱的评估方式。
Anthropic 恢复对 Claude Fable 5 和 Mythos 5 的访问
Anthropic 宣布,在美国出口管制解除后,Claude Fable 5 和 Mythos 5 已恢复上线,详细介绍了新的安全分类器、行业级越狱严重性框架以及与政府的扩展合作。
Claude Fable 5 和 Claude Mythos 5 正式发布 – 搭载安全防护机制的先进 Mythos 类模型,支持分级访问
Anthropic 发布了 Claude Fable 5,一款在软件工程、视觉和科学领域均创下记录性能的通用型 Mythos 类 1 模型,以及 Claude Mythos 5,一款为可信网络安全专家和未来生物研究伙伴提供的放宽安全限制版本。
Anthropic Frontier Red Team:压力测试人工智能能力
Anthropic 的 Frontier Red Team 通过对人工智能在网络安全、国家安全和自主系统方面的影响进行基于证据的分析,以预测未来风险。
Claude Science AI 工作台发布
Anthropic 推出了 Claude Science,这是一个集成科学工具、管理可扩展计算并提供可审计研究成果的 AI 工作台,旨在加速科学发现。
Anthropic 经济指数周期报告 – 2026 年 6 月
Anthropic 2026 年 6 月的经济指数报告揭示,Claude 的使用模式如今遵循每日和每周的工作节奏,生成的输出价值更高且消耗更多计算资源,而自动化程度更高的用户对人工智能对其工作影响的预期出人意料地乐观。
Anthropic 项目 Fetch 第二阶段
Claude Opus 4.7 展示了自主执行机器人控制任务的能力,速度约为人类团队的 20 倍,标志着向物理自主 AI 的转变。
Anthropic 在首尔开设新办公室以拓展韩国人工智能生态系统
Anthropic 已在首尔开设新办公室,并与韩国科学技术信息通信部签署谅解备忘录,以推进人工智能安全并扩大 Claude 在韩国企业及研究机构中的应用。
Anthropic Claude Code 使用报告 2026 年 6 月 – 关于代理式编程、专业能力与劳动力影响的发现
Anthropic 分析了约 40 万次 Claude Code 会话(2025 年 10 月至 2026 年 4 月),发现用户负责规划任务而 Claude 负责执行,成功率与各职业的专业软件工程师相当,而领域专业知识——而非编程技能——是决定更高成功率与更高任务价值的关键因素。
Anthropic 与 TCS 合作推动受监管行业的应用
Anthropic 与塔塔咨询服务公司(TCS)达成合作,将 Claude 部署至 50,000 名 TCS 员工,并向医疗健康和金融服务等高度受监管行业的企业提供基于 Claude 的 AI 解决方案。
Anthropic 根据美国政府指令暂停 Fable 5 和 Mythos 5 的使用
Anthropic 为遵守美国政府因担心模型可能被越狱而提出的国家安全相关的出口管制指令,已为所有客户禁用了 Fable 5 和 Mythos 5 的访问权限。
Anthropic 公共记录:美国公众对人工智能的看法
Anthropic 对近52,000名美国人的首次公共记录调查显示,尽管对人工智能驱动的医疗突破抱有强烈期望,但公众普遍高度担忧失业问题,并广泛支持政府监管。
Anthropic 与 DXC Technology 全球联盟
Anthropic 与 DXC Technology 已达成多年期全球联盟,旨在将 Claude 集成到受监管行业的关键任务系统中,并辅以一项旨在认证数万名工程师的计划。
Anthropic 推出 Claude Corps 赋能计划
Anthropic 推出了 Claude Corps,这是一项价值 1.5 亿美元的国家级赋能计划,旨在培训 1,000 名早期职业专业人士,将人工智能解决方案应用于美国非营利组织。
Anthropic 发布 gget virus:确定性检索层显著提升 AI 代理在病毒序列数据上的准确性
Anthropic 推出了 gget virus,一个确定性检索工具,将 AI 代理在病毒序列查询上的准确率从不足 100% 提升至超过 99%,突显了构建代理友好型生物数据基础设施的必要性。
Anthropic 评估大型语言模型对 N 日漏洞利用的影响
Anthropic 表明,其前沿模型 Claude Mythos Preview 可在数小时内自主创建针对 Firefox 和 Windows 内核补丁的可工作 N 日漏洞利用,显著缩短了传统的补丁差距窗口。
Anthropic Claude Opus 4.7 化学版本发布:NMR 预测与结构解析
Anthropic 宣布 Claude Opus 4.7 可以实现与 ChemDraw 相当的 ¹H/¹³C NMR 谱图预测精度,并能从 1D NMR 数据中推断结构,标志着迈向 AI 辅助化学工作流程的第一步。
Anthropic 攻击导航器:映射人工智能赋能的网络威胁并引入 ARiES 风险评分
Anthropic 发布了攻击导航器,一项将 832 个由人工智能赋能的威胁行为者映射到 MITRE ATT&CK 的研究,揭示中等或更高风险行为者比例增长了 1.7 倍,并引入了人工智能风险赋能评分(ARiES)以量化人工智能增强的网络风险。
Anthropic Claude Partner Network: Services Track and Partner Hub
Anthropic 推出了 Services Track 和 Partner Hub,旨在通过提供分层认证系统和公开目录,帮助企业识别合格的 Claude 实施合作伙伴。
Anthropic 对 AI 赋能的网络威胁分析 (2025-2026)
Anthropic 对 832 个被封禁账号的分析显示,AI 正在使技术水平较低的行为者能够执行复杂的入侵后活动,并创建当前的 MITRE ATT&CK 等安全框架无法捕捉的自主攻击链。
Anthropic 正在扩大 Project Glasswing 的规模
Anthropic 正在将 Project Glasswing 扩展到 150 家新组织,利用 Claude Mythos Preview 来保护关键基础设施,旨在在强大的、具备网络攻击能力的 AI 模型广泛发布之前,建立新的网络安全规范。
Anthropic 机密提交拟议 IPO 的 S-1 草案
Anthropic, PBC 已向美国证券交易委员会机密提交了 Form S-1 表格的注册登记声明草案,拟对其普通股进行首次公开募股 (IPO)。
Anthropic 系列 H 轮融资与估值更新
Anthropic 已完成 650 亿美元的系列 H 轮融资,投后估值达 9650 亿美元,旨在扩大计算能力并加速人工智能安全研究。
Anthropic 在米兰开设办事处,以支持意大利企业与研究
Anthropic 在米兰开设了新的办事处,这是其在欧洲的第六个据点,旨在支持意大利企业、开发者和研究机构在负责任地扩展 Claude AI 的过程中提供支持。
社会科学中的编程智能体
对 1,260 名社会科学家的调查显示,虽然 81% 的人使用 AI 聊天机器人,但只有 20% 的人采用了自主编程智能体,且在性别、职业阶段和机构声望之间存在显著的采用差距。
Anthropic 任命 KiYoung Choi 为韩国代表董事
Anthropic 已任命 KiYoung Choi 为韩国代表董事,以领导市场进入策略并支持 Claude.ai 在韩国市场的极高采用率。
Anthropic 如何在各产品中对 Claude 进行管控——工程概览
Anthropic 宣布了其针对 Claude 智能体的多层管控策略,详细介绍了环境沙箱、人在回路控制和出站过滤机制,以在 claude.ai、Claude Code 和 Claude Cowork 产品中有效控制影响范围。
Anthropic 联合创始人 Chris Olah 谈教皇利奥十四世的《Magnifica Humanitas》通谕
Anthropic 联合创始人 Chris Olah 强调,需要来自宗教和公民社会领导者的外部道德和哲学监督,以平衡 AI 开发的商业和地缘政治动机。
Anthropic 研究:衡量大语言模型的漏洞利用开发能力
Anthropic 的 Claude Mythos Preview 在 V8、Linux 内核和智能合约领域展现出端到端漏洞利用能力的质变,显著超越了此前的前沿模型。
Project Glasswing: Anthropic 关于 AI 驱动漏洞发现的初步更新
Anthropic 的 Project Glasswing 使用 Claude Mythos Preview 模型在系统性软件中识别出了超过 10,000 个高危或严重级别的漏洞,使网络安全瓶颈从漏洞发现转向了验证和修复。
Anthropic 将多样化的智慧传统融入 AI 道德形成计划
Anthropic 正在与来自 15 个以上宗教和跨文化团体的学者、神职人员和哲学家进行交流,以为其 AI 系统的道德形成和性格开发提供参考。
KPMG 与 Anthropic 达成战略联盟,推动 Claude 全球集成
KPMG 正在将其全球超过 276,000 名员工的工作流程中集成 Anthropic 的 Claude,并将该 AI 嵌入其 Digital Gateway 平台,以增强税务、法律和私募股权服务。
Anthropic 收购 Stainless
Anthropic 收购了 Stainless,通过将先进的 SDK 和 MCP 服务器工具集成到 Claude Platform,来增强 Claude agent 的连接性。
Anthropic 2028 年人工智能领导力情景
Anthropic 发布了一份报告,概述了美中人工智能竞争在 2028 年可能出现的两种结果,认为保持民主国家的算力领先对防止威权人工智能主导至关重要。
Anthropic 与比尔及梅琳达·盖茨基金会合作推动全球人工智能影响
Anthropic 与比尔及梅琳达·盖茨基金会合作,将在未来四年提供 2 亿美元的赠款资金、Claude 使用额度和技术支持,以推动全球健康、生命科学、教育和经济流动性的发展。
Anthropic 与 PwC 扩大战略联盟,推动企业级 AI 部署
Anthropic 与 PwC 扩大了其战略合作伙伴关系,通过在 PwC 的全球员工和客户业务中部署 Claude、Claude Code 和 Claude Cowork,实现复杂企业职能的自动化。
Anthropic 研究:教导 Claude 理解原理以减少代理失调
Anthropic 通过将训练重点从对齐行为转向教导行为背后的底层伦理原则和推理,减少了 Claude 模型中的代理失调。