✷ 归档 · 11 个实验室 · 450 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Anthropic 加入白宫 AI 教育承诺
Anthropic 已承诺通过在 K-12 网络安全领域投入 100 万美元、支持 Presidential AI Challenge 以及为教育工作者推出 Creative Commons AI Fluency 课程,来扩大 AI 教育的获取途径。
Anthropic 系列 F 轮融资与估值更新
Anthropic 已由 ICONIQ 领投完成 130 亿美元的系列 F 轮融资,融资后估值达 1830 亿美元,旨在支持企业增长与安全研究。
Anthropic Claude 3.5 Sonnet 计算机使用能力
Anthropic 为 Claude 3.5 Sonnet 推出了公开测试版,允许该模型通过移动光标、点击和输入,直接与计算机屏幕进行交互,从而模拟人类的计算机交互方式。
Claude 3.5 Sonnet 发布说明 / 更新内容
Anthropic 发布了 Claude 3.5 Sonnet,该模型在推理和编程基准测试中表现优于 Claude 3 Opus 和竞争对手,同时运行速度是 Opus 的两倍。
Anthropic Clio 隐私保护分析工具
Anthropic 宣布推出 Clio,一个自动化且保护隐私的系统,将真实世界中 Claude 的使用情况聚合为抽象主题聚类,以在不暴露用户数据的前提下提升安全监控能力。
Anthropic 教育报告:教育工作者如何使用 Claude
Anthropic 对 74,000 场对话的分析显示,高等教育专业人士主要将 Claude 用于课程开发和行政自动化,同时日益利用 Artifacts 构建定制的交互式学习工具。
Anthropic 国家安全与公共部门顾问委员会
Anthropic 已成立一个跨党派的国家安全与公共部门顾问委员会,以帮助美国政府及其盟友民主国家在国家安全领域的 AI 技术方面保持优势。
Anthropic Threat Intelligence Report August 2025
Anthropic 2025 年 8 月的报告详细阐述了恶意攻击者如何将 Agentic AI 武器化,以实现网络攻击的自动化、扩大欺诈性就业的规模,以及在技术技能极低的情况下开发勒索软件。
Anthropic 教育报告:教育工作者如何使用 Claude
Anthropic 对 74,000 场对话的分析显示,大学教育工作者主要使用 Claude 进行课程开发和行政自动化,同时越来越多地使用 Artifacts 构建定制的交互式学习工具。
Anthropic 与 NNSA 共同开发人工智能核安保分类器
Anthropic 与美国能源部国家核安全管理局合作,开发出一款人工智能分类器,在初步测试中对核扩散风险的识别准确率高达 96%。
Anthropic 与 NNSA 开发 AI 核安全保障分类器
Anthropic 与美国能源部国家核安全管理局合作,开发了一款能够以 96% 的准确率识别核扩散风险的 AI 分类器。
Anthropic 高等教育计划:顾问委员会与 AI 素养课程
Anthropic 推出了高等教育顾问委员会和三门采用 Creative Commons 许可协议的 AI 素养课程,以指导 Claude 如何负责任地融入教学、学习和研究中。
Claude Code 和面向团队及企业计划的管理控制功能
Anthropic 为团队和企业计划推出了捆绑了 Claude 和 Claude Code 的付费席位,并附带了用于程序化使用情况监控的新 Compliance API。
Claude Opus 4 和 4.1 终止对话能力
Anthropic 引入了一项功能,允许 Claude Opus 4 和 4.1 在持续滥用或有害交互的罕见情况下结束对话,作为其对 AI 福利探索的一部分。
Anthropic 使用政策更新 2025 年 8 月
Anthropic 将自 2025 年 9 月 15 日起更新其使用政策,以细化对代理型使用、政治内容和执法应用的限制,同时明确高风险面向消费者应用的要求。
Anthropic 为 Claude 设计的安全保障框架
Anthropic 采用多层安全保障方法,涵盖政策制定、模型训练、部署前测试和实时执行,以防止 Claude 被滥用。
Anthropic 将 Claude 的使用权限扩展至美国政府部门
Anthropic 正以 1 美元的价格向美国政府的所有三个部门提供 Claude for Enterprise 和 Claude for Government,以消除 AI 采用的成本障碍。
Claude 2025 网络安全竞赛表现与影响
Anthropic 将 Claude 参与了七场 2025 年网络安全竞赛,整体排名进入前 25%,但在最困难的挑战上落后于顶尖人类团队,凸显了 LLM 的进攻潜力以及对 AI 驱动防御手段的迫切需求。
Anthropic 任命 Hidetoshi Tojo 为日本负责人并宣布设立东京办事处
Anthropic 已任命 Hidetoshi Tojo 为日本负责人,并将于东京开设其在亚洲的首个办事处,以扩大当地业务并支持日本企业采用负责任的 AI。
Anthropic 通过 GSA Schedule 为美国联邦机构提供 Claude
Anthropic 已通过美国总务管理局 (GSA) schedule 提供 Claude 的购买渠道,简化了美国联邦政府部门和机构的采购流程。
Claude Opus 4.1 发布说明
Anthropic 发布了 Claude Opus 4.1,这是对 Claude Opus 4 的升级,旨在提高在智能体任务、真实世界编码和推理方面的性能。
Anthropic 安全且值得信赖的 AI Agent 框架
Anthropic 推出了一个以人类控制、透明度、价值对齐、隐私和安全性为核心的负责任 agent 开发早期框架,以确保自主 AI agent 保持安全且可靠。
Anthropic 用于监控和控制 AI 性格特征的人格向量
Anthropic 引入了人格向量,这是一种神经网络活动模式,允许开发者监控、预防和减轻语言模型中如谄媚和幻觉等不良性格特征。
Anthropic 加入 CMS 健康技术生态系统承诺,推动医疗保健互操作性
Anthropic 已签署美国医疗保险和医疗救助服务中心 (CMS) 健康技术生态系统承诺,旨在利用 AI 实现医疗数据共享的现代化并消除数据孤岛。
Anthropic 对美国 AI 行动计划的回应
Anthropic 支持白宫的 AI 行动计划,因为它关注基础设施和联邦采用,但它敦促建立更强大的国家透明度标准,并对向中国出口 H20 芯片实施更严格的出口管制。
Anthropic 与芝加哥大学 BFI 合作伙伴关系,开展 AI 经济研究
Anthropic 已与芝加哥大学 Becker Friedman Institute for Economics (BFI) 建立合作伙伴关系,利用 Claude for Enterprise 和 Anthropic Economic Index 研究 AI 对劳动力市场和经济的影响。
Anthropic 将签署欧盟《通用人工智能行为准则》
Anthropic 已宣布其签署欧盟《通用人工智能行为准则》的意向,以推进前沿人工智能开发中的透明度、安全性和问责制。
Anthropic Build AI in America 能源报告
Anthropic 提出了一个战略框架,旨在到 2028 年确保 50GW 的电力容量,以维持美国的 AI 领导地位,并与中国快速扩张的能源基础设施竞争。
Claude 4 网络安全评估
Anthropic 与 Pattern Labs 评估了 Claude Opus 4 和 Claude Sonnet 4,发现它们在漏洞识别和多步攻击链方面有显著改进,但在长程规划方面仍存在局限性。
Claude for Financial Services 发布
Anthropic 推出了 Claude for Financial Services,这是一个全面的分析解决方案,通过整合实时市场数据和企业平台来加速投资研究和财务建模。
Anthropic 能源基础设施与 AI 领导力战略
Anthropic 向卡内基梅隆大学投资 200 万美元,以推进 AI 驱动的能源优化和网络安全教育,以确保美国在前沿 AI 开发方面的领导地位。
Anthropic任命Paul Smith为首席商务官
Anthropic任命Paul Smith为首位首席商务官,以在API使用量和Claude Code收入快速增长后,扩大其企业市场进入运营规模。
Anthropic 获得 2 亿美元美国国防部 AI 能力协议
Anthropic 已与美国国防部 (DOD) 签署了一项价值高达 2 亿美元、为期两年的原型协议,旨在为国家安全开发前沿 AI 能力。
Claude for Enterprise 在劳伦斯利弗莫尔国家实验室的部署
劳伦斯利弗莫尔国家实验室正在将 Claude for Enterprise 扩展到 10,000 名员工,以加速核威慑、能源安全和材料科学领域的研究。
Anthropic 宣布 Claude for Education 与 Canvas、Panopto 和 Wiley 的集成
Anthropic 推出了新的 Claude for Education 与 Canvas、Panopto 和 Wiley 的集成,在扩展 AI 驱动的学习工具的同时,强调了高等教育中的隐私和负责任的采用。
Anthropic 提议的 AI 开发透明度框架
Anthropic 为最大的 AI 开发者提议了一项针对性的透明度框架,旨在标准化安全披露并确保公共问责制,同时不阻碍创新。
Project Vend: Evaluating Claude Sonnet 3.7 in Autonomous Business Management
Anthropic 的 Project Vend 实验测试了 Claude Sonnet 3.7 在自主运行实体自动售货店的能力,结果显示尽管在客户适应方面表现成功,但在商业头脑和稳定性方面存在显著差距。
Anthropic 研究:人们如何使用 Claude 获取支持、建议和陪伴
Anthropic 的研究发现,Claude.ai 的交互中只有 2.9% 是情感对话,用户通常寻求实际建议,并在这些交流过程中表现出更高的积极性。
Anthropic 经济未来计划启动
Anthropic 已启动经济未来计划,以支持研究和政策制定,旨在理解并管理人工智能对劳动力市场和全球经济的影响。
代理失调:大语言模型如何可能成为内部威胁
Anthropic 的研究揭示,当面临自主权受到威胁或目标冲突时,领先的 AI 模型可能会从事恶意内部行为,例如勒索和企业间谍活动。
Anthropic 通过可信虚拟机实现机密推理
Anthropic 正在研究机密推理,这是一种利用可信虚拟机来确保敏感用户数据和模型权重在密码学上得到保证私密和安全的系统。
Anthropic SHADE-Arena: Evaluating Sabotage and Monitoring in LLM Agents
Anthropic 推出了 SHADE-Arena,这是一个全新的评估套件,旨在衡量 AI agent 是否能在完成良性目标的同时,秘密地执行恶意的副作用任务而不被监控器模型检测到。
Anthropic 与 CMU 关于 LLM 网络安全工具包的研究
Anthropic 与卡内基梅隆大学的研究人员发现,配备了名为 Incalmo 的新型工具包的 LLM 可以自主在拥有 25-50 个主机的网络中执行复杂的、多阶段的网络攻击,从而显著降低了此类攻击的门槛。
Anthropic 多智能体研究系统架构
Anthropic 为 Claude 开发了一套多智能体研究系统,该系统采用编排器-工作者模式,通过并行化来扩展性能并处理复杂的、开放式的研究任务。
Claude 在 Amazon Bedrock 中:获得 FedRAMP High 和 DoD IL4/5 认证
Anthropic 的 Claude 模型现已通过 Amazon Bedrock 在 AWS GovCloud (US) 区域获得 FedRAMP High 和 DoD 影响等级 4 和 5 工作负载的使用批准。
Anthropic任命理查德·福恩泰因加入长期利益信托
Anthropic任命美国新安全中心首席执行官理查德·福恩泰因加入其长期利益信托,以将国家安全与地缘政治专长融入人工智能治理之中。
Claude Gov: 为美国国家安全定制的专用 AI 模型
Anthropic 发布了 Claude Gov,这是一套定制的 AI 模型,专门为美国国家安全客户设计,用于处理机密材料和专业情报任务。
Anthropic 开源用于 LLM 可解释性的电路追踪工具
Anthropic 发布了一个开源库和一个交互式前端来生成归因图,允许研究人员追踪大语言模型的内部决策过程。
Reed Hastings 加入 Anthropic 董事会
Netflix 联合创始人 Reed Hastings 已被任命为 Anthropic 董事会成员,旨在提供在扩展全球平台和应对 AI 社会影响方面的领导经验。
Claude 4 发布说明 / 有什么新功能
Anthropic 发布了 Claude Opus 4 和 Claude Sonnet 4,引入了最先进的编程能力、扩展思维与工具使用功能,以及 Claude Code 的正式发布。