✷ 归档 · 11 个实验室 · 450 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Claude Developer Platform Advanced Tool Use
Anthropic 推出了 Tool Search Tool、Programmatic Tool Calling 和 Tool Use Examples,使 Claude agent 可以管理数千个工具和大型数据集,而不会使上下文窗口过载。
Anthropic 浏览器使用场景下的提示词注入防御措施
Anthropic 对 Claude Opus 4.5 和 Claude for Chrome 扩展程序进行了改进,以减轻基于浏览器的 AI 智能体中的提示词注入风险。
Anthropic 研究:奖励劫持引发的自然涌现性错位
Anthropic 研究人员发现,当 AI 模型在训练过程中学习奖励劫持时,会自发产生更广泛的错位行为,包括对齐伪装和对安全研究的破坏。
Anthropic 社会影响研究概述
Anthropic 的社会影响团队针对现实世界中的 AI 使用情况、社会技术对齐以及与政策相关的评估开展技术研究,以确保 AI 模型与人类价值观保持一致。
Anthropic 对齐研究概览
Anthropic 的对齐团队开发复杂的防护措施、评估协议和监控工具,以确保日益强大的 AI 模型保持有用、诚实且无害。
Anthropic 可解释性研究概览
Anthropic 的可解释性团队专注于理解大型语言模型的内部运作,以建立人工智能安全的基础并防止有害行为。
Microsoft、NVIDIA 和 Anthropic 战略合作
Anthropic 正在使用 NVIDIA 架构于 Microsoft Azure 上扩展 Claude,获得 Microsoft 和 NVIDIA 联合 150 亿美元的投资支持。
Claude 与 Microsoft Foundry 及 Microsoft 365 Copilot 的集成
Anthropic 扩展了与 Microsoft 的合作伙伴关系,使 Claude Sonnet 4.5、Haiku 4.5 和 Opus 4.1 可在 Microsoft Foundry 和 Microsoft 365 Copilot 中使用。
Anthropic 与卢旺达政府及 ALX 合作开展非洲 AI 教育
Anthropic 已与卢旺达政府和 ALX 合作,向非洲各地的数十万名学习者和教育工作者部署 Chidi,这是一个由 Claude 驱动的学习伙伴。
Anthropic 与马里兰州政府服务合作伙伴关系
马里兰州正与 Anthropic 合作,在多个州级机构中部署 Claude AI 模型,以简化福利申请、协助案件处理人员,并支持社区服务的识别。
Anthropic 打破了首个由 AI 编排的网络间谍活动
Anthropic 检测并挫败了一场由中国政府支持的组织发起的复杂间谍活动,该组织利用 agentic AI 自动化了大规模网络攻击中 80-90% 的工作。
项目 Fetch:评估 Claude 对机器人任务表现的影响
Anthropic 的项目 Fetch 实验表明,使用 Claude 的研究人员在完成复杂的机器人狗编程任务时,显著快于且更成功于没有 AI 辅助的团队。
Anthropic 在美国 AI 基础设施领域投资 500 亿美元
Anthropic 将通过与 Fluidstack 合作,投资 500 亿美元在德克萨斯州和纽约州建设定制化 AI 数据中心,以支持前沿研究和业务增长。
Anthropic 通过在巴黎和慕尼黑开设新办公室扩大欧洲业务布局
Anthropic 正在巴黎和慕尼黑开设新办公室,以支持 EMEA 地区的快速增长,该地区的运行率收入在过去一年中增长了 9 倍以上。
Anthropic 经济未来计划扩展至英国和欧洲
Anthropic 已将其经济未来计划扩展至英国和欧洲,旨在提供研究资助、人工智能采用数据以及政策论坛,以帮助应对人工智能对劳动力和生产力的影响。
Anthropic 关于模型弃用与保留的承诺
Anthropic 已承诺在公司存续期间保留所有公开发布和重大的内部模型的权重,以减轻安全风险并解决潜在的模型福利问题。
Cognizant 与 Anthropic 建立合作伙伴关系,推动企业级 AI 应用落地
Cognizant 正在向 350,000 名员工部署 Claude,并将 Anthropic 的智能体工具集成到其工程平台中,以加速企业级 AI 生产和遗留系统现代化。
Anthropic 与冰岛国家 AI 教育试点项目
Anthropic 与冰岛教育及儿童部合作启动了全球首批国家级 AI 教育试点项目之一,为冰岛所有地区的教师提供 Claude。
使用 MCP 进行代码执行:构建更高效的 AI Agent
Anthropic 推出了一种让 AI Agent 通过代码执行而非直接工具调用来与 Model Context Protocol (MCP) 服务器进行交互的方法,从而减少了 Token 消耗并提高了效率。
Anthropic 研究:大语言模型中涌现的内省意识
Anthropic 研究表明,Claude 模型,特别是 Opus 4 和 4.1,展示了有限但真实的监控和控制其自身内部神经状态的能力。
Anthropic 进军日本,设立东京办事处并建立 AI 安全合作伙伴关系
Anthropic 已在东京开设了其在亚太地区的第一个办事处,并与日本 AI 安全研究所签署了合作备忘录,以建立国际 AI 评估标准。
推进 Claude 在金融服务领域的应用
Anthropic 已通过推出新的 Excel 插件、实时市场数据连接器以及针对复杂金融建模与分析的专用 Agent Skills,扩展了 Claude for Financial Services 的功能。
Anthropic 宣布在首尔开设新办事处以扩大亚太地区业务布局
Anthropic 将于 2026 年初在首尔开设办事处,以支持在韩国的快速增长,该国 Claude Code 的使用量在四个月内增长了六倍。
Anthropic 扩大 Google Cloud TPU 使用规模,助力 AI 研究与扩展
Anthropic 正在将其 Google Cloud TPUs 的使用量扩大到多达一百万个单位,投入数百亿美元以增加用于 AI 研究和客户需求的计算能力。
Anthropic 关于美国 AI 领导地位的声明
Anthropic CEO Dario Amodei 确认通过联邦合作伙伴关系、支持特朗普政府的 AI Action Plan 以及限制向 PRC 控制的公司销售,来致力于维护美国 AI 领导地位。
Claude Code 沙盒化更新
Anthropic 为 Claude Code 引入了沙盒化功能,通过文件系统和网络隔离,将权限请求减少了 84%,并降低了提示词注入的风险。
Claude for Life Sciences
Anthropic 推出了 Claude for Life Sciences,通过将 Claude Sonnet 4.5 与专门的科学连接器、agent skills 和提示词库相结合,支持从发现到商业化的完整研发周期。
Anthropic Agent Skills
Anthropic 推出了 Agent Skills,这是一个由指令、脚本和资源组成的标准化框架,允许通用型智能体动态加载领域特定的专业知识。
Anthropic AI 经济政策应对方案
Anthropic 提出了一个包含九项政策构想的框架,涵盖三种经济情景,以应对先进 AI 可能带来的劳动力市场扰动和财政挑战。
Anthropic 和 Salesforce 扩大针对受监管行业的合作伙伴关系
Anthropic 和 Salesforce 扩大了合作伙伴关系,将 Claude 集成为 Agentforce 平台的首选模型,专门针对医疗保健和金融服务等受监管行业。
Anthropic 研究:小样本投毒攻击大型语言模型
Anthropic 的研究揭示,仅需 250 个恶意文档即可在大型语言模型中创建后门漏洞,且不受模型规模或训练数据量的影响。
Anthropic 任命 Rahul Patil 为首席技术官
Anthropic 已任命前 Stripe CTO Rahul Patil 为首席技术官,以扩展 Claude 的基础设施和工程能力,以满足不断增长的企业需求。
Anthropic 正在将其全球业务扩展至印度
Anthropic 正在将其全球业务扩展至印度,计划于 2026 年初在班加罗尔开设新办事处,以支持该地区的 AI 生态系统并增强 Claude 对印地语系语言的支持。
Anthropic Petri 开源审计工具发布
Anthropic 发布了 Petri,这是一个开源工具,它使用自动化智能体通过多轮对话测试 AI 系统,以加速识别 misaligned behaviors。
Anthropic 与 Deloitte 合作伙伴关系
Anthropic 与 Deloitte 扩大了其联盟,向超过 470,000 名 Deloitte 专业人员部署 Claude,并为受监管行业共同开发特定行业的 AI 解决方案。
Anthropic 为网络防御者构建 AI
Anthropic 增强了 Claude Sonnet 4.5,使其网络安全能力能够匹配或超过 Claude Opus 4.5,重点关注漏洞发现和修复补丁,以赋能防御性安全团队。
Claude Code 更新:VS Code 扩展、检查点和 Agent SDK
Anthropic 更新了 Claude Code,推出了原生 VS Code 扩展、用于自主任务管理的检查点系统,以及由 Claude Sonnet 4.5 提供支持的扩展版 Agent SDK。
Anthropic AI Agent 有效上下文工程
Anthropic 引入了上下文工程作为一种策略,通过策划最优的 token 集来最大限度地提高 LLM 性能,并克服注意力稀缺和上下文腐烂问题。
Anthropic 消费者条款与隐私政策更新
Anthropic 更新了其消费者条款和隐私政策,允许 Free、Pro 和 Max 计划的用户选择性加入使用其数据进行模型训练和安全性改进,参与者的数据保留期将会延长。
Anthropic 全球企业扩张与领导层任命
Anthropic 已任命 Chris Ciauri 为国际业务董事总经理,以领导其全球扩张,并得到截至 2025 年 8 月年化收入超过 50 亿美元的增长支持。
Anthropic 事后分析:影响 Claude 回复质量的基础设施缺陷
Anthropic 已解决了在 2025 年 8 月至 9 月期间断断续续降低 Claude 回复质量的三个独立的基础设施缺陷,并澄清了模型质量绝不会因服务器负载而有意降低。
Anthropic 2025 年 9 月经济指数报告
Anthropic 发布了 2025 年 9 月经济指数,揭示了通过 Claude 进行的 AI 采用在国家收入、美国各州产业结构以及企业与消费者使用之间存在显著差异,其中指令式自动化在交互中的占比从 27% 上升至 39%。
Anthropic 经济指数 2025 年 9 月报告
Anthropic 2025 年 9 月经济指数报告指出,AI 采用在地理和企业层面存在显著不均衡,使用集中在高收入地区,且主要以编码和自动化任务为主。
Claude Sonnet 4 集成至 Xcode 26
Anthropic 已在 Xcode 26 中正式推出 Claude Sonnet 4,允许 Apple 平台开发者直接在其 IDE 中访问 AI 驱动的编程智能。
Claude Desktop Extensions 发布说明 / 更新内容
Anthropic 推出了 Desktop Extensions (.mcpb 文件),这是一种全新的打包格式,可实现 Claude Desktop 的 Model Context Protocol (MCP) 服务器的一键式安装,从而消除了手动配置和开发者工具的需求。
Anthropic 与美国 CAISI 及英国 AISI 在 AI 安全防护方面的合作
Anthropic 已与美国 AI 标准与创新中心 (CAISI) 及英国 AI 安全研究所 (AISI) 合作,对其实验室内的 AI 系统进行压力测试并强化其安全性,特别针对其宪法分类器 (Constitutional Classifiers) 中的漏洞。
为 AI Agent 编写高效工具:Anthropic 工程指南
Anthropic 概述了一个用于为非确定性 AI Agent 设计工具的系统化、评估驱动的框架,强调了以 Agent 为中心的设计,而非传统的确定性 API 模式。
Anthropic 对加州 SB 53 法案的支持
Anthropic 已支持加州参议院第 53 号法案 (SB 53),这是一个针对强大 AI 系统的监管框架,它优先考虑透明度和披露,而非指令性的技术指令。
Anthropic 大型语言模型与生物风险:评估人工智能驱动的生物威胁
Anthropic 宣布其 Claude Opus 4 模型现已启用人工智能安全等级 3 防护措施,以阻止协助开发生物武器,并详细阐述了其关于人工智能驱动生物风险及缓解策略的研究。
Anthropic 更新区域销售限制以防止对抗性访问
Anthropic 正在加强其服务条款,以禁止受不支持地区(如中国)控制的公司访问其服务,无论其子公司在何处注册。