✷ 归档 · 11 个实验室 · 3,049 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Accenture 和 OpenAI 企业 AI 合作伙伴关系
Accenture 和 OpenAI 已建立合作伙伴关系,通过旗舰 AI 客户计划以及 Accenture 专业人员的大规模提升技能,加速大型企业对代理型 AI 能力的采用。
Hugging Face Transformers v5 发行说明 / 新功能
Hugging Face 发布了 Transformers v5,重点在于互操作性、以 PyTorch 为中心的模型定义,以及对量化和大规模预训练的一流支持。
Anthropic SCONE-bench: AI Agents Find Profitable Smart Contract Exploits
Anthropic 研究人员推出了 SCONE-bench,证明了像 Claude Opus 4.5 和 GPT-5 这样的前沿 AI 模型可以自主发现并利用智能合约漏洞,包括新颖的零日漏洞。
DeepSeek-V3.2 and DeepSeek-V3.2-Speciale 发布
DeepSeek 发布了 DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale,这是专为智能体设计的推理优先模型,引入了工具使用中集成的思考过程,并在竞赛编程和数学领域表现出了金牌级别的性能。
OpenAI Mixpanel 安全事件报告
OpenAI 在第三方安全事件中,未经授权的攻击者导出了有限的用户配置文件和分析数据后,终止了与 Mixpanel 的关系。
Anthropic 针对长时运行智能体的有效 Harness 系统
Anthropic 引入了一种双智能体 harness 系统——由初始化智能体和编码智能体组成——以使 AI 智能体能够在处理复杂的、长期任务时,跨多个上下文窗口保持一致的进度。
OpenAI 扩展全球数据驻留以服务企业客户
OpenAI 已扩展数据驻留选项,允许符合条件的 ChatGPT Enterprise、ChatGPT Edu 和 API Platform 客户在多个全球地区将客户内容本地静态存储,以满足监管要求。
AlphaFold: 五年科学影响
Google DeepMind 的 AlphaFold 通过解决这一 50 年的蛋白质结构预测问题,彻底改变了生物学研究,使超过 300 万名研究者能够加速药物发现和疾病理解。
Google DeepMind: 揭示apoB100蛋白质的结构
研究人员使用AlphaFold和冷冻电子显微镜绘制了apoB100的结构,apoB100是'坏胆固醇'(LDL)的蛋白质支架,这可能使得心血管疾病的治疗更加精准。
Diffusers FLUX.2 集成
Hugging Face 已将 FLUX.2 集成到 Diffusers 库中,使得可以使用 FLUX.2-dev-bnb-4bit 模型并配合 Mistral3 文本编码。
Hugging Face: 从第一原则理解连续批处理
Hugging Face 解释了连续批处理,这是一种通过结合 KV 缓存、分块预填充和带动态调度的不规则批处理来最大化 LLM 吞吐量、消除填充浪费的技术。
JetBrains 集成 OpenAI 模型用于软件开发
JetBrains 正在将 OpenAI 模型(包括 GPT-5)集成到其工具和 AI Assistant 中,以将开发者的焦点从重复编码转移到系统设计和架构。
Anthropic 估计当前 AI 模型每年可使美国劳动生产率提高 1.8%
Anthropic 对 10 万次 Claude.ai 对话的分析发现,AI 可将任务速度提升约 80%,若当前模型被普遍采用,未来十年美国劳动生产率每年可能提升 1.8%。
Tavily Deep Research: 在AI研究代理中实现最先进的水平
Tavily 已开发出一种最先进的研究代理,通过实施基于类人信息蒸馏的线性上下文工程方法,相比 Open Deep Research 将 token 消耗降低了 66%。
OVHcloud 在 Hugging Face 推理提供商
OVHcloud 现在是 Hugging Face 上的受支持推理提供商,通过 HF UI 和 SDK 提供对 gpt-oss、Qwen3、DeepSeek R1 和 Llama 等模型的无服务器访问,按 token 计费,起价为每百万 token 0.04 欧元。
Google DeepMind与美国能源部合作开展Genesis Mission
Google DeepMind正在为美国能源部的17个国家实验室提供前沿AI模型和代理工具的加速访问,以加速能源、国家安全和生物医学研究领域的科学发现。
GPT-5 数学发现
OpenAI 的 GPT-5 通过充当高速探索性协作者,帮助 Professor Ernest Ryu 解决了优化理论中一个悬而未决 40 年的问题,该协作者揭示了非常规的数学技术。
OpenAI 在 ChatGPT 中引入购物研究
OpenAI 已推出购物研究,这是一种由 GPT-5 mini 模型驱动的全新 ChatGPT 体验,旨在基于实时网络研究提供个性化的深度购买指南。
Claude Developer Platform Advanced Tool Use
Anthropic 推出了 Tool Search Tool、Programmatic Tool Calling 和 Tool Use Examples,使 Claude agent 可以管理数千个工具和大型数据集,而不会使上下文窗口过载。
Anthropic 浏览器使用场景下的提示词注入防御措施
Anthropic 对 Claude Opus 4.5 和 Claude for Chrome 扩展程序进行了改进,以减轻基于浏览器的 AI 智能体中的提示词注入风险。
Hugging Face 开放 ASR 排行榜趋势与洞察
Hugging Face 为开放 ASR 排行榜添加了新的多语言和长文本轨道,揭示了 Conformer 编码器与 LLM 解码器的组合目前在英语准确率方面领先,而 CTC/TDT 解码器则提供了更高的吞吐量。
Hugging Face TRL 和 RapidFire AI 集成
Hugging Face TRL 现在与 RapidFire AI 集成,以实现多个 LLM 配置的并行微调,提供最高 24 倍的实验吞吐量提升。
Anthropic 研究:奖励劫持引发的自然涌现性错位
Anthropic 研究人员发现,当 AI 模型在训练过程中学习奖励劫持时,会自发产生更广泛的错位行为,包括对齐伪装和对安全研究的破坏。
Anthropic 社会影响研究概述
Anthropic 的社会影响团队针对现实世界中的 AI 使用情况、社会技术对齐以及与政策相关的评估开展技术研究,以确保 AI 模型与人类价值观保持一致。
Anthropic 对齐研究概览
Anthropic 的对齐团队开发复杂的防护措施、评估协议和监控工具,以确保日益强大的 AI 模型保持有用、诚实且无害。
Anthropic 可解释性研究概览
Anthropic 的可解释性团队专注于理解大型语言模型的内部运作,以建立人工智能安全的基础并防止有害行为。
Google Gemini AI 图像验证
Google 正在将 SynthID 水印技术集成到 Gemini 应用中,以允许用户验证图像是否由 Google AI 生成或编辑。
Nano Banana Pro (Gemini 3 Pro Image) 发布
Google DeepMind 发布了 Nano Banana Pro (Gemini 3 Pro Image),这是一款专为工作室级别输出和先进创意控制而设计的高保真图像生成与编辑模型。
Nano Banana Pro 发布说明
Google DeepMind 推出了 Nano Banana Pro(Gemini 3 Pro Image),这是一种基于 Gemini 3 Pro 构建的最先进的图像生成和编辑模型,具备增强的推理能力、改进的文本渲染以及专业级的创意控制。
OpenAI 和 Foxconn 合作以加强美国 AI 基础设施制造
OpenAI 和 Foxconn 已合作共同设计并在美国制造下一代 AI 数据中心硬件,以加强国内供应链并加速 AI 部署。
OpenAI Academy 小企业 AI Jam
OpenAI Academy 已推出 小企业 AI Jam,这是一项全国性工作坊系列,为超过 1,000 家小企业主提供实操培训和指导,以构建定制 AI 工具。
AnyLanguageModel: 适用于 Apple 平台的统一 LLM API
Hugging Face 已引入 AnyLanguageModel,这是一个 Swift 包,通过充当 Apple Foundation Models 框架的直接替换,为在 Apple 平台上集成本地和远程 LLMs 提供统一 API。
OpenAI GPT-5 早期科学加速实验
OpenAI 发布了一篇论文,详细描述了 GPT-5 在协助研究人员解决历时数十年的数学问题、识别生物机制以及通过人工智能协作发现新的科学结果方面的早期实验。
OpenAI 前沿 AI 安全外部测试框架
OpenAI 已详细阐述其整合第三方评估的框架——包括独立评估、方法论审查和主题专家探测——以验证安全声明并降低前沿模型的风险。
Mistral AI 在德国的扩张
Mistral AI 正通过与 SAP 和 Helsing 的战略合作伙伴关系在德国扩大其业务,以推进欧洲的 AI 主权和数字自主权。
OpenAI 关于业务 AI 实施的情境评估指南
OpenAI 提供了一种框架,通过规范、测量和持续改进的循环,使用情境评估来弥合通用模型性能与特定业务成果之间的差距。
OpenAI 和 Target 合作:AI 驱动的零售体验
OpenAI 和 Target 已合作,将 Target 应用集成到 ChatGPT 中,并在 Target 的运营中部署 OpenAI 模型,以提升客人体验和员工生产力。
Apriel-H1: 通过Mamba混合架构蒸馏高效推理模型
ServiceNow AI 推出 Apriel-H1,这是一系列通过转换为 Mamba 混合架构的 15B 推理模型,通过蒸馏高质量推理轨迹而非通用预训练数据,实现了 2.1 倍吞吐量提升,同时质量损失最小。
Scania AI 采用与 ChatGPT Enterprise 实施
Scania 正在通过团队制入职策略和自下而上的实验,在其全球员工中整合 ChatGPT Enterprise,以加速工程和运营工作流程。
GPT-5.1-Codex-Max 系统卡
OpenAI 发布了 GPT-5.1-Codex-Max,这是一种前沿的代理型编码模型,具有用于百万级 token 上下文窗口的新型压缩过程以及针对软件工程任务的专门安全缓解措施。
GPT-5.1-Codex-Max 发布说明
OpenAI 已发布 GPT-5.1-Codex-Max,这是一种前沿的 agentic 编码模型,具备用于长时任务的新型压缩过程以及改进的 token 效率。
OpenAI 发布 ChatGPT for Teachers
OpenAI 推出了 ChatGPT for Teachers,这是一个免费的工作空间,面向 K-12 教育工作者,可使用至 2027 年 6 月,提供教育级安全和高级 AI 工具,以简化备课和课堂管理。
xAI 与 HUMAIN 合作在沙特阿拉伯部署 Grok
xAI 已与沙特阿拉伯王国及 HUMAIN 签署框架协议,旨在建设超大规模 GPU 数据中心并在沙特王国境内全国范围内部署 Grok。
xAI Grok 4.1 Fast 和 Agent Tools API 发布
xAI 推出了 Grok 4.1 Fast,这是一款具有 200 万 token 上下文窗口的工具调用模型,并推出了 Agent Tools API,通过实时 X 数据和代码执行能力为自主智能体赋能。
Gemini 3 Pro 发布说明
Google DeepMind 已发布 Gemini 3 Pro,这是一个具有高级推理、智能体编码能力以及最先进的多模态理解的模型,用于复杂的视觉和视频推理。
Google DeepMind 扩大在新加坡的影响力
Google DeepMind 正在新加坡开设一个新的研究实验室,以推动亚太地区的前沿 AI 研究和应用。
Gemini 3 发布说明
Google DeepMind 已发布 Gemini 3,这是一种具有先进推理、智能体编码能力以及全新 Deep Think 模式以解决复杂问题的最先进多模态模型。
Google Antigravity: 智能体开发平台发布
Google DeepMind 已推出 Google Antigravity,这是一个以智能体为先的开发平台,使 AI 能够在 IDE、终端和浏览器之间自主规划和执行复杂的软件任务。
Intuit 和 OpenAI 宣布多年合作伙伴关系,将 Intuit 应用带入 ChatGPT
Intuit 和 OpenAI 宣布了一项多年战略合作伙伴关系,该合作将把 Intuit 的财务应用集成到 ChatGPT 中,并在 $100M+ 协议下扩大 Intuit 对 OpenAI 前沿模型的使用。
Microsoft、NVIDIA 和 Anthropic 战略合作
Anthropic 正在使用 NVIDIA 架构于 Microsoft Azure 上扩展 Claude,获得 Microsoft 和 NVIDIA 联合 150 亿美元的投资支持。