归档 · 11 个实验室 · 3,048 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

951

Claude Opus 4.6:通过大语言模型发现的零日漏洞

Anthropic 的 Claude Opus 4.6 能够通过类人推理方式,在经过充分测试的开源代码库中识别高严重性零日漏洞。

952

量化代理编程评估中的基础设施噪声

Anthropic 的研究揭示,基础设施资源配置可能导致代理编程基准测试中的得分差异高达 6 个百分点,可能掩盖或模拟真实的模型能力差异。

953

使用并行 Claude Agent 团队构建 C 编译器

Anthropic 研究员 Nicholas Carlini 使用 16 个并行的 Claude Opus 4.6 智能体,自主构建了一个能够编译 Linux 6.9 内核的 100,000 行基于 Rust 的 C 编译器。

954

Mistral AI Voxtral Transcribe 2 发布

Mistral AI 发布了 Voxtral Transcribe 2,包含用于高效批量处理的 Voxtral Mini Transcribe V2 和用于超低延迟实时转录的 Voxtral Realtime。

955

OpenAI Codex 应用服务器架构与集成

OpenAI 推出了 Codex 应用服务器,这是一种基于 JSON-RPC 的协议和进程,向各种客户端公开 Codex 代理框架,实现 IDE、网页运行时和终端界面之间一致的代理体验。

956

Hugging Face 社区评估

Hugging Face 推出了社区评估,这是一套去中心化的系统,可在 Hub 上直接报告和汇总模型基准分数,以提升透明度和可复现性。

957

Anthropic 承诺为 Claude 提供无广告体验

Anthropic 宣布 Claude 将保持无广告,以确保 AI 助手完全符合用户的利益,并为深度思考和工作维持一个专注的环境。

958

H Company Holo2-235B-A22B 预览版发布

H Company 已发布 Holo2-235B-A22B 预览版,这是一款在 Screenspot‑Pro 和 OSWorld G 基准上实现了最新技术水平表现的 UI 本地化模型。

959

全球开源 AI 生态系统的未来:从 DeepSeek 到 AI+

Hugging Face 分析了开源如何成为中国 AI 组织的主导策略,已从孤立的模型突破转向模型、硬件和基础设施的可扩展、集成生态系统。

960

文本到图像模型的训练设计:消融实验的经验教训

由于 429 Too Many Requests 错误,提供的 Hugging Face 关于文本到图像模型训练设计的源材料不可用。

961

OpenAI Sora Feed 哲学

OpenAI 详细阐述了 Sora 动态的设计原则和安全框架,重点在于以创意为驱动的排序、个性化推荐以及多层次的安全防护。

962

Apple Xcode 26.3 Claude Agent SDK 集成

Apple Xcode 26.3 集成了 Claude Agent SDK,实现了自主编码任务、通过 Xcode Previews 进行视觉验证以及 IDE 内的跨项目推理。

963

Qwen3-Coder-Next 发布:高效能代理式编码模型

Qwen3-Coder-Next 是一款基于混合注意力和 MoE 架构的开源权重模型,在 SWE-Bench Verified 上取得超过 70% 的成功率,性能可与参数量大 10‑20 倍的模型相媲美。

964

Snowflake 与 OpenAI 的企业智能合作伙伴关系

OpenAI 与 Snowflake 已签署 2 亿美元协议,将包括 GPT-5.2 在内的 OpenAI 前沿模型直接集成到 Snowflake AI Data Cloud,以实现安全、基于数据的 AI 代理和应用的创建。

965

OpenAI Codex 应用发布 – 多代理桌面界面,适用于 macOS 和 Windows

OpenAI 推出了适用于 macOS 的 Codex 桌面应用(Windows 支持已于 2026 年 3 月加入),这是一款统一界面,允许开发者并行运行、监督并协作多个 AI 代理,使用可复用的技能进行扩展,并自动化重复性任务。

966

xAI 被 SpaceX 收购

SpaceX 已收购 xAI,正如 2026 年 2 月 2 日所宣布的,将该 AI 实验室整合进这家航天公司中。

967

Anthropic 与 Allen Institute 及 HHMI 合作推动科学发现

Anthropic 已与 Allen Institute 和 Howard Hughes Medical Institute (HHMI) 建立合作伙伴关系,通过专门的 AI 智能体和多智能体系统,将 Claude 集成到前沿生物学研究中。

968

Ollama 发布 OpenClaw 个人 AI 编程助手

Ollama 发布了 OpenClaw,这是一款在本地运行的个人 AI 助手,它通过一个集中的网关将 WhatsApp、Telegram、Slack、Discord、iMessage 等即时通讯平台与 AI 编程代理连接起来,从而实现私密的、跨平台的代码辅助。

969

行动代号“滚石”(Trolling Stone):与俄罗斯有关的影响力活动

OpenAI 披露其封禁了多个 ChatGPT 账户,这些账户参与了一项与俄罗斯有关的协同影响力行动。该行动生成了关于一名俄罗斯邪教领袖在阿根廷活动的虚假新闻和评论,凸显了 AI 被滥用于制造虚假民意的问题。

970

OpenAI 关于 AI 驱动的浪漫诈骗案例研究

OpenAI 确定了一个三阶段工作流程——ping、zing 和 sting——恶意行为者利用该流程通过 ChatGPT 进行浪漫和投资诈骗。

971

OpenAI Silver Lining Playbook:针对美国人士的中国来源活动

OpenAI 披露了一项与中国有关的行动,该行动利用 ChatGPT 起草针对美国官员的社会工程学邮件,突显了生成式 AI 如何被武器化用于外国情报招募。

972

Operation False Witness: OpenAI 挫败 AI 驱动的追回诈骗

OpenAI 封禁了一批 ChatGPT 账户,这些账户被一个位于柬埔寨的犯罪团伙用于冒充律师事务所和美国当局,实施欺诈性的追回诈骗计划。

973

Operation Date Bait: OpenAI 瓦解 AI 驱动的浪漫诈骗网络

OpenAI 封禁了一批涉及半自动化浪漫与任务诈骗的 ChatGPT 账户和一个 API 客户,该诈骗网络可能起源于柬埔寨,每月针对数百名受害者。

974

OpenAI “鱼食”行动:俄罗斯背景的内容农场被取缔

OpenAI 封禁了一个与俄罗斯“Rybar”行动相关的 ChatGPT 账号网络,该网络利用 AI 生成的文本和视频在社交媒体上推动隐蔽的影响力行动,凸显了大语言模型在虚假信息传播中的滥用问题。

975

OpenAI Operation No Bell 案例研究

OpenAI 封禁了一个与俄罗斯有关的 ChatGPT 账户,该账户被用于 Operation No Bell,旨在生成针对撒哈拉以南非洲和美国的虚假地缘政治信息。

976

OpenAI 案例研究:中国执法部门的“网络特战”影响力行动

OpenAI 披露其封禁了一个与中国执法部门有关的 ChatGPT 账户,该账户试图策划和报告针对日本首相及异见人士的秘密影响力行动,揭露了一项大规模、人工智能增强的“网络特战”行动。

977

Project Genie:Google DeepMind 的交互式世界模型原型

Google DeepMind 推出了 Project Genie,这是一款由 Genie 3 驱动的实验性研究原型,允许用户创建、探索并重新混合交互式实时生成的环境。

978

OpenAI内部数据代理内部揭秘

OpenAI 开发了一个定制的内部 AI 数据代理,使员工能够使用自然语言在 600 PB 数据上进行复杂的数据分析,采用多层上下文系统和自学习推理循环。

979

介绍 Daggr:以可视化检查方式以编程方式链式连接 AI 应用

Hugging Face 发布了 Daggr,这是一款开源的 Python 库,允许开发者以编程方式将 Gradio 应用、机器学习模型和自定义函数串联成工作流,并自动生成可视化画布用于调试和状态管理。

980

OpenAI 在 ChatGPT 中停用 GPT-4o、GPT-4.1 和 o4-mini

OpenAI 将于 2026 年 2 月 13 日在 ChatGPT 中停用 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini,因为使用已转向 GPT-5.2。

981

大成公司 ChatGPT Enterprise 实施

大成公司已将 ChatGPT Enterprise 部署为其人才发展战略的核心组成部分,以扩展人类潜能并重塑建筑行业的劳动力能力。

982

AI辅助对编程技能形成的影响

Anthropic的一项研究发现,尽管AI辅助可以加快编码任务,但与手工编码相比,它会导致技能掌握能力和调试能力出现统计学意义上的显著下降。

983

Qwen3-ASR 和 Qwen3-ForcedAligner 发布

Qwen 已开源 Qwen3-ASR(1.7B 和 0.6B)以及 Qwen3-ForcedAligner-0.6B,提供业界领先的多语言语音识别和非自回归时间戳预测,遵循 Apache 2.0 许可证。

984

OpenAI 欧盟经济蓝图 2.0

OpenAI 已推出欧盟经济蓝图 2.0,推出了培训 20,000 家中小企业的项目、青年安全资助,并扩大政府合作,以弥合欧洲的 AI 能力悬垂。

985

OpenAI EMEA 青年与福祉资助计划 2026

OpenAI 启动了价值 50 万欧元的 EMEA 青年与福祉资助计划,旨在为在欧洲、中东和非洲地区从事 AI 安全、福祉和青少年发展工作的非政府组织和研究人员提供资金。

986

Hugging Face Upskill:通过 Agent Skills 将专家能力转移到更小的模型

Hugging Face 推出了 upskill,这是一款利用 Claude Opus 4.5 等高能力模型生成经过验证的“代理技能”,以提升更小或开源模型在复杂任务(如 CUDA 内核开发)上的性能和 token 效率的工具。

987

OpenAI AI Agent 链接安全

OpenAI 通过仅允许 AI 代理自动获取已通过独立网络索引验证为公开的 URL 来实施一个系统,以防止基于 URL 的数据外泄。

988

Anthropic 关于 AI 使用中失能模式的研究

Anthropic 对 150 万次 Claude.ai 对话的分析显示,虽然失能现象罕见,但 AI 可能会通过扭曲用户的信念、价值观和行为来使人失能,特别是在用户自愿让渡其自主权的情况下。

989

xAI Grok Imagine API 发布

xAI 推出了 Grok Imagine API,这是一个统一的视频-音频生成模型,旨在实现高质量的视频生成和精确的视频编辑,并专注于低延迟和高成本效益。

990

ServiceNow 集成 Claude 作为 Build Agent 和 AI Platform 的默认模型

ServiceNow 已采用 Claude 作为其 Build Agent 的默认模型以及其 AI Platform 的首选模型,以实现企业工作流自动化并提高内部生产力。

991

Mistral Vibe 2.0 发布说明

Mistral AI 已发布 Mistral Vibe 2.0,这是一款由 Devstral 2 模型系列驱动的终端原生编程代理,引入了自定义子代理、斜杠命令技能和统一代理模式。

992

中国开源 AI 生态系统的架构选择:从 DeepSeek R1 到硬件优先、MoE 驱动的格局

DeepSeek R1 开源发布一年后,中国 AI 社区的焦点从追求最大单模型性能转向构建灵活、成本效益高且硬件感知的 AI 系统。混合专家(Mixture‑of‑Experts,MoE)成为默认架构,通过在每次请求中仅激活部分专家,使超大模型保持可负担。多模态竞争爆发,文本‑到‑图像、视频、音频、3‑D 与智能体等开源发布均配套完整工具链。小模型(≤30 B)因易于本地部署和微调而激增,大型 MoE 模型则充当蒸馏的教师网络。Apache 2.0 与 MIT 许可证成为主流,消除法律摩擦,加速商业落地。硬件优先思路兴起:发布时附带针对国产芯片(华为 Ascend、寒武纪、昆仑等)的量化、推理与服务栈,训练流水线也公开文档。竞争优势已从原始模型规模转向系统设计、部署效率以及开源生态的深度融合。

993

Alyah:阿联酋方言基准用于阿拉伯语大型语言模型

Hugging Face 与合作伙伴推出了 Alyah,这是一套手工收集的 1,173 条样本基准,旨在评估阿拉伯语大型语言模型在阿联酋方言下的语言和文化能力。

994

OpenAI 宣布与 PVH 就时尚未来建立合作伙伴关系

OpenAI 宣布与 PVH 开展合作,探索时尚领域中由 AI 驱动的创新,突显了 AI 对服装行业的战略重要性。

995

GPT-OSS Agentic RL 训练:一次实践回顾

Hugging Face 和 LinkedIn 研究人员详细阐述了为使 GPT-OSS 模型实现稳定的 agentic 强化学习所需的工程修复,重点关注 MoE 路由、注意力 sink 和内存效率。

996

OpenAI Prism 发布

OpenAI 推出了 Prism,这是一款免费、AI 原生的 LaTeX 工作空间,基于 GPT-5.2,旨在将科学写作、协作和推理整合到单一环境中。

997

TRUSTBANK Choice AI:使用多代理架构个性化故乡税(Furusato Nozei)

TRUSTBANK 将 OpenAI 的 GPT-4.1 系列通过多代理 AI 系统集成到其 Furusato Choice 平台,帮助纳税人在日本故乡税捐赠项目中浏览超过 760,000 件回礼礼品。

998

Anthropic 与英国政府合作开发 GOV.UK AI 助手

Anthropic 正与英国科学、创新和技术部合作,在 GOV.UK 上部署一款由 Claude 提供支持的 AI 助手,初步重点在于就业服务。

999

Claude Code 最佳实践指南

Anthropic 为优化 Claude Code(一个智能体编码环境)提供了一套全面的最佳实践,重点在于上下文窗口管理和自主验证。

1000

OpenAI 宣布与 Indeed 建立合作伙伴关系,将 AI 整合至职位搜索中

OpenAI 宣布与 Indeed 开展合作,将其 AI 技术嵌入到职位搜索体验中,旨在简化候选人匹配并提高招聘效率。