归档 · 11 个实验室 · 3,048 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

451

Anthropic 与 TCS 合作推动受监管行业的应用

Anthropic 与塔塔咨询服务公司(TCS)达成合作,将 Claude 部署至 50,000 名 TCS 员工,并向医疗健康和金融服务等高度受监管行业的企业提供基于 Claude 的 AI 解决方案。

452

Anthropic 根据美国政府指令暂停 Fable 5 和 Mythos 5 的使用

Anthropic 为遵守美国政府因担心模型可能被越狱而提出的国家安全相关的出口管制指令,已为所有客户禁用了 Fable 5 和 Mythos 5 的访问权限。

453

Anthropic 公共记录:美国公众对人工智能的看法

Anthropic 对近52,000名美国人的首次公共记录调查显示,尽管对人工智能驱动的医疗突破抱有强烈期望,但公众普遍高度担忧失业问题,并广泛支持政府监管。

454

PyTorch 性能分析(第 2 部分):从 nn.Linear 到融合的 MLP

摘要:Hugging Face 解释了如何通过分析 GPU 内核融合、`torch.compile` 的影响以及使用 `kernels` 库的手工调优内核来优化 PyTorch 中的多层感知机(MLP)。

455

BBVA 与 OpenAI 就 AI 原生银行业务达成战略合作

BBVA 已与 OpenAI 建立战略联盟,旨在将其全球业务中的人工智能进行整合,将 ChatGPT Enterprise 的应用规模扩大到 100,000 名员工,并实施了名为“The Eight”的全面 AI 转型路线图。

456

OpenAI 收购 Ona 以实现 Codex 持久云执行

OpenAI 正在收购 Ona,将安全云执行和编排技术整合到 Codex 中,使 AI 代理能够独立于用户的活跃会话,执行复杂且长期的任务。

457

OpenAI 支持欧盟关于 AI 生成内容透明度的行为准则

OpenAI 已宣布支持欧盟委员会关于 AI 生成内容透明度的行为准则,以实施欧盟 AI 法案并提升数字来源可追溯性。

458

使用 OpenAI Codex 加速黑洞等离子体模拟

天体物理学家 Chi-kwan Chan 正在使用 OpenAI Codex 推导和测试新的数值算法,以减少模拟黑洞周围粒子运动的计算开销。

459

Anthropic 与 DXC Technology 全球联盟

Anthropic 与 DXC Technology 已达成多年期全球联盟,旨在将 Claude 集成到受监管行业的关键任务系统中,并辅以一项旨在认证数万名工程师的计划。

460

Anthropic 推出 Claude Corps 赋能计划

Anthropic 推出了 Claude Corps,这是一项价值 1.5 亿美元的国家级赋能计划,旨在培训 1,000 名早期职业专业人士,将人工智能解决方案应用于美国非营利组织。

461

Grok Build 插件市场发布

xAI 已推出 Grok Build 插件市场,这是一个内置目录,允许开发者安装和发布插件,将技能、代理和 MCP 服务器打包集成到 Grok Build 中。

462

Ollama Apple Silicon MLX 引擎更新

Ollama 更新了其 MLX 引擎,通过支持 NVFP4、内核融合 (kernel fusion) 以及针对智能体工作流的新型状态快照系统,提升了在 Apple Silicon 上的性能。

463

OpenAI 和 Oracle Cloud Infrastructure 集成

OpenAI 和 Oracle 正在合作,以允许 Oracle Cloud Infrastructure (OCI) 客户将符合条件的 Oracle Universal Credits 用于 OpenAI 前沿模型和 Codex。

464

DiffusionGemma: 通过文本扩散实现4倍更快的文本生成

Google DeepMind 已发布 DiffusionGemma,这是一个实验性的 26B MoE 模型,利用文本扩散同时生成文本块,相比自回归模型在专用 GPU 上实现最高 4 倍更快的推理。

465

OpenAI 破坏与 PRC 关联的影响行动,针对美国 AI 辩论

OpenAI 已封禁两组与中国相关的 ChatGPT 账户簇,这些账户利用 AI 秘密操纵美国关于 AI 基础设施和技术政策的公众辩论。

466

Google DeepMind 多智能体 AI 安全研究资助呼吁

Google DeepMind 及其合作伙伴宣布了一项 $10M 资助呼吁,以研究大规模多智能体 AI 系统的安全性和稳定性,以减轻由相互作用的独立智能体产生的新兴风险。

467

DiffusionGemma: 首个在 vLLM 中获得原生支持的 Diffusion LLM

vLLM 已集成 DiffusionGemma,这是一个 26B 参数的离散扩散语言模型,通过迭代式地对 Token 块进行去噪而非顺序自回归解码,实现了高吞吐量、低延迟的生成。

468

LSEG 通过 OpenAI 集成扩展可信 AI

伦敦证券交易集团(LSEG)已集成 ChatGPT Enterprise 和 OpenAI API,将产品发布周期从月份缩短至周,并提升全球员工生产力。

469

xAI 与 eToro 将实时 X 市场情绪集成到 Tori AI 智能体中

eToro 已通过 API 集成了 SpaceXAI 模型,为其 AI 智能体 Tori 提供来自 X 平台的实时市场情绪和实时信号。

470

Gemini 3.5 Live Translate 发布说明

Google DeepMind 发布了 Gemini 3.5 Live Translate,这是一款音频模型,可为 70 多种语言提供近乎实时的语音对语音翻译,同时保留说话者的语调和音高。

471

Gemma 4 12B 发行说明 / 新功能

Google DeepMind 已发布 Gemma 4 12B,这是一个专为在配备 16GB RAM 的笔记本电脑上本地执行而设计的无编码器多模态模型,具备原生音频和视觉处理能力。

472

Google DeepMind 加速器:机器人项目启动

Google DeepMind 在欧洲推出了一个机器人加速器,选拔了 15 家早期机器人初创公司,以获得三个月的技术支持和访问 Gemini 机器人模型的机会。

473

Nextdoor 工程团队集成 OpenAI Codex

Nextdoor 利用 OpenAI Codex 和 GPT-5.5 使单个工程师能够实现端到端产品所有权,将工程瓶颈从实现转移到战略规划。

474

Hugging Face Spaces agents.md 实现自动化 3D 多媒体流水线

一个编程智能体通过串联两个现有的 Space,自动构建了一个以 3D Gaussian splats 形式展示巴黎古迹的静态 Hugging Face Space,展示了 `agents.md` 如何将任何 Space 转化为多媒体流水线中可组合的构建模块。

475

OpenAI Codex 在 Notion 的集成

Notion 正在使用 OpenAI Codex 自动化功能开发,使工程师和经理能够在几小时而不是几周内交付生产就绪代码。

476

vime RL 框架发布

vLLM 推出 vime,这是一个开源的 RL 后训练框架,它将 Megatron 训练与 vLLM 推理相结合,以提供一个稳定且高效的 LLM 强化学习管道。

477

OpenAI 智能时代的工业政策

OpenAI 已提出一套以人为本的工业政策思想,以确保超智能的益处得到广泛共享,并启动了一项资助计划以支持相关研究。

478

将 GitHub CI 迁移到 Hugging Face Jobs

Hugging Face 提供了一种在无服务器 Hugging Face Jobs 基础设施上运行 GitHub Actions 的方法,实现 GPU 加速的 CI,并将 CPU 作业运行时间降低多达 30%。

479

xAI 与 Gopuff 推出 Go AI 购物助手

Gopuff 与 xAI 已推出 Go,这是一款由 Grok 文本、音频和图像模型驱动的多模态 AI 购物助手,旨在提供个性化、预测性的购物体验。

480

OpenAI 保密 S-1 提交

OpenAI 已向 SEC 提交了一份保密的 S-1 草案,为公司提供了在保持私有状态以追求特定目标的同时选择上市的选项。

481

Google DeepMind 引导学习 AI 在塞拉利昂的试验

塞拉利昂的一项预登记试验表明,AI 驱动的引导学习可以在八周内将数学进步提升多达典型学习的 2.5 年,前提是它被用作教师主导的增强工具。

482

OpenAI 关于 AGI 分发与发展的战略计划

OpenAI 已宣布一项战略计划,以确保 AGI 惠及全人类,通过专注于自动化 AI 研究、经济加速以及向地球上的每个人提供个人 AGI。

483

OpenAI 经济研究交流启动

OpenAI 已启动经济研究交流,以向外部研究人员提供 OpenAI 工具和数据集的访问权限,以产生关于 AI 经济影响的独立实证证据。

484

OpenEnv: 标准化开源 AI 的 Agentic RL 环境

摘要: Hugging Face 已将 OpenEnv 过渡到一个社区协调项目,以充当 agentic 强化学习环境的互操作层。

485

OpenAI Economic Research Exchange Launch

OpenAI 已推出 OpenAI Economic Research Exchange,以支持外部研究人员就 AI 对工人、企业和机构的经济影响产生实证、独立的证据。

486

Anthropic 发布 gget virus:确定性检索层显著提升 AI 代理在病毒序列数据上的准确性

Anthropic 推出了 gget virus,一个确定性检索工具,将 AI 代理在病毒序列查询上的准确率从不足 100% 提升至超过 99%,突显了构建代理友好型生物数据基础设施的必要性。

487

Anthropic 评估大型语言模型对 N 日漏洞利用的影响

Anthropic 表明,其前沿模型 Claude Mythos Preview 可在数小时内自主创建针对 Firefox 和 Windows 内核补丁的可工作 N 日漏洞利用,显著缩短了传统的补丁差距窗口。

488

vLLM Semantic Router v0.3 Themis 发布说明

vLLM Semantic Router v0.3 Themis 引入了有状态的生产级路由,其特点是会话感知智能体路由 (SAAR)、规范的配置契约,以及对 AMD ROCm 和 Intel OpenVINO 扩展的硬件支持。

489

Anthropic Claude Opus 4.7 化学版本发布:NMR 预测与结构解析

Anthropic 宣布 Claude Opus 4.7 可以实现与 ChemDraw 相当的 ¹H/¹³C NMR 谱图预测精度,并能从 1D NMR 数据中推断结构,标志着迈向 AI 辅助化学工作流程的第一步。

490

Ollama 0.30 发布,新增 GGUF 模型支持并提升 NVIDIA 性能高达 20%

Ollama 0.30 通过 llama.cpp 引入了 GGUF 模型兼容性,并在 NVIDIA GPU 上提供了高达 20% 的吞吐量提升,同时通过默认的 Vulkan 加速扩展了硬件支持。

491

NVIDIA Nemotron 3.5 内容安全发布

NVIDIA 发布了 Nemotron 3.5 Content Safety,这是一个拥有 4B 参数的多模态、多语言安全模型,具有自定义策略执行功能和可选的推理轨迹,适用于企业级 AI。

492

Endava AI 集成:使用 OpenAI Agents 重新设计软件交付

Endava 在其 11,000 人员工队伍中集成了 OpenAI 技术,以重新设计软件交付和运营工作流程,将 AI 从生产力工具转变为核心运营模型。

493

ChatGPT 做梦记忆更新

OpenAI 推出了一种基于 '做梦' 的更强大且计算效率更高的记忆架构,以改善 ChatGPT 如何合成、更新和回忆用户上下文、偏好和时敏感信息。

494

NVIDIA Nemotron 3 Ultra 在 vLLM 上的支持

vLLM 宣布对 NVIDIA Nemotron 3 Ultra 提供 Day-0 支持,这是一个 550B 参数的模型,通过混合 Transformer-Mamba MoE 架构针对长时间运行的自主代理工作流程进行了优化。

495

OpenAI 在智能时代的生物防御行动计划

OpenAI 已推出生物防御行动计划,通过为负责任的防御者配备先进的 AI 能力(具体利用 GPT-Rosalind 模型)来增强生物韧性。

496

Hugging Face hf CLI 针对智能体优化重构,降低了 Token 使用量并提升了成功率

Hugging Face 宣布对 hf CLI 进行了针对智能体优化的重构,将 Token 使用量降低了高达 6 倍,并提高了 Claude Code 和 Codex 等编程智能体的成功率。

497

NVIDIA Nemotron 3 Ultra 发布

NVIDIA Nemotron 3 Ultra 是一款拥有 550B 参数的开源模型,针对长时运行的智能体工作流进行了优化,具有 1M token 上下文窗口并采用 NVFP4 量化以实现高效率。

498

GPT-Rosalind 更新:增强生命科学能力和研究工具

OpenAI 已更新 GPT-Rosalind,将 GPT-5.5 的 agentic 能力与药物化学、基因组学和湿实验故障排除的专业智能相结合,以服务于企业级生命科学研究。

499

TITLE: 直接偏好优化:超越聊天机器人

SUMMARY: 提供的源材料是来自 Hugging Face 的 429 限流错误页面,且不包含有关直接偏好优化的任何技术内容。

500

Wasmer 如何使用 OpenAI Codex 为边缘计算构建 Node.js 运行时

Wasmer 使用 OpenAI Codex 开发了 Edge.js,这是一种能够在 WebAssembly 沙箱中运行 Node.js 工作负载的 JavaScript 运行时,将开发时间从预计的一年缩短到了两周。