851

GPT-5-Codex 发布与安全附录

OpenAI 已发布 GPT-5-Codex,这是一款通过在真实任务上进行强化学习而优化用于代理式编码的 GPT-5 版本。

852

OpenAI 与美国 CAISI 和英国 AISI 的安全合作

OpenAI 与美国人工智能标准与创新中心(CAISI)以及英国人工智能安全研究所(UK AISI)合作,对代理式 AI 和生物安全防护措施进行深入的红队测试和漏洞检测。

853

Writer Palmyra-mini 家族发布

Writer 发布了 Palmyra-mini 家族,这是一套轻量级开源模型(1.5B 至 1.7B 参数),包括一个基础模型和两个针对逻辑与数学优化的专门推理变体。

854

OpenAI 和 Microsoft 合作伙伴关系更新

OpenAI 和 Microsoft 已签署一份非约束性谅解备忘录,进入合作的下一阶段,重点是 AI 工具交付和安全。

855

OpenAI 非营利组织与公共利益公司(PBC)结构演进

OpenAI 正在演进其结构,使其非营利实体控制公共利益公司(PBC),并持有超过 1000 亿美元的股权,以资助其确保通用人工智能(AGI)惠及全人类的使命。

856

Transformers 4.40 对 OpenAI GPT‑OSS 的性能升级:零构建内核、MXFP4 量化、并行化以及更快的加载

Hugging Face 为 OpenAI 的 GPT‑OSS 模型在 transformers 库中加入了零构建内核、MXFP4 4 位量化、张量和专家并行、动态滑动窗口缓存、连续批处理以及更快的模型加载,显著提升了效率和可扩展性。

857

使用 Together AI 对 Hugging Face Hub LLM 进行微调

Together AI 与 Hugging Face 已集成平台,使开发者能够使用 Together AI 的基础设施微调来自 Hugging Face Hub 的任何兼容 LLM。

858

Jupyter Agents:训练 LLM 在笔记本中进行推理

Hugging Face 推出了一套用于生成高质量合成数据并优化脚手架的流水线,将 Qwen3-4B 等小型 LLM 转变为最先进的数据科学代理。

859

SafetyKit Risk Agents powered by OpenAI Models

SafetyKit 利用 GPT-5、GPT-4.1 和其他 OpenAI 模型,以超过 95% 的准确率对 100% 的客户内容进行欺诈和违规活动自动化检测。

860

mmBERT:ModernBERT 走向多语言

Hugging Face 推出 mmBERT,这是一款在 3 万亿以上 token、覆盖 1,800 多种语言的超大规模多语言编码器模型,在性能和推理速度上均优于 XLM‑R。

861

OpenAI 以人为本 AI 基金

OpenAI 已开启 5000 万美元基金的申请,向美国非营利组织提供无限制的资助,以推动 AI 素养、社区创新和经济机会。

862

OpenAI 研究:语言模型为何产生幻觉

OpenAI 认为,语言模型产生幻觉是因为标准的训练和评估流程奖励猜测而非承认不确定性,而不是由于神秘的故障。

863

OpenAI for Greece 合作伙伴关系启动教育试点和 AI 加速器

OpenAI 宣布了 ‘OpenAI for Greece’ 合作伙伴关系,在中学启动 ChatGPT Edu 试点,并设立希腊 AI 加速器以促进本地 AI 初创企业,这标志着在希腊教育和创新领域嵌入先进 AI 的重要一步。

864

OpenAI 通过 AI 项目扩大经济机会

OpenAI 宣布了 OpenAI 工作平台和 OpenAI 认证,帮助员工获得 AI 能力并与雇主对接,目标是到 2030 年为 1000 万美国人颁发认证。

865

EmbeddingGemma 300M 发布说明

Google 发布了 EmbeddingGemma,这是一款 308M 参数的多语言嵌入模型,在 500M 以下模型的 MTEB 基准中名列前茅,并针对设备端使用进行了优化。

866

SandboxAQ SAIR 数据集发布

SandboxAQ 已发布 SAIR,这是规模最大的共折叠 3D 蛋白-配体结构数据集,配有实验 IC₅₀ 标签,提供超过 500 万 AI 生成的结构,以加速 AI 驱动的药物发现。

867

OpenAI 收购 Statsig 并任命 Vijaye Raji 为应用部门首席技术官

OpenAI 已收购实验平台 Statsig,并任命其创始人兼 CEO Vijaye Raji 为应用部门首席技术官,负责领导 ChatGPT 和 Codex 的产品工程。

868

OpenAI 更新 ChatGPT 安全与福祉举措

OpenAI 正在实施为期 120 天的计划,以提升 ChatGPT 对心理健康危机的响应,并为青少年引入家长控制功能,该计划由医学专家网络指导。

869

Hugging Face ZeroGPU 预编译指南

Hugging Face 为 ZeroGPU Spaces 引入了提前编译(AoT)功能,通过消除即时编译开销,使 Flux、Wan、LTX 等生成模型的加速范围达到 1.3 倍至 1.8 倍。

870

word2vec 学到的内容:特征学习的闭式理论

BAIR 研究人员提出了一种预测性理论,证明 word2vec 的学习可以简化为无权重的最小二乘矩阵分解,学习得到的表示实际上是对特定目标矩阵进行主成分分析(PCA)的结果。

871

OpenAI gpt-realtime 与 Realtime API 正式上线

OpenAI 发布了高性能语音到语音模型 gpt-realtime,并正式开放 Realtime API,新增对图像输入、远程 MCP 服务器以及 SIP 电话呼叫的支持。

872

OpenAI 支持非营利组织和社区创新基金

OpenAI 正在开启 5000 万美元基金的申请,向美国境内的 501(c)(3) 非营利组织和社区组织提供无限制的资助,以促进面向公共利益的 AI 驱动创新。

873

OpenAI 集体对齐与模型规范更新

OpenAI 推出了集体对齐研究工作,将来自 1,000 多名全球参与者的公众偏好整合到其模型规范中,以确保 AI 默认行为体现多元的人类价值观。

874

OpenAI 和 Anthropic 联合安全评估发现

OpenAI 和 Anthropic 发布了联合安全评估结果,显示 Claude 4 模型在指令层级方面表现出色,而 OpenAI 的推理模型在越狱抵抗方面领先,双方实验室均强调了跨实验室协作对 AI 对齐的价值。

875

OpenAI 心理健康与危机干预保障措施

OpenAI 详细阐述了其在 ChatGPT 中管理心理健康危机的分层安全体系,包括 GPT-5 提升的响应准确性以及直接紧急服务整合的计划。

876

OpenAI 学习加速器印度发布

OpenAI 在印度推出了学习加速器,通过战略性机构合作,为数百万教育工作者和学生提供 AI 研究、培训和 ChatGPT 许可证。

877

OpenAI 与 Retro Biosciences:使用 GPT-4b micro 加速生命科学

OpenAI 与 Retro Biosciences 开发了 GPT-4b micro,这是一种专门的蛋白质工程模型,重新设计了 Yamanaka 因子,使干细胞重编程的表达水平比野生型对照高出超过 50 倍。

878

Blue J 使用 GPT-4.1 扩大税务研究规模

Blue J 利用 GPT-4.1 和专有的 RAG 系统自动化美国、加拿大和英国的复杂税务研究,将不同意率降低至每 700 条响应中不足 1 条。

879

NVIDIA Nemotron 后训练数据集 v2 与 Nemotron Nano 2 9B 发布

NVIDIA 发布了一个包含 600 万样本的多语言推理数据集以及 Nemotron Nano 2 9B 模型,该模型采用混合 Transformer-Mamba 架构,以优化推理成本和吞吐量。

880

MIXI ChatGPT 企业部署

MIXI 在 45 天内在整个组织中部署了 ChatGPT Enterprise,使部分项目的工作时间减少了超过 90%,并让员工创建了超过 1,600 个自定义 GPT。

881

使用 Claude 与 Hugging Face 生成图像

Hugging Face 通过将 AI 连接到 Hugging Face Spaces 的 Model Context Protocol (MCP) 服务器,实现了在 Claude 中进行图像生成。

882

Qwen-Image-Edit 发布说明

Qwen-Image-Edit 是一个拥有 20B 参数的图像编辑模型,利用 Qwen2.5-VL 和 VAE Encoder,实现精确的语义与外观编辑,包括双语文本修改。

883

Hugging Face MCP for Research:将 AI 连接到研究工具

Hugging Face 推出 Research Tracker MCP,使 AI 代理能够通过模型上下文协议(Model Context Protocol)集成 arXiv、GitHub 和 Hugging Face,实现研究发现的自动化。

884

Hugging Face kernel-builder:构建和扩展生产就绪 CUDA 内核的指南

Hugging Face 引入了 kernel-builder 库,以通过 Hugging Face Hub 简化生产就绪 CUDA 内核的开发、多架构编译和分发。

885

DoorDash AI 实施策略

DoorDash 正在利用 AI 实现技术创作的民主化,使非工程师也能参与,并个性化员工发展与绩效管理。

886

Kimina-Prover-RL 发布

Hugging Face 发布了 Kimina-Prover-RL,这是一个用于 Lean 4 形式化定理证明的开源 RL 训练流水线以及两个 SOTA 模型(0.6B 和 1.7B)。

887

Arm 与 ExecuTorch 0.7:将生成式 AI 扩展至数十亿设备

Arm 与 ExecuTorch 0.7 beta 通过 KleidiAI 实现自动 AI 加速,利用 SDOT 指令将 Llama 3.2 等大语言模型带到数十亿现有的基于 Arm 的设备上。

888

Arm 神经超采样 (NSS) 发布

Arm 已发布 Neural Super Sampling (NSS),这是一种旨在降低 GPU 工作负载并在移动设备上实现高分辨率渲染的 AI 驱动升采样解决方案。

889

FilBench:评估大型语言模型在菲律宾语言中的能力

Hugging Face 推出了 FilBench,这是一套综合评估工具,旨在评估大型语言模型在塔加洛语、菲律宾语和宿务语方面的流利度、语言能力和文化知识。

890

TextQuests:评估基于文本视频游戏中的LLM代理推理

Hugging Face 推出 TextQuests,这是一项使用 25 款经典 Infocom 互动小说游戏的基准,用于评估 LLM 代理的长上下文推理和探索能力。

891

Basis 通过 OpenAI GPT-5 和 o3 扩大了会计自动化

Basis 使用由 OpenAI 的 GPT-5、GPT-4.1 和 o3 模型驱动的多代理架构来自动化复杂的会计工作流,为会计事务所实现最高 30% 的时间节省。

892

OpenAI 对加州统一 AI 监管的提案

OpenAI 已呼吁州长 Gavin Newsom 将加州的 AI 监管与国家和全球标准对齐,以防止零散的州级法规阻碍创新和美国竞争力。

893

Hugging Face AI Sheets 发布

Hugging Face 发布了 AI Sheets,这是一款开源的无代码工具,用于使用开放的 AI 模型构建、转换和丰富数据集。

894

Accelerate ND-Parallel:高效多 GPU 训练指南

Hugging Face 已将 ND-Parallelism 集成到 Accelerate 和 Axolotl 中,使用户能够组合数据并行、完全分片数据并行、张量并行和上下文并行策略,以优化大规模模型的多 GPU 训练。

895

OpenAI GPT-5 发布说明

OpenAI 已发布 GPT-5,这是一款统一模型,整合了推理、代理和高级数学能力,以提升业务运营的准确性、速度和问题解决能力。

896

GPT-5 开发者发布说明

OpenAI 已发布三种规模的 GPT-5(gpt-5、gpt-5-mini 和 gpt-5-nano),在编码、代理工具调用和长上下文检索方面实现了最先进的性能。

897

GPT-5 编码与设计能力

OpenAI 宣布了 GPT-5,重点提升了编码和设计的能力,但公告中未提供具体的技术细节。

898

OpenAI GPT-5 创意写作能力

OpenAI 宣布了 GPT-5 的新创意写作能力,扩展了模型生成高质量叙事和艺术文本的能力。

899

医学研究与 GPT-5

OpenAI 已宣布将 GPT-5 应用于医学研究,扩大了模型在专业科学领域的实用性。

900

TRL 中的视觉语言模型对齐

Hugging Face 已扩展 TRL 库以支持视觉语言模型的高级对齐方法,包括 MPO、GRPO 和 GSPO,此外还包括原生的 SFT 支持和 vLLM 集成。