551

TRUSTBANK Choice AI:使用多代理架构个性化故乡税(Furusato Nozei)

TRUSTBANK 将 OpenAI 的 GPT-4.1 系列通过多代理 AI 系统集成到其 Furusato Choice 平台,帮助纳税人在日本故乡税捐赠项目中浏览超过 760,000 件回礼礼品。

552

Indeed AI 集成更新

关于 Indeed 如何使用 AI 发展求职搜索的公告的源材料目前因服务器错误而不可用。

553

Qwen3-Max-Thinking 发布说明

Qwen 已发布 Qwen3‑Max‑Thinking,这款旗舰推理模型具备自适应工具使用和多轮测试时扩展策略,可与 GPT‑5.2‑Thinking 和 Claude‑Opus‑4.5 竞争。

554

OpenAI Codex CLI 代理循环技术概述

OpenAI 解释了 Codex CLI 的代理循环架构,详细说明了它如何通过提示缓存和压缩来管理模型推理、提示构建和上下文窗口优化。

555

扩展 PostgreSQL 以支持 8 亿 ChatGPT 用户

OpenAI 通过使用单主架构、近 50 个只读副本以及积极的工作负载优化,将 PostgreSQL 扩展至支持 8 亿用户和每秒数百万查询。

556

ChatGPT 企业采用模式与 GPT-5 集成

OpenAI 报告称,ChatGPT 正在各行业自下而上地被采用,GPT-5 引入实时路由器,以自动化业务工作流中高级功能的使用。

557

Praktika AI 语言学习架构

Praktika 利用由 GPT-5.2 和 GPT-5 Pro 驱动的多代理系统,通过实时对话 AI 提供个性化、适应性的语言辅导。

558

Qwen3-TTS 发布说明:开源语音设计、克隆与生成

Qwen 已开源 Qwen3-TTS 系列,提供 0.6B 与 1.7B 参数规模的模型,实现高保真语音克隆、基于自然语言的语音设计以及跨 10 种语言的超低延迟流式语音生成。

559

Higgsfield AI 视频平台与 OpenAI 模型的集成

Higgsfield 是一个生成式媒体平台,利用 GPT-4.1、GPT-5 和 Sora 2 将产品链接和简单创意转化为电影化、社交优先的短视频。

560

AssetOpsBench:弥合 AI 代理基准与工业现实之间的差距

Hugging Face 与 IBM Research 推出 AssetOpsBench,这是一套综合基准,旨在评估工业资产生命周期管理中的多代理 AI 系统,重点关注安全关键的故障模式和运营约束。

561

OpenAI 结束能力超前报告及倡议

OpenAI 发布了关于 AI 能力超前的研究,并扩展了其 OpenAI for Countries 计划,帮助各国政府将 AI 融入教育、健康和公共服务,以防止经济分化。

562

OpenAI 教育国家项目启动

OpenAI 推出 Education for Countries 项目,该项目与政府和大学合作,将 ChatGPT Edu、GPT‑5.2 等 AI 工具嵌入 K‑12 和高等教育体系,旨在弥合能力悬垂,帮助学生为 AI 驱动的职场做好准备。

563

OpenAI Horizon 1000:推动初级医疗的 AI 发展

OpenAI 与盖茨基金会已启动 Horizon 1000,这是一项价值 5000 万美元的倡议,旨在于 2028 年前在非洲各国(首站卢旺达)的 1,000 家初级医疗诊所中整合 AI 能力。

564

OpenAI Stargate 社区计划公告

OpenAI 宣布了 Stargate 社区计划,承诺自行资助能源、最小化用水,并在扩展 AI 基础设施以实现 2029 年 10 GW 目标的过程中创造本地就业。

565

自DeepSeek Moment以来的一年:中国开源AI生态的崛起

Hugging Face 分析了 DeepSeek R1 的发布如何催化了中国向开源 AI 的巨大转变,导致高性能开源模型激增,如今这些模型在全球下载指标中占据主导地位。

566

ServiceNow 与 OpenAI 的可操作企业 AI 合作伙伴关系

ServiceNow 与 OpenAI 合作,将 GPT-5.2 和多模态功能集成到其 AI 平台,使企业能够在 IT、财务和人力资源领域自动化复杂工作流。

567

差分 Transformer V2

提供的 Differential Transformer V2 源材料由于 429 Too Many Requests 错误而不可用,且未检索到任何技术内容。

568

OpenAI 对 ChatGPT 的年龄预测

OpenAI 正在 ChatGPT 消费者计划中部署年龄预测模型,以自动为可能未满 18 岁的用户应用青少年安全防护措施。

569

Waypoint-1:来自 Overworld 的实时交互式视频扩散模型

Overworld 已发布 Waypoint-1,这是一款在 10,000 小时游戏素材上训练的实时交互式视频扩散模型,能够通过文本、鼠标和键盘实现零延迟的世界交互。

570

OpenAI 商业模式与计算扩展策略

OpenAI 实施了一种随智能价值扩展的商业模式,通过多元化的计算组合和多层次变现,实现了 2023 年至 2025 年收入十倍增长。

571

ChatGPT Go 全球发布

OpenAI 已将 ChatGPT Go(美国每月 8 美元的低价订阅计划)扩展至所有可用市场,以提升全球对 GPT-5.2 Instant 的访问。

572

OpenAI 广告策略与 ChatGPT Go 扩展

OpenAI 正在将每月 8 美元的 ChatGPT Go 层级扩展到美国及所有可用市场,并将在免费和 Go 层级开始测试广告,以提高 AI 的可访问性。

573

OpenAI 对 Merge Labs 的投资

OpenAI 正在参与 Merge Labs 的种子轮融资,该研究实验室致力于开发高带宽脑机接口(BCI),以连接生物智能和人工智能。

574

OpenAI 通过国内制造加强美国 AI 供应链的倡议

OpenAI 已启动一项提案请求(RFP),以识别并启用美国本土制造关键 AI 基础设施组件,包括数据中心硬件、消费电子和机器人。

575

Hugging Face 开放响应推理标准

Hugging Face 推出了 Open Responses,这是一种基于 Responses API 的开放推理标准,旨在取代用于代理式 AI 工作流的 Chat Completion 格式。

576

OpenAI 与 Cerebras 合作实现低延迟推理

OpenAI 正与 Cerebras 合作,将其专用 AI 系统集成到其推理栈中,以加速 AI 模型响应并实现实时 AI 交互。

577

Veo 3.1 发布说明:增强的原料到视频功能与 4K 升级

Google DeepMind 发布了 Veo 3.1,引入了改进的身份和对象一致性用于图像到视频的生成、原生竖屏视频支持以及 1080p 和 4K 分辨率的升级。

578

Zenken 案例研究:使用 ChatGPT Enterprise 扩展销售和运营

Zenken 已集成 ChatGPT Enterprise,实现知识工作自动化,年外包成本节省 5000 万日元,最终提案批准率提升 30%。

579

基于信息驱动的成像系统设计

BAIR 的研究人员开发了一个基于互信息的框架,用于评估和优化成像系统,使得在无需任务特定解码器的情况下即可实现高性能硬件设计。

580

OpenAI 与软银集团与 SB Energy 的合作伙伴关系

OpenAI 与软银集团各自向 SB Energy 投资 5 亿美元,以加速 AI 数据中心园区和能源基础设施的建设,其中包括位于 Milam County 的 1.2 GW 场址。

581

Datadog 将 OpenAI Codex 集成用于系统级代码审查

Datadog 已将 OpenAI Codex 部署给超过 1,000 名工程师,用于在代码审查中识别系统性风险和跨服务依赖,成功检测出 22% 的历史事故,这些事故是人工审查遗漏的。

582

OpenAI for Healthcare 发布

OpenAI 已推出 OpenAI for Healthcare,这是一套符合 HIPAA 的工具,包括 ChatGPT for Healthcare 和 OpenAI API,旨在减轻临床医生的行政负担并提升护理的一致性。

583

Netomi 将代理系统扩展到企业 – 来自 OpenAI 的经验教训

Netomi 宣布了一款生产级代理平台,该平台结合了用于低延迟工具使用的 GPT‑4.1 和用于深度多步骤规划的 GPT‑5.2,实现了亚 3 秒响应、98% 意图准确率以及企业级规模的内置治理。

584

Qwen3-VL-Embedding 与 Qwen3-VL-Reranker 发布

Qwen 已发布 Qwen3-VL-Embedding 与 Qwen3-VL-Reranker,这是一系列针对文本、图像、截图和视频的高精度跨模态检索的多模态模型。

585

Tolan 如何使用 GPT-5.1 构建语音优先 AI

Tolan 利用 GPT-5.1 和自定义实时上下文管理系统,创建了一个具有持久记忆和一致人格的低延迟语音优先 AI 伴侣。

586

ChatGPT Health 发布说明

OpenAI 已推出 ChatGPT Health,这是一个专用且安全的体验,它整合了个人医疗记录和健康应用数据,帮助用户在不替代临床护理的情况下导航健康信息。

587

NVIDIA Cosmos Reason 2 发布说明 / 新功能

NVIDIA 已发布 Cosmos Reason 2,这是一款面向物理 AI 的开放推理视觉语言模型,位居 Physical AI Bench 和 Physical Reasoning 排行榜首位。

588

Falcon-H1-Arabic 发布说明

Hugging Face 宣布了 Falcon-H1-Arabic,这是一系列三种混合 Mamba-Transformer 模型(3B、7B 和 34B),在扩展上下文窗口最高可达 256K tokens 的情况下,为阿拉伯语自然语言处理设定了新的最先进基准。

589

NVIDIA DGX Spark 和 Reachy Mini 集成指南

NVIDIA 通过结合 DGX Spark 硬件、Reachy Mini 机器人技术以及使用开放推理和视觉模型的 NeMo Agent Toolkit,推出了一种创建真实世界 AI 代理的框架。

590

OpenAI Grove 第二期公告

OpenAI 已开放 OpenAI Grove 第二期的申请,该项目旨在支持尚未有想法的技术人才构建 AI 驱动的公司。

591

Qwen-Image-2512 发布说明 / 新功能

Qwen-Image-2512 是对 Qwen-Image 文本到图像模型的十二月更新,显著提升了人物真实感、自然细节渲染以及复杂文字布局的准确性。

592

Google DeepMind 2025 年度回顾:Gemini 3、Gemma、AI 产品、科学与安全突破

Google DeepMind 宣布了 2025 年在 Gemini 3 模型、开源 Gemma、AI 驱动的产品、生成式媒体、科学 AI、量子计算、安全框架以及全球合作方面的突破,标志着 AI 从工具向实用性的转变。

593

AprielGuard:现代大型语言模型系统中的安全与对抗鲁棒性护栏

Hugging Face 和 ServiceNow AI 推出了 AprielGuard,这是一款拥有 8B 参数的安全防护模型,旨在检测 16 类安全风险以及在单独提示、多轮对话和代理工作流中的广泛对抗攻击。

594

Qwen-Image-Edit-2511 发布说明

Qwen-Image-Edit-2511 是一个更新的图像编辑模型,提升了角色一致性,集成了社区 LoRAs,并增强了几何推理和工业设计能力。

595

Qwen3-TTS-VD-Flash 与 Qwen3-TTS-VC-Flash 发布:可控语音设计与快速多语言语音克隆

Qwen 推出了用于自然语言语音设计的 Qwen3‑TTS‑VD‑Flash 和用于 3 秒多语言语音克隆的 Qwen3‑TTS‑VC‑Flash,两者在可控性和准确性方面均优于领先的 TTS 系统。

596

ChatGPT Atlas: 加固浏览器代理以抵御提示注入

OpenAI 使用经过强化学习训练的自动化攻击者实施了一个主动的快速响应循环,以在野外被利用之前发现并缓解 ChatGPT Atlas 中的提示注入漏洞。

597

OpenAI 客户增长与企业采用

OpenAI 已突破一百万企业客户,75% 的用户报告能够完成以前无法完成的任务。

598

Qwen-Image-Layered:层次化分解实现内在可编辑性

Qwen-Image-Layered 是一种新模型,可将图像分解为多个 RGBA 层,实现对图像组件的独立操作而不影响其他内容。

599

OpenAI 评估链式思考可监控性

OpenAI 引入了一个框架和 13 项评估来衡量“可监控性”——即从模型内部推理预测其行为的能力——并发现监控链式思考的效果显著优于仅监控输出。

600

OpenAI Model Spec 更新:未满18岁(U18)原则

OpenAI 已更新其 Model Spec,加入未满18岁(U18)原则,为 ChatGPT 建立适龄行为准则,以优先保障13至17岁青少年的安全并提供现实世界的支持。