TRUSTBANK Choice AI:使用多代理架构个性化故乡税(Furusato Nozei)
TRUSTBANK 将 OpenAI 的 GPT-4.1 系列通过多代理 AI 系统集成到其 Furusato Choice 平台,帮助纳税人在日本故乡税捐赠项目中浏览超过 760,000 件回礼礼品。
Indeed AI 集成更新
关于 Indeed 如何使用 AI 发展求职搜索的公告的源材料目前因服务器错误而不可用。
Qwen3-Max-Thinking 发布说明
Qwen 已发布 Qwen3‑Max‑Thinking,这款旗舰推理模型具备自适应工具使用和多轮测试时扩展策略,可与 GPT‑5.2‑Thinking 和 Claude‑Opus‑4.5 竞争。
OpenAI Codex CLI 代理循环技术概述
OpenAI 解释了 Codex CLI 的代理循环架构,详细说明了它如何通过提示缓存和压缩来管理模型推理、提示构建和上下文窗口优化。
扩展 PostgreSQL 以支持 8 亿 ChatGPT 用户
OpenAI 通过使用单主架构、近 50 个只读副本以及积极的工作负载优化,将 PostgreSQL 扩展至支持 8 亿用户和每秒数百万查询。
ChatGPT 企业采用模式与 GPT-5 集成
OpenAI 报告称,ChatGPT 正在各行业自下而上地被采用,GPT-5 引入实时路由器,以自动化业务工作流中高级功能的使用。
Praktika AI 语言学习架构
Praktika 利用由 GPT-5.2 和 GPT-5 Pro 驱动的多代理系统,通过实时对话 AI 提供个性化、适应性的语言辅导。
Qwen3-TTS 发布说明:开源语音设计、克隆与生成
Qwen 已开源 Qwen3-TTS 系列,提供 0.6B 与 1.7B 参数规模的模型,实现高保真语音克隆、基于自然语言的语音设计以及跨 10 种语言的超低延迟流式语音生成。
Higgsfield AI 视频平台与 OpenAI 模型的集成
Higgsfield 是一个生成式媒体平台,利用 GPT-4.1、GPT-5 和 Sora 2 将产品链接和简单创意转化为电影化、社交优先的短视频。
AssetOpsBench:弥合 AI 代理基准与工业现实之间的差距
Hugging Face 与 IBM Research 推出 AssetOpsBench,这是一套综合基准,旨在评估工业资产生命周期管理中的多代理 AI 系统,重点关注安全关键的故障模式和运营约束。
OpenAI 结束能力超前报告及倡议
OpenAI 发布了关于 AI 能力超前的研究,并扩展了其 OpenAI for Countries 计划,帮助各国政府将 AI 融入教育、健康和公共服务,以防止经济分化。
OpenAI 教育国家项目启动
OpenAI 推出 Education for Countries 项目,该项目与政府和大学合作,将 ChatGPT Edu、GPT‑5.2 等 AI 工具嵌入 K‑12 和高等教育体系,旨在弥合能力悬垂,帮助学生为 AI 驱动的职场做好准备。
OpenAI Horizon 1000:推动初级医疗的 AI 发展
OpenAI 与盖茨基金会已启动 Horizon 1000,这是一项价值 5000 万美元的倡议,旨在于 2028 年前在非洲各国(首站卢旺达)的 1,000 家初级医疗诊所中整合 AI 能力。
OpenAI Stargate 社区计划公告
OpenAI 宣布了 Stargate 社区计划,承诺自行资助能源、最小化用水,并在扩展 AI 基础设施以实现 2029 年 10 GW 目标的过程中创造本地就业。
自DeepSeek Moment以来的一年:中国开源AI生态的崛起
Hugging Face 分析了 DeepSeek R1 的发布如何催化了中国向开源 AI 的巨大转变,导致高性能开源模型激增,如今这些模型在全球下载指标中占据主导地位。
ServiceNow 与 OpenAI 的可操作企业 AI 合作伙伴关系
ServiceNow 与 OpenAI 合作,将 GPT-5.2 和多模态功能集成到其 AI 平台,使企业能够在 IT、财务和人力资源领域自动化复杂工作流。
差分 Transformer V2
提供的 Differential Transformer V2 源材料由于 429 Too Many Requests 错误而不可用,且未检索到任何技术内容。
OpenAI 对 ChatGPT 的年龄预测
OpenAI 正在 ChatGPT 消费者计划中部署年龄预测模型,以自动为可能未满 18 岁的用户应用青少年安全防护措施。
Waypoint-1:来自 Overworld 的实时交互式视频扩散模型
Overworld 已发布 Waypoint-1,这是一款在 10,000 小时游戏素材上训练的实时交互式视频扩散模型,能够通过文本、鼠标和键盘实现零延迟的世界交互。
OpenAI 商业模式与计算扩展策略
OpenAI 实施了一种随智能价值扩展的商业模式,通过多元化的计算组合和多层次变现,实现了 2023 年至 2025 年收入十倍增长。
ChatGPT Go 全球发布
OpenAI 已将 ChatGPT Go(美国每月 8 美元的低价订阅计划)扩展至所有可用市场,以提升全球对 GPT-5.2 Instant 的访问。
OpenAI 广告策略与 ChatGPT Go 扩展
OpenAI 正在将每月 8 美元的 ChatGPT Go 层级扩展到美国及所有可用市场,并将在免费和 Go 层级开始测试广告,以提高 AI 的可访问性。
OpenAI 对 Merge Labs 的投资
OpenAI 正在参与 Merge Labs 的种子轮融资,该研究实验室致力于开发高带宽脑机接口(BCI),以连接生物智能和人工智能。
OpenAI 通过国内制造加强美国 AI 供应链的倡议
OpenAI 已启动一项提案请求(RFP),以识别并启用美国本土制造关键 AI 基础设施组件,包括数据中心硬件、消费电子和机器人。
Hugging Face 开放响应推理标准
Hugging Face 推出了 Open Responses,这是一种基于 Responses API 的开放推理标准,旨在取代用于代理式 AI 工作流的 Chat Completion 格式。
OpenAI 与 Cerebras 合作实现低延迟推理
OpenAI 正与 Cerebras 合作,将其专用 AI 系统集成到其推理栈中,以加速 AI 模型响应并实现实时 AI 交互。
Veo 3.1 发布说明:增强的原料到视频功能与 4K 升级
Google DeepMind 发布了 Veo 3.1,引入了改进的身份和对象一致性用于图像到视频的生成、原生竖屏视频支持以及 1080p 和 4K 分辨率的升级。
Zenken 案例研究:使用 ChatGPT Enterprise 扩展销售和运营
Zenken 已集成 ChatGPT Enterprise,实现知识工作自动化,年外包成本节省 5000 万日元,最终提案批准率提升 30%。
基于信息驱动的成像系统设计
BAIR 的研究人员开发了一个基于互信息的框架,用于评估和优化成像系统,使得在无需任务特定解码器的情况下即可实现高性能硬件设计。
OpenAI 与软银集团与 SB Energy 的合作伙伴关系
OpenAI 与软银集团各自向 SB Energy 投资 5 亿美元,以加速 AI 数据中心园区和能源基础设施的建设,其中包括位于 Milam County 的 1.2 GW 场址。
Datadog 将 OpenAI Codex 集成用于系统级代码审查
Datadog 已将 OpenAI Codex 部署给超过 1,000 名工程师,用于在代码审查中识别系统性风险和跨服务依赖,成功检测出 22% 的历史事故,这些事故是人工审查遗漏的。
OpenAI for Healthcare 发布
OpenAI 已推出 OpenAI for Healthcare,这是一套符合 HIPAA 的工具,包括 ChatGPT for Healthcare 和 OpenAI API,旨在减轻临床医生的行政负担并提升护理的一致性。
Netomi 将代理系统扩展到企业 – 来自 OpenAI 的经验教训
Netomi 宣布了一款生产级代理平台,该平台结合了用于低延迟工具使用的 GPT‑4.1 和用于深度多步骤规划的 GPT‑5.2,实现了亚 3 秒响应、98% 意图准确率以及企业级规模的内置治理。
Qwen3-VL-Embedding 与 Qwen3-VL-Reranker 发布
Qwen 已发布 Qwen3-VL-Embedding 与 Qwen3-VL-Reranker,这是一系列针对文本、图像、截图和视频的高精度跨模态检索的多模态模型。
Tolan 如何使用 GPT-5.1 构建语音优先 AI
Tolan 利用 GPT-5.1 和自定义实时上下文管理系统,创建了一个具有持久记忆和一致人格的低延迟语音优先 AI 伴侣。
ChatGPT Health 发布说明
OpenAI 已推出 ChatGPT Health,这是一个专用且安全的体验,它整合了个人医疗记录和健康应用数据,帮助用户在不替代临床护理的情况下导航健康信息。
NVIDIA Cosmos Reason 2 发布说明 / 新功能
NVIDIA 已发布 Cosmos Reason 2,这是一款面向物理 AI 的开放推理视觉语言模型,位居 Physical AI Bench 和 Physical Reasoning 排行榜首位。
Falcon-H1-Arabic 发布说明
Hugging Face 宣布了 Falcon-H1-Arabic,这是一系列三种混合 Mamba-Transformer 模型(3B、7B 和 34B),在扩展上下文窗口最高可达 256K tokens 的情况下,为阿拉伯语自然语言处理设定了新的最先进基准。
NVIDIA DGX Spark 和 Reachy Mini 集成指南
NVIDIA 通过结合 DGX Spark 硬件、Reachy Mini 机器人技术以及使用开放推理和视觉模型的 NeMo Agent Toolkit,推出了一种创建真实世界 AI 代理的框架。
OpenAI Grove 第二期公告
OpenAI 已开放 OpenAI Grove 第二期的申请,该项目旨在支持尚未有想法的技术人才构建 AI 驱动的公司。
Qwen-Image-2512 发布说明 / 新功能
Qwen-Image-2512 是对 Qwen-Image 文本到图像模型的十二月更新,显著提升了人物真实感、自然细节渲染以及复杂文字布局的准确性。
Google DeepMind 2025 年度回顾:Gemini 3、Gemma、AI 产品、科学与安全突破
Google DeepMind 宣布了 2025 年在 Gemini 3 模型、开源 Gemma、AI 驱动的产品、生成式媒体、科学 AI、量子计算、安全框架以及全球合作方面的突破,标志着 AI 从工具向实用性的转变。
AprielGuard:现代大型语言模型系统中的安全与对抗鲁棒性护栏
Hugging Face 和 ServiceNow AI 推出了 AprielGuard,这是一款拥有 8B 参数的安全防护模型,旨在检测 16 类安全风险以及在单独提示、多轮对话和代理工作流中的广泛对抗攻击。
Qwen-Image-Edit-2511 发布说明
Qwen-Image-Edit-2511 是一个更新的图像编辑模型,提升了角色一致性,集成了社区 LoRAs,并增强了几何推理和工业设计能力。
Qwen3-TTS-VD-Flash 与 Qwen3-TTS-VC-Flash 发布:可控语音设计与快速多语言语音克隆
Qwen 推出了用于自然语言语音设计的 Qwen3‑TTS‑VD‑Flash 和用于 3 秒多语言语音克隆的 Qwen3‑TTS‑VC‑Flash,两者在可控性和准确性方面均优于领先的 TTS 系统。
ChatGPT Atlas: 加固浏览器代理以抵御提示注入
OpenAI 使用经过强化学习训练的自动化攻击者实施了一个主动的快速响应循环,以在野外被利用之前发现并缓解 ChatGPT Atlas 中的提示注入漏洞。
OpenAI 客户增长与企业采用
OpenAI 已突破一百万企业客户,75% 的用户报告能够完成以前无法完成的任务。
Qwen-Image-Layered:层次化分解实现内在可编辑性
Qwen-Image-Layered 是一种新模型,可将图像分解为多个 RGBA 层,实现对图像组件的独立操作而不影响其他内容。
OpenAI 评估链式思考可监控性
OpenAI 引入了一个框架和 13 项评估来衡量“可监控性”——即从模型内部推理预测其行为的能力——并发现监控链式思考的效果显著优于仅监控输出。
OpenAI Model Spec 更新:未满18岁(U18)原则
OpenAI 已更新其 Model Spec,加入未满18岁(U18)原则,为 ChatGPT 建立适龄行为准则,以优先保障13至17岁青少年的安全并提供现实世界的支持。