OpenAI ChatGPT for Excel 测试版及金融数据集成公告
OpenAI 推出基于 GPT‑5.4 的 ChatGPT for Excel(测试版),并新增与主要金融数据提供商的原生集成,实现 AI 辅助的电子表格建模以及对可信市场数据的即时访问。
OpenAI:企业重塑的五大 AI 价值模型
OpenAI 定义了五种战略价值模型——员工赋能、AI 原生分发、专家能力、系统与依赖管理以及流程再造——以帮助组织从孤立的 AI 试点转向完整的业务模型转型。
OpenAI “单负号引力子树振幅非零” 预印本公告
OpenAI 发布了一篇预印本,展示单负号引力子树振幅在半共线 regime 中为非零,该结果在 AI 模型 GPT‑5.2 Pro 的大量帮助下得以推导。
OpenAI 学习成果测量套件
OpenAI 推出了学习成果测量套件,这是一套旨在跟踪 AI 对学生学习的长期影响、超越单纯考试成绩的框架。
Axios 本地 AI 集成
Axios 正在利用 OpenAI 工具通过自动化生产工作流、分析公共数据以及降低新城市新闻编辑部启动的运营成本,来规模化高影响力的本地新闻报道。
vLLM Triton 注意力后端深度解析
vLLM 实现了一个可移植的基于 Triton 的注意力后端,使用单一源码实现,在 NVIDIA、AMD 和 Intel GPU 上达到了业界领先的性能。
PRX 第三部分:在 24 小时内训练文本到图像模型
Hugging Face 与 Photoroom 展示了使用 32 块 H200 GPU、约 1500 美元预算,在 24 小时内训练出的文本到图像模型,结合了像素空间训练、Token 路由和表征对齐。
Gemini 3.1 Flash‑Lite 发布:面向大批量工作负载的高速、低成本 AI
Google DeepMind 发布了 Gemini 3.1 Flash‑Lite,这是一款面向大批量工作负载的高速、低成本 AI 模型,输入代币每百万 0.25 美元,输出代币每百万 1.50 美元。
GPT-5.3 Instant 发布说明
OpenAI 推出了 GPT-5.3 Instant,这是一款旨在实现更快响应时间、改进网页搜索上下文并简化对话流程的模型。
GPT-5.3 Instant 发布:更流畅、更准确的日常对话
OpenAI 宣布了 GPT‑5.3 Instant,这一更新使日常的 ChatGPT 对话更流畅、更准确,并且更少出现不必要的拒绝或过度谨慎的语言。
OpenAI 与战争部的协议
OpenAI 已与战争部达成协议,在机密环境中部署先进的 AI 系统,采用仅云架构并设有严格的安全防护措施。
OpenAI 与亚马逊战略合作伙伴关系
OpenAI 与亚马逊宣布了一项为期多年的战略合作伙伴关系,涉及对 OpenAI 的 500 亿美元投资以及在 Amazon Bedrock 上共同创建有状态运行时环境。
Amazon Bedrock 中的 Agent 有状态运行时环境
OpenAI 和 Amazon 已合作在 Amazon Bedrock 中推出有状态运行时环境,为 AI Agent 提供原生 AWS 基础设施,使其能够在多步骤生产工作流中保持状态、可靠性和治理能力。
OpenAI 与 Microsoft 关于合作持续性的联合声明
OpenAI 与 Microsoft 已确认,尽管 OpenAI 获得了新的融资并与包括 Amazon 在内的其他云服务提供商建立了合作关系,但双方的战略合作关系保持不变。
OpenAI 为所有人扩展 AI 的公告
OpenAI 获得了来自软银、英伟达和亚马逊的 1100 亿美元新投资,估值为 7300 亿美元(融资前),用于扩展计算基础设施和全球 AI 分发。
OpenAI 心理健康安全更新与诉讼状态
OpenAI 正在为成年用户推出可信联系人功能,并加强模型对情绪困扰的检测,同时处理加州心理健康相关诉讼的合并事宜。
vLLM AMD ROCm 注意力后端优化
vLLM 为 AMD ROCm 引入了优化的注意力后端,在 Instinct MI300X、MI325X 和 MI355X GPU 上实现了 MHA 吞吐量提升最高 4.4 倍、MLA 吞吐量提升最高 1.5 倍。
Nano Banana 2 发布:专业级图像生成,闪电速度
Google DeepMind 宣布了 Nano Banana 2,这是一款将 Nano Banana Pro 的高级功能与 Gemini Flash 的超低延迟相结合的图像生成模型,能够即时为 Google 产品提供高质量、基于知识的图像。
OpenAI 与 PNNL 合作加速联邦许可
OpenAI 与太平洋西北国家实验室(PNNL)合作,评估使用编码代理加速《国家环境政策法》(NEPA)联邦许可流程,展示了起草时间可能降低 15%。
OpenAI Codex 与 Figma 集成:无缝的代码到设计工作流
OpenAI 与 Figma 推出了由 Figma MCP 服务器驱动的代码到设计集成,使用户能够在 Codex 代码生成和 Figma 设计画布之间无缝切换。
vLLM 多 LoRA 服务用于 MoE 模型
vLLM 0.15.0 版引入了针对混合专家(MoE)模型的优化多 LoRA 服务,使多个微调适配器能够共享单个 GPU,从而降低空闲计算容量。
Transformer 中的专家混合(MoEs)
Hugging Face 重新设计了 transformers 库,通过全新的权重加载重构、可插拔的专家后端以及原生的专家并行,使专家混合(MoEs)成为一等公民。
OpenAI 2026年2月《遏制 AI 恶意使用》报告
OpenAI 发布了一份威胁报告,详细说明威胁行为者如何将 AI 模型与社交媒体、网站等传统工具相结合,以实施恶意活动。
OpenAI 任命 Arvind KC 为首席人才官
OpenAI 任命 Arvind KC 为首席人才官,负责领导组织增长并制定 AI 驱动工作转型的模型。
OpenAI 停止 SWE-bench Verified 评估
OpenAI 已停止报告 SWE-bench Verified 分数,因为有缺陷的测试用例和训练数据污染使该基准无法可靠衡量前沿模型的编码能力。
OpenAI 前沿联盟合作伙伴公告
OpenAI 已推出前沿联盟,与麦肯锡、波士顿咨询集团(BCG)、BCG X、埃森哲和凯捷合作,帮助企业使用前沿平台部署和扩展 AI 同事。
OpenAI 首次证明提交
OpenAI 已提交针对 First Proof 研究级数学挑战的证明尝试,内部模型可能已解决至少十个问题中的五个。
使用 Unsloth 和 Hugging Face Jobs 训练 AI 模型
Hugging Face 已将 Unsloth 与 Hugging Face Jobs 集成,以实现快速、低成本的 LLM 微调,专为像 LiquidAI/LFM2.5-1.2B-Instruct 这样的小模型进行优化。
GGML 与 llama.cpp 加入 Hugging Face
GGML,llama.cpp 的创建者,已加入 Hugging Face,为本地 AI 推理提供可持续资源,并简化 Transformers 库与本地模型部署之间的集成。
Gemini 3.1 Pro 发布说明
Google DeepMind 推出了 Gemini 3.1 Pro,这是一款在复杂任务上推理能力显著提升的新模型,现已通过 Gemini API、Vertex AI、Gemini 应用和 Notebook LM 以预览形式提供。
OpenAI 对齐项目资助
OpenAI 宣布向 The Alignment Project 提供 750 万美元的资助,该基金由英国人工智能安全研究所(UK AISI)管理,旨在扩大对 AI 对齐与安全的独立研究规模。
OpenAI for India 计划
OpenAI 已推出 “OpenAI for India”,这是一项全国性计划,与 Tata Group 及其他机构合作,构建主权 AI 基础设施,加速企业采用,并在全国范围内扩大 AI 技能提升。
IBM 与加州大学伯克利分校使用 IT-Bench 与 MAST 诊断企业代理故障
IBM 研究院和加州大学伯克利分校推出了 MAST(多代理系统故障分类法),用于诊断企业 IT 代理为何失败,揭示前沿模型主要受孤立的验证错误影响,而开源模型则面临级联的系统性崩溃。
使用 Lyria 3 的 Gemini 音乐生成
Google DeepMind 已将 Lyria 3 生成音乐模型集成到 Gemini 应用中,使用户能够通过文本提示或图像、视频上传创建 30 秒的 AI 生成曲目。
Gradio 6 gr.HTML:一次性 Web 应用开发
Gradio 6 引入了对 gr.HTML 的增强支持,支持自定义模板、作用域 CSS 和 JavaScript 交互,使得能够在单个 Python 文件中创建复杂的网页组件。
OpenAI 推出 EVMbench
OpenAI 与 Paradigm 已发布 EVMbench,这是一项用于评估 AI 代理检测、修补和利用高危智能合约漏洞能力的基准测试。
Google DeepMind 人工智能国家合作伙伴计划:印度扩展
Google DeepMind 正在与印度政府部门和机构建立新的合作伙伴关系,以扩大前沿 AI 模型在科学、教育、农业和能源安全方面的获取。
Qwen 3.5‑397B‑A17B 发布:混合线性注意力 MoE 模型,具备 1 M 令牌上下文和最先进的多模态性能
Qwen 3.5‑397B‑A17B 是一个拥有 3970 亿参数的多模态模型,每个令牌仅激活 170 亿参数,在语言、编码、推理和视觉任务上实现最先进的性能,同时推理速度比前代提升最高可达 19 倍。
GPT-5.2 在理论物理学中推导出新结果
OpenAI 宣布,GPT-5.2 Pro 以及一个支撑版的 GPT-5.2 被用于在半共线区间推导出关于非零胶子树振幅的新理论物理结果。
ChatGPT 锁定模式和提升风险标签
OpenAI 引入了锁定模式和提升风险标签,以缓解提示注入攻击,并为用户提供更大的数据泄露风险控制。
OpenAI 通过混合信用系统扩展对 Codex 和 Sora 的访问
OpenAI 实施了一个实时访问引擎,将速率限制与可购买的信用系统相结合,以防止 Codex 和 Sora 用户出现硬性停止。
OpenAI GABRIEL:使用 GPT 扩大社会科学研究规模
OpenAI 发布了 GABRIEL,这是一款开源的 Python 工具包,利用 GPT 将非结构化文本和图像转化为社会科学研究的定量测量。
Hugging Face CUDA 内核代理技能
Hugging Face 推出了一项代理技能,使 Claude、Codex 等编码代理能够编写、基准测试并集成用于 transformers 和 diffusers 库的可投入生产的 CUDA 内核。
Gemini 3 Deep Think 更新
Google DeepMind 已更新 Gemini 3 Deep Think,这是一种专门的推理模式,在数学、物理和化学奥林匹克中达到金牌水平表现,并已通过 Gemini API 向特定用户开放。
GPT-5.3-Codex-Spark 发布说明
OpenAI 已发布 GPT-5.3-Codex-Spark,这是一款小型、低延迟模型,针对实时编码协作进行优化,并在 Cerebras 硬件上实现每秒超过 1,000 个 token 的输出。
OpenEnv: 在真实环境中评估使用工具的智能体
Hugging Face 和 Meta 推出了 OpenEnv,这是一个开源框架,用于针对真实系统和像 Calendar Gym 这样的生产级环境评估 AI 智能体,以弥合研究与生产可靠性之间的差距。
OpenAI Harness Engineering:利用 Codex 实现零手写代码开发
OpenAI 使用 Codex 开发了一个内部软件产品,实现了零行手写代码,通过从手动编码转向环境设计和代理编排,将开发时间缩短约 10 倍。
Qwen-Image-2.0 发布:专业信息图表与写实渲染
Qwen-Image-2.0 是一款统一的图像生成与编辑模型,支持 1k-token 指令用于专业信息图表,并具备原生 2K 分辨率实现高保真写实渲染。
Gemini Deep Think 实现跨数学、物理和计算机科学的自主研究
Gemini Deep Think 为自主和协作代理提供动力,解决研究级别的数学、物理和计算机科学问题,产出可发表的成果并破解未解猜想。
OpenAI 将 ChatGPT 集成到 GenAI.mil 为战争部
OpenAI 正在将定制版 ChatGPT 部署到 GenAI.mil,为战争部的 300 万名人员提供安全、非机密的生成式 AI 能力,以支持行政和运营工作。