Gemini Omni Flash 发布
Google DeepMind 已推出 Gemini Omni Flash,这是一个原生多模态模型,能够从文本、图像、音频和视频输入的组合中生成和编辑高质量视频。
Google Antigravity 2.0 公告
Google DeepMind 宣布了 Google Antigravity 2.0,但提供的源材料仅包含一个重定向通知,且未包含任何技术细节。
Gemini for Science: 用于科学发现的AI工具
Google DeepMind 已推出 Gemini for Science,这是一套旨在通过假设生成、计算发现和文献合成来加速科学方法的 AI 工具和实验套件。
Google DeepMind 内容透明度和验证工具更新
Google DeepMind 正在将 SynthID 水印和 C2PA 内容凭证扩展到 Search、Gemini、Chrome 和 Pixel,以帮助用户识别 AI 生成的内容和真实的相机拍摄内容。
Google DeepMind 和 Singapore 国家 人工智能 合作伙伴关系
Google DeepMind 正与新加坡政府合作,在医疗、教育和可持续发展等领域部署前沿 AI,以潜在地创造 S$3.3 亿的经济价值,目标是到 2040 年。
Google DeepMind 用于传染病研究的 Co-Scientist
剑桥大学的 Clare Bryant 教授正在使用 Google DeepMind 的 Co-Scientist 来识别人畜共患病原体中的分子开关,将识别精确氨基酸靶点的时间从数年缩短至数月。
开辟衰老研究新路径 – Google DeepMind 与 Calico 利用 Co‑Scientist 生成假设
Google DeepMind 宣布,Calico Life Sciences 利用其 Co‑Scientist 多智能体 AI 系统,针对衰老过程中的整合应激反应生成并测试了一个新颖的假设,展示了 AI 如何加速生物医学发现。
谷歌DeepMind Co-Scientist 加速肝病研究
谷歌DeepMind的Co-Scientist AI系统帮助爱丁堡大学的研究人员将NLRP3炎症小体识别为MASH肝病中的关键分子桥梁,从而促进了潜在双重疗法的发现。
谷歌 DeepMind Co-Scientist 用于 ALS 研究
Google DeepMind 的 Co-Scientist AI 代理正在促进 MIT 与波士顿儿童医院之间的多学科合作,以发现用于 ALS 的新型基于 RNA 的机制和疗法。
Google DeepMind Co-Scientist 用于肝纤维化药物再利用
斯坦福研究人员使用 Google DeepMind 的 Co-Scientist AI 识别肝纤维化的再利用药物,成功发现了能够阻止疤痕形成并促进细胞再生的候选药物。
Google DeepMind WeatherNext:提升飓风强度和路径预测
Google DeepMind 的 WeatherNext AI 模型帮助美国国家飓风中心提前五天预测梅丽莎飓风在牙买加的5级登陆,这在快速增强预测方面标志着历史性里程碑。
OpenAI 与马耳他合作伙伴关系:为所有公民提供 ChatGPT Plus
OpenAI 与马耳他政府合作,为所有完成专门 AI 素养课程的马耳他公民提供免费一年期的 ChatGPT Plus 访问权限。
Gemini 3.5 Flash 发布说明 / 新功能
Google DeepMind 已发布 Gemini 3.5 Flash,这是一款针对代理工作流和编码进行优化的模型,提供前沿水平的智能,并且输出速度比其他前沿模型快 4 倍。
业务运营团队如何使用 ChatGPT Work
OpenAI 将 ChatGPT Work 作为一种工具推出,供业务运营团队将零散数据合成为决策就绪的简报和战略模型。
Databricks 集成 GPT-5.5 用于企业代理工作流
Databricks 将 GPT-5.5 集成到其企业代理工作流中,在复杂文档任务的 OfficeQA Pro 基准测试中实现了新的最先进性能。
ChatGPT 个人理财体验发布
OpenAI 在 ChatGPT 中推出了一项新的个人理财体验,允许用户安全地连接财务账户以进行基于 AI 的预算和财务规划。
Sea Limited 在代理软件开发中实施 Codex
Sea Limited 正在整合 Codex,以将其工程团队从手动编码转向系统编排,并报告称开发者中有 87% 的周活跃使用率。
Granite 嵌入多语言 R2 发布:开放的 Apache 2.0 多语言嵌入,支持 32K 上下文
IBM Granite 发布了两款 Apache 2.0 多语言嵌入模型——granite-embedding-97m-multilingual-r2(97M)和 granite-embedding-311m-multilingual-r2(311M),具备 32K 令牌上下文、支持 200 多种语言,并在子 100M 检索得分中名列前茅。
OpenAI Codex 移动集成与企业更新
OpenAI 已将 Codex 集成到 ChatGPT 移动应用中,使用户能够在手机上管理跨笔记本电脑和远程环境的长时间运行的代理任务。
VeRL-Omni: 用于扩散和全模态模型的强化学习训练框架
vLLM 已宣布 VeRL-Omni 的预发布,这是一个专门为多模态生成模型设计的通用强化学习后训练框架,包括扩散和全模态架构。
vLLM 弹性专家并行
vLLM 引入弹性专家并行(Elastic EP),使得 Mixture-of-Experts (MoE) 部署能够在运行时上下调工作节点数量,而无需服务器重启。
OpenAI 更新 ChatGPT 安全功能,以提升在敏感对话中的上下文识别能力
OpenAI 已对 ChatGPT 实施安全更新,使模型能够更好地识别单次和多次对话中的演变风险信号和有害意图,特别针对自杀、自我伤害和对他人伤害的情景。
解锁连续批处理中的异步性
Hugging Face 展示了如何在连续批处理中使用 CUDA 流和事件重叠 CPU 和 GPU 工作,使得 8B 模型生成 8K tokens 的 LLM 推理时间缩短约 22%。
为在 Windows 上启用 Codex 构建安全、高效的沙盒
OpenAI 为 Windows 上的 Codex 实现了自定义沙盒,以在无需用户对每个命令持续批准的情况下提供安全、受限的代码代理执行环境。
OpenAI 对 TanStack npm 供应链攻击的响应
OpenAI 对 TanStack npm 库的供应链攻击作出响应,此攻击是 Mini Shai-Hulud 运动的一部分,并已为 macOS、iOS、Windows 和 Android 应用轮换代码签名证书,未发现用户数据被泄露的证据。
财务团队如何使用 ChatGPT Work – OpenAI Academy 指南
OpenAI Academy 的文章展示了财务团队如何使用 ChatGPT Work 将现有的财务输入转化为可审阅的资产,用于报告、规划和差异分析,而无需编写代码。
Google DeepMind Co-Scientist:一种用于科学假设生成的多代理 AI 系统
Google DeepMind 推出了 Co-Scientist,这是一款由 Gemini 驱动的多代理 AI 合作伙伴,能够迭代生成、辩论并演化新颖的科学假设,以加速生命科学和工程领域的研究。
OpenAI 参数高尔夫:AI 辅助机器学习研究的洞见
OpenAI 的参数高尔夫挑战揭示了 AI 编码代理如何通过严格受限的优化问题降低实验门槛并发掘卓越的机器学习人才。
AutoScout24 通过 OpenAI AI 驱动的工作流扩展工程规模
AutoScout24 集团已整合 ChatGPT 和 Codex,将开发周期从数周缩短至数天,并提升其车辆交易平台的工程吞吐量。
NVIDIA 如何使用 OpenAI Codex 与 GPT-5.5
NVIDIA 的工程师和研究人员正在利用基于 GPT-5.5 的 Codex,并在 GB200 与 GB300 基础设施上运行,以自动化复杂的工程任务和端到端的机器学习研究工作流。
AWS 上基础模型训练与推理的构建模块
Hugging Face 阐述了在 AWS 上的四层架构框架——包括基础设施、资源编排、机器学习软件栈和可观测性,以支持预训练、后训练和推理阶段不断演进的扩展规律。
ChatGPT 采用趋势 2026 年第一季度
OpenAI 报告称,2026 年第一季度,ChatGPT 的使用在年龄、性别和地域上均有所扩大,并向更专业的工作场所任务转变。
OpenAI推出校园网络兴趣表格,面向学生社团
OpenAI宣布了校园网络,邀请全球学生社团通过兴趣表加入,以获得AI学习支持、活动资源、早期工具访问以及大使机会。
企业如何扩展 AI:OpenAI 高管研究的经验教训
OpenAI 确定了企业扩展 AI 的五大关键模式,强调成功更多取决于文化、治理和工作流重新设计,而非工具的技术部署。
OpenAI 推出 OpenAI 部署公司,加速企业 AI 采用
OpenAI 推出了 OpenAI 部署公司,这是一家获得 40 亿美元初始投资并收购 Tomoro 的独立业务单元,旨在将前置部署工程师嵌入组织,以围绕前沿 AI 重新设计工作流程。
vLLM 性能基准:领跑 Artificial Analysis 排行榜
vLLM 通过实施激进的内核融合和推测解码优化,在 Artificial Analysis 排行榜上为 DeepSeek V3.2、MiniMax-M2.5 和 Qwen 3.5 397B 获得了最高排名。
vLLM TurboQuant 研究:准确性与性能分析
vLLM 的一项综合研究表明,FP8 仍然是 KV-cache 量化的最佳默认选项,而 TurboQuant 各变体则以显著的吞吐量和延迟为代价换取额外的内存容量。
在 OpenAI 安全运行 Codex
OpenAI 为 Codex 实施了一套安全框架,结合沙箱、受管网络策略和代理原生遥测,以在保持开发者生产力的同时提供企业级控制。
自适应并行推理:高效推理扩展的新范式
BAIR 介绍了自适应并行推理 (APR),这是一种允许 LLM 动态决定何时并行化推理线程,从而在保持准确性的同时降低延迟并避免上下文退化的范式。
OpenAI GPT-5.5 与 GPT-5.5-Cyber 发布
OpenAI 在有限预览中推出了 GPT-5.5-Cyber,并推出了可信网络访问(TAC)框架,为经过验证的安全防御者提供更宽松、专用的 AI 能力,以保护关键基础设施。
Parloa AI Agent Management Platform (AMP) 概述
Parloa 推出了 AI Agent Management Platform (AMP),这是一个基于包括 GPT-5.4 在内的 OpenAI 模型构建的企业级系统,旨在允许非技术领域的专家设计并部署可靠、低延迟的客服 Agent。
OpenAI 在 API 中推出 GPT‑Realtime‑2、GPT‑Realtime‑Translate 和 GPT‑Realtime‑Whisper
OpenAI 推出了三款新的实时音频模型——GPT‑Realtime‑2、GPT‑Realtime‑Translate 和 GPT‑Realtime‑Whisper,使开发者能够构建具备实时推理、翻译和转录功能的语音应用。
Simplex 软件开发集成 OpenAI Codex
Simplex 已将 OpenAI Codex 和 ChatGPT Enterprise 集成,以从辅助 AI 转向 AI 原生交付,实现了对 CRUD 型 Web 应用的屏幕开发时间最高可降低 70%。
ChatGPT 中的可信联系人:OpenAI 为危机支持推出的新安全功能
OpenAI 推出了可信联系人,这是 ChatGPT 中的可选安全功能,允许成年人指定一位可信人士,在系统检测到严重自我伤害风险时进行通知。
vLLM V1 迁移:确保强化学习中的后端正确性
ServiceNow AI 通过修复日志概率语义、运行时默认设置、权重更新路径,并实现 fp32 lm_head,使 vLLM V0 与 V1 在强化学习 rollout 生成方面实现了等价。
AlphaEvolve:在各行业扩展基于 Gemini 的算法发现
Google DeepMind 的 AlphaEvolve 是一款基于 Gemini 的编码代理,通过在基因组学、量子物理、AI 基础设施和商业领域优化算法,展示了显著的影响力。
ChatGPT 如何学习并保护用户隐私
OpenAI 概述了数据来源、诸如 OpenAI 隐私过滤器等隐私保护技术,以及可用的用户控制措施,以防止 ChatGPT 对话被用于模型训练。
在规模化环境下使用 vLLM x Mooncake 提供 Agentic 工作负载
vLLM 集成了 Mooncake 的分布式 KV 缓存存储,以提升 Agentic 大语言模型服务,在真实追踪上实现了 3.8 倍更高的吞吐量、46 倍更低的首次生成时间(TTFT)以及 8.6 倍更低的端到端延迟,并可扩展至 60 台 GB200 GPU。
Hugging Face 开放 ASR 排行榜:使用私有数据集对抗 Benchmaxxing
Hugging Face 在开放 ASR 排行榜中引入了来自 Appen Inc. 和 DataoceanAI 的私有评估数据集,以防止测试集污染并提供更可靠的真实场景 ASR 性能衡量。
Singular Bank 集成 ChatGPT 和 Codex 以推出 Singularity 助手
Singular Bank 开发了 Singularity,这是一个由 ChatGPT 和 Codex 驱动的内部 AI 助手,通过自动化投资组合分析和沟通,使银行家每天的生产力损失减少 60 到 90 分钟。