OpenAI 收购 TBPN – 战略媒体整合与编辑独立性
OpenAI 宣布收购 TBPN,这是一家以 AI 为中心对话而闻名的媒体平台,旨在将编辑独立性嵌入 OpenAI 的 Strategy 组织,并利用 TBPN 的传播专长。
OpenAI Codex 团队灵活定价
OpenAI 在 ChatGPT Business 和 Enterprise 工作区推出了 Codex 专用席位的按使用量付费定价,以降低团队采用和试点项目的门槛。
Gemma 4 在 vLLM 上:高级推理和多模态能力
vLLM 引入了对 Gemma 4 的 Day 0 支持,Gemma 4 是谷歌推出的一系列开放模型,具备高级推理、多模态输入,并在 TPU、GPU 和 XPU 等硬件上具有广泛兼容性。
Gemma 4 发布:开源多模态模型,支持本地设备
Gemma 4 是 Google DeepMind 推出的全新开源多模态系列,已在 Hugging Face 上发布,支持图像、音频、视频,拥有最高 256 K 上下文,并可在发布首日即与 transformers、llama.cpp、MLX、Rust 和 WebGPU 兼容。
2024 年沙巴卡安中央市场标志垂直文字 – “2006”
2024 年沙巴卡安中央市场主标志右侧的垂直文字为 “2006”。
Falcon Perception 与 Falcon OCR 发布
Hugging Face 和 TII 推出 Falcon Perception,这是一种 0.6B 参数的早期融合 Transformer,用于开放词汇定位;以及 Falcon OCR,这是一种 0.3B 参数的高吞吐量文档理解模型。
Gradient Labs 银行业 AI 账户经理
Gradient Labs 正在部署由 OpenAI 的 GPT-5.4 mini 和 nano 模型驱动的 AI 代理,为银行客户提供能够处理复杂且合规的金融流程的专属 AI 账户经理。
Gradio Server:将自定义前端与 Gradio 后端集成
Hugging Face 推出 gradio.Server,这是一款 FastAPI 扩展,允许开发者使用任意自定义前端框架,同时保留 Gradio 的排队、API 基础设施以及 ZeroGPU 支持。
Granite 4.0 3B Vision 发布说明 / 新功能
IBM 发布了 Granite 4.0 3B Vision,这是一款针对企业文档理解进行优化的紧凑多模态模型,具备高精度表格提取、图表推理和键值对提取功能。
OpenAI 融资与基础设施战略更新
OpenAI 已在 8520 亿美元的后融资估值下筹集了 1220 亿美元的承诺资本,以扩展其计算基础设施并开发统一的 AI 超级应用。
OpenMed CodonRoBERTa 多物种 mRNA 语言模型发布
OpenMed 发布了一个端到端的蛋白质工程流水线,包含 CodonRoBERTa-large-v2(困惑度 4.10,CAI 0.404)以及一个在 55 GPU 小时内训练完成、成本为 165 美元的 25 物种密码子优化模型套件。
TRL v1.0 发布说明 / 新功能
Hugging Face 发布了 TRL v1.0,这是一款实现了超过 75 种方法的稳定后训练库,采用双轨稳定模型,以在快速实验迭代和生产级可靠性之间取得平衡。
vLLM 隐状态提取系统
vLLM v0.18.0 引入了原生的隐藏状态提取系统,使得能够高性能地获取内部模型表示,以用于训练投机解码的草稿模型。
OpenAI 亚洲灾害管理 AI Jam
OpenAI 与 Gates 基金会、APDC 和 DataKind 合作,在曼谷举办了 AI Jam,帮助来自 13 个亚洲国家的灾害管理专业人员开发用于应急响应的实用 AI 工作流。
Qwen3.5-Omni 发布说明
Qwen 宣布了 Qwen3.5-Omni,这是一款能够处理文本、图像、音频和视频的新型全模态大语言模型,支持 256k 上下文、113 种语言的语音识别、36 种语言的语音合成,并新增了语义中断、网页搜索、语音控制和语音克隆等实时功能。
Google DeepMind AI 驱动的指针
Google DeepMind 正在开发一款由 Gemini 驱动的 AI 指针,它用直观的指向和语音指令取代复杂的文本提示,以在各类应用中与数字内容交互。
STADLER AI 实施与生产力提升
STADLER,这家拥有 230 年历史的工业回收公司,通过将 OpenAI 的 ChatGPT 嵌入为全公司范围的生产力层,实现了知识任务时间节省 30%‑40%,起草速度提升 2.5 倍。
Hugging Face OpenClaw 迁移指南
Hugging Face 提供两种方法——Inference Providers 和本地 llama.cpp 设置——将 OpenClaw 代理从受限的 Claude 模型迁移到开源替代方案。
Gemini 3.1 Flash Live 发布说明 / 新功能
Google DeepMind 已发布 Gemini 3.1 Flash Live,这是一款高质量的音频和语音模型,旨在实现自然的实时对话,具备更高的精度、更低的延迟以及更广泛的全球可用性。
Google DeepMind 对 AI 有害操纵的研究
Google DeepMind 发布了一项新的研究报告和一个经实证验证的工具包,用于衡量并降低 AI 被用于有害操纵人类思想和行为的风险。
Lyria 3 Pro 发布:更长、更具结构感的音乐生成,遍及 Google 产品
DeepMind 宣布了 Lyria 3 Pro,这款音乐生成模型能够创作最长三分钟、具备结构感的曲目,并已在 Vertex AI、AI Studio、Google Vids、Gemini 和 ProducerAI 等 Google 产品中实现集成。
OpenAI 模型规范:明确模型行为的框架
OpenAI 推出了模型规范,这是一套正式的、公开的框架,旨在使预期的 AI 模型行为明确、易读,并可供用户、开发者和研究者进行修订。
OpenAI 安全漏洞赏金计划启动
OpenAI 已启动公开的安全漏洞赏金计划,以识别超出传统安全漏洞范围的 AI 滥用和安全风险,特别针对代理风险、专有信息泄露以及平台完整性。
OpenAI 青少年安全政策包和 gpt-oss-safeguard
OpenAI 发布了基于提示的安全政策和开源权重的 gpt-oss-safeguard 模型,以帮助开发者在 AI 应用中为青少年实施适龄保护。
OpenAI 基金会更新
OpenAI 宣布,其基金会将在未来一年内在生命科学、经济影响、AI 弹性和社区项目等领域投资至少 10 亿美元,以确保通用人工智能(AGI)惠及全人类。
OpenAI 通过 Agentic Commerce Protocol 扩展 ChatGPT 中的产品发现
OpenAI 在 ChatGPT 中推出了增强的可视化购物和产品发现功能,借助扩展的 Agentic Commerce Protocol(ACP)简化用户的产品查找和比较流程。
EVA 端到端语音代理评估框架
EVA 是一个全新的端到端框架,可同时评估语音代理的准确性和对话体验,揭示任务成功率与用户满意度之间的一致权衡。
vLLM Model Runner V2 发布说明 / 新功能
vLLM 推出了 Model Runner V2(MRV2),这是一项从头重新实现的模型运行器,通过 GPU 原生、异步优先和模块化的架构提升吞吐量并降低延迟。
OpenAI Sora 2 安全框架
OpenAI 详细阐述了 Sora 2 的安全架构,重点在于来源信号、基于同意的肖像管理以及对音视频的严格内容过滤。
领域特定嵌入微调与 NVIDIA Nemotron – 一天内完成
NVIDIA 与 Hugging Face 发布了一个单 GPU、一天内完成的流水线,可在合成领域数据上微调 Llama‑Nemotron‑Embed‑1B‑v2 模型,实现超过 10% 的检索提升,且在真实企业数据集上提升最高达 26%。
OpenAI 内部编码代理监控系统
OpenAI 已部署一套由 GPT-5.4 Thinking 驱动的监控系统,用于检测内部编码代理中的错位和安全违规,能够识别那些通常仅在复杂、工具丰富的工作流中出现的行为。
OpenAI 收购 Astral
OpenAI 正在收购 Astral,以将其开源 Python 工具(包括 uv、Ruff 和 ty)整合到 Codex 生态系统中,使 AI 代理能够参与整个软件开发生命周期。
Qwen3.5-Max-Preview 在 LMSys Arena 上发布
Qwen 已将 Qwen3.5-Max-Preview 部署到 LMSys Arena,供社区在两周内的正式发布前进行评估。
Hugging Face 开源现状:2026 年春季
Hugging Face 报告称,2025 年开源 AI 生态系统出现大幅扩张,特点是中国在模型下载量上超越美国,且机器人领域迅速崛起成为最大的数据集类别。
Google DeepMind 测量通往 AGI 的进展:认知框架
Google DeepMind 引入了认知分类法和三阶段评估协议,以实证方式衡量 AI 向通用人工智能(AGI)的进展。
Holotron-12B 高吞吐量计算机使用代理
H 公司发布了 Holotron-12B,这是一款基于 NVIDIA Nemotron-Nano-2 VL 的多模态计算机使用模型,采用混合 SSM-注意力架构,实现了针对代理工作负载的高推理吞吐量。
OpenAI GPT-5.4 mini 和 nano 发布说明
OpenAI 已发布 GPT-5.4 mini 和 nano,这些高效小模型将 GPT-5.4 的能力带入高并发工作负载,并显著降低延迟和成本。
OpenAI 日本青少年安全蓝图
OpenAI 日本推出了日本青少年安全蓝图,这一框架将青少年的安全置于便利和隐私之上,以保护年轻用户免受 AI 相关风险。
OpenAI 研究:员工如何使用 ChatGPT 获取薪酬洞察
OpenAI 的研究显示,美国员工每天向 ChatGPT 发送近 300 万条信息,寻求工资基准和薪酬指导,尤其是在高技能、信息不透明的岗位。
OpenAI Codex 安全:为何系统避免使用 SAST 报告进行种子化
OpenAI 的 Codex 安全避免从静态应用安全测试(SAST)报告开始,以防止分析过早收窄,并专注于通过转换链验证安全不变量是否真正成立。
BAIR 推出用于可扩展 LLM 交互发现的 SPEX 与 ProxySPEX
BAIR 推出了 SPEX 和 ProxySPEX,这些算法利用信号处理和编码理论在大规模上识别特征、训练数据和模型组件之间的影响交互。
P-EAGLE:vLLM 中的并行投机解码
vLLM 引入了 P-EAGLE,这是一种并行投机解码方法,可在一次前向传播中生成所有草稿标记,在 NVIDIA B200 GPU 上相较于原生 EAGLE-3 实现最高 1.69 倍的加速。
OpenAI 设计 AI 代理以抵御提示注入
OpenAI 正在将其对提示注入的防御策略转变为将其视为社会工程问题,重点在于限制成功操纵的影响,而不是仅仅依赖输入过滤。
OpenAI 响应 API 计算环境更新
OpenAI 为 Responses API 配备了 shell 工具和托管容器工作区,使模型能够通过命令行界面和持久运行时上下文执行真实世界任务。
乐天集成 OpenAI Codex 提升工程效率
乐天已将 OpenAI Codex 集成到其工程体系中,实现了平均恢复时间(MTTR)降低 50%,并将原本需要数个季度的开发项目压缩至数周。
vLLM 对 NVIDIA Nemotron 3 Super 的支持
vLLM 现在支持 NVIDIA Nemotron 3 Super,这是一款拥有 1200 亿参数的混合 MoE 模型,针对多代理 AI 进行了优化,具备 100 万 token 的上下文窗口和高推理效率。
Wayfair OpenAI 集成案例研究
Wayfair 已将 OpenAI 模型集成到内部系统中,实现对 3000 万商品的产品目录标签自动化,并通过 AI 驱动的工具 Wilma 简化供应商支持。
OpenAI 指令层级改进与 GPT‑5 Mini‑R
OpenAI 推出了全新的强化学习数据集 IH‑Challenge,用于训练模型优先执行可信指令而非不可信指令,进而产生了具备更佳安全可控性和提示注入鲁棒性的 GPT‑5 Mini‑R 模型。
ChatGPT 交互式可视化(数学与科学)
OpenAI 在 ChatGPT 中推出了针对 70 多个核心数学和科学概念的动态可视化解释,帮助用户实时理解变量与公式之间的关系。
vLLM Semantic Router v0.2 Athena 发布说明 / 新功能
vLLM Semantic Router v0.2 Athena 引入了全新构建的模型堆栈、实验性的 ClawOS 编排层以及先进的模型选择原语,将语义路由转变为面向多代理部署的战略系统大脑。