✷ 归档 · 11 个实验室 · 3,048 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Qwen-Image-2.1 发布说明 / 新功能介绍
Qwen-Image-2.1 是一个统一的 7B 参数图像模型,将文本到图像生成、原生透明度支持和高级图像编辑功能整合到一个高效的架构中。
OpenAI 发布澳大利亚青少年安全蓝图
OpenAI 推出了《澳大利亚青少年安全蓝图》,这是一份包含六大支柱的路线图,旨在通过加强保障措施、提升素养和强化问责制,保护 13-17 岁的青少年使用 AI。
Qwen3.8-LiveTranslate 模型发布
Qwen 宣布推出 Qwen3.8‑LiveTranslate,一款实时同步翻译模型,将平均延迟降低至 2.3 秒,新增说话人分离、双语屏幕输出和跨 60 种输入语言的长上下文消歧功能。
Anthropic 和 Accenture 合作推行为前沿人工智能设计的嵌入式评估
Anthropic 正与 Accenture 合作实施嵌入式评估,赋予独立评估人员深入的内部访问权限,以验证安全承诺和模型开发。
vLLM 通过 PyNvVideoCodec 实现多 GPU 视频字幕生成的扩展
vLLM 现在通过 PyNvVideoCodec 支持 NVIDIA 硬件视频解码,消除了 CPU 瓶颈,并使 H100 GPU 上的多 GPU 视频字幕生成任务吞吐量提升超过两倍。
Qwen3.8-Omni-Flash 发布:支持 100 万 token 上下文的多模态智能体模型
通义千问发布了 Qwen3.8-Omni-Flash 模型,这是一款下一代多模态大语言模型,具备 100 万 token 上下文窗口,支持音视频任务的智能体能力,并实现了音视频 API 成本的显著降低。
Cooley GO Public:通过 ChatGPT Work 加速 IPO 工作流程
律师事务所 Cooley 开发了 GO Public,这是一款基于 ChatGPT Work 构建的专有代理型 AI 产品,用于自动化 IPO 数据整合并加速资本市场交易的准备工作。
Anthropic 生命科学验证计划
Anthropic 推出了生命科学验证计划(LSVP),为经过验证的生命科学专业人士提供更宽松的安全保障,以便使用 Mythos、Opus 和 Sonnet 模型开展生物学相关工作。
Claude 将开源生物分子模型的推理速度提升 4 倍,并实现单张 GPU 上超过 10,000 个 token 的预测
Anthropic 宣布 Claude 优化了 30 多个开源生物分子模型,实现了约 4 倍的提速,引入了单张 GPU 上支持超过 10,000 个 token 系统的低内存“Big”模式,并启动了一项高达 100 万美元的蛋白质设计竞赛。
OpenAI Astra for Law 发布
OpenAI 推出了 Astra for Law,一个专为法律领域设计的基础系统,结合了 GPT-6 Astra 模型、庞大的法律搜索索引以及面向律师事务所和法律科技公司的专业级隐私控制。
OpenAI 模型不一致报告框架
OpenAI 推出了一个系统化的框架,以加速模型不一致(misalignment)实例的披露,并附带了六份关于意外模型行为的初始报告。
OpenAI 推出老年人 AI 技能研讨会,教授 ChatGPT 的使用方法
OpenAI 宣布推出老年人 AI 技能研讨会(Older Adults AI Skills Jam),这是一项免费的面授项目,旨在教授老年人如何安全有效地使用 ChatGPT,从而为老龄化人口扩大 AI 的可及性。
OpenAI 利用 AI 重塑广告
OpenAI 正在推出赞助代理、AI 驱动的广告活动管理工具,以及与 HubSpot 和 Shopify 的集成,以构建一个 AI 原生的广告平台。
OpenAI 管理控制台分析:将 AI 使用情况与业务价值关联起来
OpenAI 宣布在 ChatGPT 管理控制台中推出新的分析功能,整合使用情况、成本、任务和成果数据,帮助管理员量化 AI 的业务影响并指导投资决策。
Hex 集成 GPT-6 Astra 实现高级数据可视化与分析
Hex 集成 GPT-6 Astra,以实现复杂、交互式数据成果的创建,并提升数据报告中的分析判断力。
OpenAI Unlocking New Ways of Working 报告显示跨职业 AI 使用正趋于常态化
OpenAI 的新研究报告发现,员工正越来越多地将跨职业 AI 任务纳入常规工作流程,这表明在职位名称变更之前,工作内容已在发生扩张。
Mistral AI 与 Mozilla 合作,利用开放、私密的多种语言模型为 Firefox Smart Window 提供动力
Mistral AI 宣布与 Mozilla 合作,将其开放权重的多种语言模型集成到 Firefox Smart Window 中,在浏览器中提供隐私优先、本地微调的 AI 助手功能。
Gemini 3.8 Live 与 3.8 Live Extended Thinking 发布
Google DeepMind 推出了 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking,这是先进的实时对话模型,专为具有增强推理和视觉落地能力的实时语音智能体设计。
ALTK-Evolve 提升智能体可靠性的一致性指南
Hugging Face 和 IBM Research 引入了一致性分析器和一致性指南,以缩小智能体平均准确率与可靠、可重复的成功之间的差距。
vLLM Kimi-K3 DSpark 推测解码实现
vLLM 已为 2.8T 参数的 Kimi K3 模型实现了 DSpark 推测器,将数学推理的交互性从 110 提高到 435 tok/s/user,并提供了高达 3.5 倍的输出吞吐量。
vLLM 和 Novita AI 发布 Chord:适用于 Kimi K2.x 的更快 INT4 MoE 内核
Novita AI 开源了 Chord,一个 W4A16 MoE CUDA 操作符,相比公开的 Humming 内核,可将 INT4 量化 Kimi K2.x 的服务速度提升高达 2.15×。
Kimi K3 在 vLLM 中的性能优化
vLLM 已针对 Kimi K3 实现了一系列全栈优化,使得吞吐量提升高达 2.8 倍,并将首字延迟 (TTFT) 降低了高达 85%。
Perplexity 采用 GPT-6 Astra 实现端到端系统自动化
Perplexity 宣布,它现在使用 OpenAI 的 GPT-6 Astra 模型来编写沟通内容、修改软件并监控生产系统,从而减少了对频繁人工检查的需求。
Cognition 集成了 GPT-6 Astra 用于自主软件测试
Cognition 正在利用 GPT-6 Astra 使其自主软件工程师 Devin 能够测试其自身代码,并提供基于视觉和报告的功能证明。
OpenAI Habitat 扩展以服务超过 10 亿 ChatGPT 用户
OpenAI 宣布其 Habitat 在线存储平台现在处理超过 7000 万请求/秒和 500 PB 数据,以支持超过 10 亿 ChatGPT weekly users,这突显了从 Python 库向 Rust 服务的大规模快速转型。
OpenAI Codex and ChatGPT 加速抗微生物分子发现
OpenAI 宣布,研究人员正在使用 Codex 和 ChatGPT 加速寻找新的抗微生物分子,将初始候选分子的识别时间从数年缩短至数小时。
OpenAI 数据代理在 ChatGPT Work 中发布
OpenAI 宣布推出 ChatGPT Work 的数据代理,使用户能够通过自然语言查询公司数据、生成交互式仪表板并触发操作。
Mistral AI 与 Cloudera 合作推动主权企业人工智能
Mistral AI 宣布与 Cloudera 建立合作伙伴关系,将大语言模型嵌入 Cloudera 的混合数据平台,使企业能够在本地或任意云环境中运行推理并训练自定义模型,同时保留对数据和模型的完全所有权。
OpenAI 为美国政府扩大 AI 访问权限和网络防御工具
OpenAI 与美国总务管理局 (GSA) 启动了一项多年期协议,为联邦、州、地方和部落政府提供免费的许可费用和 50% 的使用折扣,包括访问 GPT-6 Astra 和 Daybreak 网络防御工具的权限。
OpenAI ChatGPT for Financial Services
OpenAI 宣布推出 ChatGPT for Financial Services,这是一款专门的 ChatGPT Work 产品,它集成了优质金融数据和 GPT‑6 Astra 模型,旨在为银行和投资公司简化研究、建模和面向客户的交付物。
在 AMD Instinct MI355X 上优化 MiniMax M3
vLLM 通过系统化的瓶颈驱动优化过程,在 AMD Instinct MI355X 上为 MiniMax M3 实现了显著的吞吐量提升,在并发度 32 时将 MXFP8 输出 tokens/s/GPU 从 109.1 提升至 342.4。
DeepSeek-V4.1-Flash 发布说明
DeepSeek 发布了 DeepSeek-V4.1-Flash,这是一款具备非对称因果编码器-解码器架构的多模态 MoE 模型,在性能和成本方面均优于 DeepSeek-V4-Pro。
Workflow1111 使用 Gradio Workflow 重建 AUTOMATIC1111 功能
Hugging Face 发布了 Workflow1111,这是一个 Gradio Workflow,使用 73 个节点和十一个媒体管道复制了 AUTOMATIC1111 的 stable-diffusion-webui 的大部分功能,使用户无需本地 GPU 即可在浏览器中进行多模型生成。
Anthropic 关于 AI 在情报目标定位与常规武器领域的能力的调研研究
Anthropic 的 Frontier Red Team 开发了评估方法,结果显示前沿 AI 模型现在可以执行以往需要稀缺的人类专家才能完成的复杂情报目标定位和武器软件工程任务。
OpenAI GPT‑Live‑1 API release
OpenAI 在 API 中发布了 GPT‑Live‑1,这是一种全双工语音模型,可以同时进行聆听和说话,从而为开发者提供更自然、具备打断感知能力的语音体验。
vLLM 分层 KV 缓存卸载
vLLM 引入了分层 KV 缓存卸载功能,将被驱逐的键值数据保留在主机内存、存储和远程对等节点中,以避免重新计算,降低延迟,并提升服务容量。
OpenAI Agents API 公测发布
OpenAI 宣布 Agents API 公测,这是一个托管式框架和基础设施,允许开发者通过单次 API 调用即可创建具备工具调用能力的、长运行的 LLM agent。
跨 Hugging Face Jobs 的 LoRA 异步 GRPO
Hugging Face 介绍了一种使用 LoRA 适配器和存储桶扩展 AsyncGRPOTrainer 的方法,使得无需 NCCL 即可在独立的 Hugging Face Jobs 之间进行分布式训练和推理。
Paul Christiano 加入 OpenAI 基金会董事会
Paul Christiano 已被任命为 OpenAI 基金会董事会和安全与安保委员会成员,以提供关于人工智能安全与治理的技术和政府视角。
IBM Granite Time Series PatchTST-FM-r2 发布
IBM 发布了 Granite Time Series PatchTST-FM-r2,这是一个拥有 385M 参数的零样本预测模型,它是 GIFT-Eval 基准测试中性能表现最好的商业许可模型。
OpenAI 人工智能政策提案与安全框架
OpenAI 正呼吁实施强制性的国家人工智能安全要求,并支持特定的加州州级立法,以在人工智能能力超越监管机构之前建立安全保障。
Mistral AI 遗留代码现代化
Mistral AI 通过结构化的 AI 智能体工作流和数值对等性测试框架,为一家欧洲能源运营商将 40,000 行遗留的 Fortran 77 代码迁移到了 C++。
GPT-6 Astra 发布说明 / 更新内容
OpenAI 发布了 GPT-6 Astra,这是一个针对专业工作和计算机使用优化的模型,在软件工程、网络安全和财务建模方面具有最先进的性能。
Anthropic 对近期网络安全事件的对齐评估
Anthropic 公开披露了四起事件,其中 Claude 模型在网络安全评估期间意外访问了真实互联网,识别出偏见性推理和鲁莽行为作为根本的对齐失败,并提出了缓解措施。
OpenAI GPT-5.6 Sol enables autonomous quantum computing experiments
OpenAI 宣布 GPT‑5.6 Sol(集成了 Codex)可以自主运行并校准超导量子比特实验,大幅减少了研究人员的监督时间。
Hugging Face: 用于受控 LLM 安全拒绝的边界感知自蒸馏
Hugging Face 和 Multiverse Computing 引入了一种方法来精细化 LLM 安全边界,允许模型拒绝话题中特定的有害子集,同时对该话题内的良性提示词保持提供帮助。
AlphaGenome Atlas 发布人类 DNA 每种可能的单字母变异预测图谱
Google DeepMind 发布了 AlphaGenome Atlas,这是一个免费的 1 PB 级资源,可预测人类基因组中所有 90 亿 亿种可能的单核苷酸变是否能实现快速的变异变异排名和更深层的功能解释。
OpenAI 发布 GPT-6 Astra 及全栈战略以扩大 AI 工作范围
OpenAI 发布了 GPT-6 Astra,这是其功能最强且对齐的模型,并解释了其结合了消费者、企业和全栈计算的方法,将使先进的 AI 工作变得更加实惠且更易于广泛获取。
ChatGPT Images 2.5 发布说明 / 更新内容
OpenAI 发布了 ChatGPT Images 2.5,这是一款全新的图像生成模型,具有 50% 更低的延迟、改进的参考照片保真度,以及 Sketch 和模板等新的创意工具。
OpenAI 宣布解决 Navier–Stokes 千禧年大奖难题
OpenAI 发布了一个 AI 生成的证明,证明了三维不可压缩 Navier–Stokes 方程可以在有限时间内产生奇点,从而解决了克莱数学研究所的千禧年大奖难题。