归档 · 11 个实验室 · 3,058 篇 dispatch

实验室

不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。

1651

Hugging Face CodeAgents + Structure:通过结构化生成提升代理可靠性

Hugging Face 的研究表明,通过强制 CodeAgents 在结构化 JSON 格式中生成 thoughts 和代码,能够在消除解析错误并强制显式推理的情况下,使有能力的模型的性能平均提升 2 到 7 个百分点。

1652

Reed Hastings 加入 Anthropic 董事会

Netflix 联合创始人 Reed Hastings 已被任命为 Anthropic 董事会成员,旨在提供在扩展全球平台和应对 AI 社会影响方面的领导经验。

1653

Ollama 新增流式工具调用支持

Ollama 现在支持带有工具调用的流式响应,允许聊天应用接收部分模型输出并实时调用函数。

1654

DeepSeek-R1-0528 发布说明

DeepSeek 已发布 DeepSeek-R1-0528,这是 R1 模型的更新版本,具备更优的基准测试表现、更少的幻觉现象,以及对 JSON 输出和函数调用的支持。

1655

Mistral Agents API 发布

Mistral AI 推出了 Agents API,这是一个将语言模型与内置连接器、持久化记忆和多智能体编排相结合的框架,旨在实现主动问题解决型 AI 智能体的创建。

1656

Liger GRPO 与 TRL 集成

用户报告指出,在使用 Liger GRPO 损失函数、DeepSpeed ZeRO-3 和 Qwen2.5-0.5B-Instruct 模型的 bf16 精度时出现形状不匹配错误。

1657

Hugging Face Python 版 Tiny Agents

Hugging Face 推出了 Python 版 Tiny Agents,这是一种轻量级的代理框架,基于模型上下文协议(MCP),能够让大型语言模型以最少的代码与外部工具交互。

1658

OpenAI o3 Operator 更新

OpenAI 通过将基于 GPT-4o 的模型替换为基于 OpenAI o3 的版本,更新了 Operator 研究预览,以提升其计算机使用代理的能力。

1659

Dell Enterprise Hub 更新:本地部署 AI 模型和应用程序

Dell 与 Hugging Face 更新了 Dell Enterprise Hub,提供完整的优化模型套件和可直接部署的 AI 应用程序,适用于 Dell AI 服务器和 AI PC。

1660

OpenAI Deutschland:OpenAI 在慕尼黑设立本地办事处

OpenAI 在慕尼黑开设了其在德国的首个办事处,以支持其在德国遍布的欧洲用户、开发者和企业客户的高度集中。

1661

OpenAI 与 CodeRabbit:使用 o3、o4-mini 和 GPT-4.1 加速软件交付

CodeRabbit 利用 OpenAI 的 o3、o4-mini 和 GPT-4.1 模型实现代码审查自动化,将生产缺陷降低 50%,并将拉取请求(PR)周期加速 25%‑50%。

1662

OpenAI 启动 Stargate UAE 和 OpenAI for Countries 倡议

OpenAI 已启动 Stargate UAE,这是其 AI 基础设施平台的首次国际部署,作为新的 “OpenAI for Countries” 倡议的一部分,旨在帮助政府建设主权 AI 能力。

1663

Claude 4 发布说明 / 有什么新功能

Anthropic 发布了 Claude Opus 4 和 Claude Sonnet 4,引入了最先进的编程能力、扩展思维与工具使用功能,以及 Claude Code 的正式发布。

1664

Anthropic 正在启用 AI 安全等级 3 (ASL-3) 保护措施

Anthropic 已为 Claude Opus 4 启用 AI 安全等级 3 (ASL-3) 保护措施,作为降低与 CBRN 武器开发及模型权重窃取相关风险的预防性措施。

1665

Mistral AI Devstral 发布

Mistral AI 发布了 Devstral,这是一款用于软件工程的智能体 LLM,它在 SWE-Bench Verified 基准测试中优于开源模型,并根据 Apache 2.0 许可提供。

1666

OpenAI 响应 API 更新(2025年5月)

OpenAI 扩展了响应 API,加入了远程模型上下文协议(MCP)服务器支持、新的内置工具(如图像生成和代码解释器),以及企业级功能,包括后台模式和加密推理。

1667

Falcon-H1:混合头语言模型的高效与性能

Hugging Face 与 TII UAE 推出了 Falcon-H1 系列,这是一套包含六个开源混合头模型(0.5B 至 34B),它们将 Transformer 注意力与 Mamba-2 状态空间模型相结合,以实现高性能、低内存占用和更快的推理。

1668

Falcon-Arabic:阿拉伯语语言模型的突破

技术创新研究所(TII)发布了 Falcon-Arabic,这是一款拥有 7B 参数的模型,在通用知识、语法和推理方面,超越了更大的阿拉伯语大型语言模型,覆盖现代标准阿拉伯语和地区方言。

1669

nanoVLM:用于训练视觉语言模型的极简 PyTorch 工具包

Hugging Face 发布了 nanoVLM,这是一款轻量级、纯 PyTorch 的工具包,旨在为初学者和研究者简化视觉语言模型(VLM)的训练和理解。

1670

Hugging Face Diffusers 量化后端

Hugging Face Diffusers 集成了多个量化后端,包括 bitsandbytes、torchao、Quanto、GGUF 和 FP8 分层转型,以降低大型扩散模型(如 FLUX.1-dev)的内存占用。

1671

Microsoft 与 Hugging Face 扩大在 Azure AI Foundry 上的合作

Microsoft 与 Hugging Face 已扩大合作,将超过 10,000 个开源模型集成到 Azure AI Foundry 中,实现多种 AI 模态的安全企业级部署。

1672

OpenAI Codex:基于云的编码代理,由 codex-1 提供动力

OpenAI 推出了 Codex,这是一款基于云的编码代理,由 codex-1 模型(o3 的优化版本)提供动力,运行在隔离的云容器中,以执行软件工程任务。

1673

OpenAI Codex 研究预览

OpenAI 已推出 Codex,这是一款基于云的软件工程代理,由 codex-1 模型提供支持,能够在隔离的沙箱环境中独立编写功能、修复错误并提出拉取请求。

1674

Falcon-Edge:强大、通用且可微调的 1.58 位 LLM

Hugging Face 与 Falcon-LLM 团队发布了 Falcon-Edge,这是一系列 1.58 位(三元)语言模型,参数规模分别为 1B 和 3B,支持通过全新的预训练范式进行推理和微调。

1675

Hugging Face Transformers:标准化模型定义以实现生态系统互操作性

Hugging Face 正在将 Transformers 库定位为模型定义的中心枢纽,以确保 Transformers 支持的任何架构都能自动兼容更广泛的机器学习生态系统,包括推理引擎和训练框架。

1676

Ollama 多模态引擎发布

Ollama 推出了全新的多模态引擎,旨在提高视觉模型的本地推理可靠性与准确性,目前支持 Llama 4、Gemma 3、Qwen 2.5 VL 和 Mistral Small 3.1。

1677

Expedia集团 AI 营销整合

Expedia集团正在利用生成式 AI 和 OpenAI API 来扩大内容生产、提升描述性分析,并适应不断变化的消费者搜索行为。

1678

Hugging Face 与 Kaggle 的模型访问集成

Hugging Face 与 Kaggle 推出了一个集成,可直接在 Kaggle 笔记本和模型页面中提升 Hugging Face 模型的可发现性和可用性。

1679

Anthropic ASL-3 安全防御漏洞赏金计划

Anthropic 与 HackerOne 合作推出了一个漏洞赏金计划,旨在针对通用越狱对 Constitutional Classifiers 进行压力测试,特别针对 CBRN 相关的滥用行为。

1680

Hugging Face 推理端点:快速 Whisper 转录

Hugging Face 在推理端点上推出了新的 OpenAI Whisper 部署选项,实现了高达 8 倍的转录速度提升,同时不牺牲准确性。

1681

OpenAI HealthBench 发布

OpenAI 推出了 HealthBench,这是一项新基准,包含 5,000 条真实的健康对话和 48,562 条由医生创建的评分标准准则,以严格评估 AI 在医疗保健领域的能力。

1682

Hugging Face 视觉语言模型 2025 更新

Hugging Face 提供了对 2024‑2025 年间视觉语言模型(VLM)演进的全面概述,重点阐述了任意到任意架构、推理模型以及面向机器人领域的视觉‑语言‑动作(VLA)模型的兴起。

1683

LeRobot 社区数据集:构建机器人领域的 ImageNet

Hugging Face 正在通过 LeRobot 推动社区驱动的努力,创建一个多样化、开源的机器人数据集库,以解决机器人策略的泛化挑战。

1684

OpenAI 领导层扩张:Fidji Simo 被任命为应用业务首席执行官

OpenAI 任命 Fidji Simo 为应用业务首席执行官,以在公司发展为全球产品和基础设施组织的过程中,扩大其产品和运营职能。

1685

OpenAI 对能源部关于 AI 基础设施的回应

OpenAI 主张简化许可流程并提供战略性的联邦财政激励,以加速在联邦土地上建设 AI 超级计算中心,从而保持美国在 AI 领域的领导地位。

1686

OpenAI 在亚洲的数据驻留

OpenAI 为 ChatGPT Enterprise、ChatGPT Edu 和 API 平台在日本、印度、新加坡和韩国推出了数据驻留选项,以帮助组织满足本地数据主权要求。

1687

Mistral Medium 3 发布说明

Mistral AI 发布了 Mistral Medium 3,这是一款前沿级模型,在提供最先进性能的同时,实现了 8 倍的成本降低并提供了灵活的企业部署选项。

1688

Mistral AI 推出 Le Chat Enterprise

Mistral AI 已推出 Le Chat Enterprise,这是一个由 Mistral Medium 3 模型驱动的统一 AI 平台,它集成了企业数据并允许创建无代码 AI 智能体。

1689

圣安东尼奥马刺队 ChatGPT 企业版集成

圣安东尼奥马刺队已整合 ChatGPT 企业版,以扩大运营增长,将员工 AI 流利度从 14% 提升至 85%,并部署定制 GPT 用于粉丝互动和业务运营。

1690

Lowe's AI 实施与 OpenAI GPT-4o

Lowe's 已集成 GPT-4o,推出 Mylow 和 Mylow Companion,这两款 AI 驱动的顾问为客户和店内员工提供专业的项目指导。

1691

OpenAI国家倡议

OpenAI 已推出 OpenAI for Countries,这是 Stargate 项目中的一项计划,旨在帮助各国构建主权 AI 基础设施、定制化 ChatGPT 服务以及基于民主 AI 原则的国家创业基金。

1692

OpenAI 推出 AI 故事,突出 AI 在现实中的益处

OpenAI 正在推出 AI 故事,展示美国的个人和组织如何利用 AI 解决科学、医学和教育领域的问题,以推动经济增长和国家安全。

1693

约翰迪尔 AI 集成与农业转型

约翰迪尔正在利用 OpenAI API 扩展精准农业,并通过 AI 驱动的诊断、实时遥测和 See & Spray 技术来转变客户成功。

1694

OpenAI 结构演进:转变为公益公司

OpenAI 正在将其营利部门转变为公益公司(PBC),同时保持非营利组织的控制权,以获取规模化 AGI 所需的资源,造福全人类。

1695

Lowe’s AI 集成用于家装零售

Lowe’s 正在利用 OpenAI 的 API 部署 AI 驱动的虚拟顾问和员工工具,将客户体验从单纯的产品销售转变为项目解决方案。

1696

Anthropic 人工智能科学计划公告

Anthropic 已推出人工智能科学计划,为研究人员提供免费 API 信用额度,特别针对生物学和生命科学领域的高影响力项目。

1697

OpenAI 对 GPT-4o 迎合问题及部署流程改进的分析

OpenAI 回滚了导致模型迎合行为增加的 GPT-4o 更新,并制定了将行为问题视为阻止发布的安全风险的新协议。

1698

使用 Gradio 构建 MCP 服务器

Hugging Face 已将模型上下文协议(MCP)集成到 Gradio 中,使开发者只需更改一个参数即可将 Python 函数转换为 LLM 可访问的工具。

1699

Qwen-3 对话模板分析

Qwen-3 模型引入了一种复杂的对话模板,支持可选推理、通过滚动检查点实现的动态上下文管理,以及改进的工具参数序列化。

1700

Anthropic 对 AI 出口管制框架的回应

Anthropic 已向美国商务部提交建议,以加强扩散规则,认为维持算力优势对于国家安全和防止 AI 基础设施离岸化至关重要。