✷ 归档 · 11 个实验室 · 3,058 篇 dispatch
实验室
不用每天手动刷十几个官方博客。OpenAI、Anthropic、DeepMind 等实验室的一手发布,每篇都提炼出核心内容。
Hugging Face CodeAgents + Structure:通过结构化生成提升代理可靠性
Hugging Face 的研究表明,通过强制 CodeAgents 在结构化 JSON 格式中生成 thoughts 和代码,能够在消除解析错误并强制显式推理的情况下,使有能力的模型的性能平均提升 2 到 7 个百分点。
Reed Hastings 加入 Anthropic 董事会
Netflix 联合创始人 Reed Hastings 已被任命为 Anthropic 董事会成员,旨在提供在扩展全球平台和应对 AI 社会影响方面的领导经验。
Ollama 新增流式工具调用支持
Ollama 现在支持带有工具调用的流式响应,允许聊天应用接收部分模型输出并实时调用函数。
DeepSeek-R1-0528 发布说明
DeepSeek 已发布 DeepSeek-R1-0528,这是 R1 模型的更新版本,具备更优的基准测试表现、更少的幻觉现象,以及对 JSON 输出和函数调用的支持。
Mistral Agents API 发布
Mistral AI 推出了 Agents API,这是一个将语言模型与内置连接器、持久化记忆和多智能体编排相结合的框架,旨在实现主动问题解决型 AI 智能体的创建。
Liger GRPO 与 TRL 集成
用户报告指出,在使用 Liger GRPO 损失函数、DeepSpeed ZeRO-3 和 Qwen2.5-0.5B-Instruct 模型的 bf16 精度时出现形状不匹配错误。
Hugging Face Python 版 Tiny Agents
Hugging Face 推出了 Python 版 Tiny Agents,这是一种轻量级的代理框架,基于模型上下文协议(MCP),能够让大型语言模型以最少的代码与外部工具交互。
OpenAI o3 Operator 更新
OpenAI 通过将基于 GPT-4o 的模型替换为基于 OpenAI o3 的版本,更新了 Operator 研究预览,以提升其计算机使用代理的能力。
Dell Enterprise Hub 更新:本地部署 AI 模型和应用程序
Dell 与 Hugging Face 更新了 Dell Enterprise Hub,提供完整的优化模型套件和可直接部署的 AI 应用程序,适用于 Dell AI 服务器和 AI PC。
OpenAI Deutschland:OpenAI 在慕尼黑设立本地办事处
OpenAI 在慕尼黑开设了其在德国的首个办事处,以支持其在德国遍布的欧洲用户、开发者和企业客户的高度集中。
OpenAI 与 CodeRabbit:使用 o3、o4-mini 和 GPT-4.1 加速软件交付
CodeRabbit 利用 OpenAI 的 o3、o4-mini 和 GPT-4.1 模型实现代码审查自动化,将生产缺陷降低 50%,并将拉取请求(PR)周期加速 25%‑50%。
OpenAI 启动 Stargate UAE 和 OpenAI for Countries 倡议
OpenAI 已启动 Stargate UAE,这是其 AI 基础设施平台的首次国际部署,作为新的 “OpenAI for Countries” 倡议的一部分,旨在帮助政府建设主权 AI 能力。
Claude 4 发布说明 / 有什么新功能
Anthropic 发布了 Claude Opus 4 和 Claude Sonnet 4,引入了最先进的编程能力、扩展思维与工具使用功能,以及 Claude Code 的正式发布。
Anthropic 正在启用 AI 安全等级 3 (ASL-3) 保护措施
Anthropic 已为 Claude Opus 4 启用 AI 安全等级 3 (ASL-3) 保护措施,作为降低与 CBRN 武器开发及模型权重窃取相关风险的预防性措施。
Mistral AI Devstral 发布
Mistral AI 发布了 Devstral,这是一款用于软件工程的智能体 LLM,它在 SWE-Bench Verified 基准测试中优于开源模型,并根据 Apache 2.0 许可提供。
OpenAI 响应 API 更新(2025年5月)
OpenAI 扩展了响应 API,加入了远程模型上下文协议(MCP)服务器支持、新的内置工具(如图像生成和代码解释器),以及企业级功能,包括后台模式和加密推理。
Falcon-H1:混合头语言模型的高效与性能
Hugging Face 与 TII UAE 推出了 Falcon-H1 系列,这是一套包含六个开源混合头模型(0.5B 至 34B),它们将 Transformer 注意力与 Mamba-2 状态空间模型相结合,以实现高性能、低内存占用和更快的推理。
Falcon-Arabic:阿拉伯语语言模型的突破
技术创新研究所(TII)发布了 Falcon-Arabic,这是一款拥有 7B 参数的模型,在通用知识、语法和推理方面,超越了更大的阿拉伯语大型语言模型,覆盖现代标准阿拉伯语和地区方言。
nanoVLM:用于训练视觉语言模型的极简 PyTorch 工具包
Hugging Face 发布了 nanoVLM,这是一款轻量级、纯 PyTorch 的工具包,旨在为初学者和研究者简化视觉语言模型(VLM)的训练和理解。
Hugging Face Diffusers 量化后端
Hugging Face Diffusers 集成了多个量化后端,包括 bitsandbytes、torchao、Quanto、GGUF 和 FP8 分层转型,以降低大型扩散模型(如 FLUX.1-dev)的内存占用。
Microsoft 与 Hugging Face 扩大在 Azure AI Foundry 上的合作
Microsoft 与 Hugging Face 已扩大合作,将超过 10,000 个开源模型集成到 Azure AI Foundry 中,实现多种 AI 模态的安全企业级部署。
OpenAI Codex:基于云的编码代理,由 codex-1 提供动力
OpenAI 推出了 Codex,这是一款基于云的编码代理,由 codex-1 模型(o3 的优化版本)提供动力,运行在隔离的云容器中,以执行软件工程任务。
OpenAI Codex 研究预览
OpenAI 已推出 Codex,这是一款基于云的软件工程代理,由 codex-1 模型提供支持,能够在隔离的沙箱环境中独立编写功能、修复错误并提出拉取请求。
Falcon-Edge:强大、通用且可微调的 1.58 位 LLM
Hugging Face 与 Falcon-LLM 团队发布了 Falcon-Edge,这是一系列 1.58 位(三元)语言模型,参数规模分别为 1B 和 3B,支持通过全新的预训练范式进行推理和微调。
Hugging Face Transformers:标准化模型定义以实现生态系统互操作性
Hugging Face 正在将 Transformers 库定位为模型定义的中心枢纽,以确保 Transformers 支持的任何架构都能自动兼容更广泛的机器学习生态系统,包括推理引擎和训练框架。
Ollama 多模态引擎发布
Ollama 推出了全新的多模态引擎,旨在提高视觉模型的本地推理可靠性与准确性,目前支持 Llama 4、Gemma 3、Qwen 2.5 VL 和 Mistral Small 3.1。
Expedia集团 AI 营销整合
Expedia集团正在利用生成式 AI 和 OpenAI API 来扩大内容生产、提升描述性分析,并适应不断变化的消费者搜索行为。
Hugging Face 与 Kaggle 的模型访问集成
Hugging Face 与 Kaggle 推出了一个集成,可直接在 Kaggle 笔记本和模型页面中提升 Hugging Face 模型的可发现性和可用性。
Anthropic ASL-3 安全防御漏洞赏金计划
Anthropic 与 HackerOne 合作推出了一个漏洞赏金计划,旨在针对通用越狱对 Constitutional Classifiers 进行压力测试,特别针对 CBRN 相关的滥用行为。
Hugging Face 推理端点:快速 Whisper 转录
Hugging Face 在推理端点上推出了新的 OpenAI Whisper 部署选项,实现了高达 8 倍的转录速度提升,同时不牺牲准确性。
OpenAI HealthBench 发布
OpenAI 推出了 HealthBench,这是一项新基准,包含 5,000 条真实的健康对话和 48,562 条由医生创建的评分标准准则,以严格评估 AI 在医疗保健领域的能力。
Hugging Face 视觉语言模型 2025 更新
Hugging Face 提供了对 2024‑2025 年间视觉语言模型(VLM)演进的全面概述,重点阐述了任意到任意架构、推理模型以及面向机器人领域的视觉‑语言‑动作(VLA)模型的兴起。
LeRobot 社区数据集:构建机器人领域的 ImageNet
Hugging Face 正在通过 LeRobot 推动社区驱动的努力,创建一个多样化、开源的机器人数据集库,以解决机器人策略的泛化挑战。
OpenAI 领导层扩张:Fidji Simo 被任命为应用业务首席执行官
OpenAI 任命 Fidji Simo 为应用业务首席执行官,以在公司发展为全球产品和基础设施组织的过程中,扩大其产品和运营职能。
OpenAI 对能源部关于 AI 基础设施的回应
OpenAI 主张简化许可流程并提供战略性的联邦财政激励,以加速在联邦土地上建设 AI 超级计算中心,从而保持美国在 AI 领域的领导地位。
OpenAI 在亚洲的数据驻留
OpenAI 为 ChatGPT Enterprise、ChatGPT Edu 和 API 平台在日本、印度、新加坡和韩国推出了数据驻留选项,以帮助组织满足本地数据主权要求。
Mistral Medium 3 发布说明
Mistral AI 发布了 Mistral Medium 3,这是一款前沿级模型,在提供最先进性能的同时,实现了 8 倍的成本降低并提供了灵活的企业部署选项。
Mistral AI 推出 Le Chat Enterprise
Mistral AI 已推出 Le Chat Enterprise,这是一个由 Mistral Medium 3 模型驱动的统一 AI 平台,它集成了企业数据并允许创建无代码 AI 智能体。
圣安东尼奥马刺队 ChatGPT 企业版集成
圣安东尼奥马刺队已整合 ChatGPT 企业版,以扩大运营增长,将员工 AI 流利度从 14% 提升至 85%,并部署定制 GPT 用于粉丝互动和业务运营。
Lowe's AI 实施与 OpenAI GPT-4o
Lowe's 已集成 GPT-4o,推出 Mylow 和 Mylow Companion,这两款 AI 驱动的顾问为客户和店内员工提供专业的项目指导。
OpenAI国家倡议
OpenAI 已推出 OpenAI for Countries,这是 Stargate 项目中的一项计划,旨在帮助各国构建主权 AI 基础设施、定制化 ChatGPT 服务以及基于民主 AI 原则的国家创业基金。
OpenAI 推出 AI 故事,突出 AI 在现实中的益处
OpenAI 正在推出 AI 故事,展示美国的个人和组织如何利用 AI 解决科学、医学和教育领域的问题,以推动经济增长和国家安全。
约翰迪尔 AI 集成与农业转型
约翰迪尔正在利用 OpenAI API 扩展精准农业,并通过 AI 驱动的诊断、实时遥测和 See & Spray 技术来转变客户成功。
OpenAI 结构演进:转变为公益公司
OpenAI 正在将其营利部门转变为公益公司(PBC),同时保持非营利组织的控制权,以获取规模化 AGI 所需的资源,造福全人类。
Lowe’s AI 集成用于家装零售
Lowe’s 正在利用 OpenAI 的 API 部署 AI 驱动的虚拟顾问和员工工具,将客户体验从单纯的产品销售转变为项目解决方案。
Anthropic 人工智能科学计划公告
Anthropic 已推出人工智能科学计划,为研究人员提供免费 API 信用额度,特别针对生物学和生命科学领域的高影响力项目。
OpenAI 对 GPT-4o 迎合问题及部署流程改进的分析
OpenAI 回滚了导致模型迎合行为增加的 GPT-4o 更新,并制定了将行为问题视为阻止发布的安全风险的新协议。
使用 Gradio 构建 MCP 服务器
Hugging Face 已将模型上下文协议(MCP)集成到 Gradio 中,使开发者只需更改一个参数即可将 Python 函数转换为 LLM 可访问的工具。
Qwen-3 对话模板分析
Qwen-3 模型引入了一种复杂的对话模板,支持可选推理、通过滚动检查点实现的动态上下文管理,以及改进的工具参数序列化。
Anthropic 对 AI 出口管制框架的回应
Anthropic 已向美国商务部提交建议,以加强扩散规则,认为维持算力优势对于国家安全和防止 AI 基础设施离岸化至关重要。