6151

Accelerate ND-Parallel:高效多 GPU 训练指南

Hugging Face 已将 ND-Parallelism 集成到 Accelerate 和 Axolotl 中,使用户能够组合数据并行、完全分片数据并行、张量并行和上下文并行策略,以优化大规模模型的多 GPU 训练。

6152

OpenAI GPT-5 发布说明

OpenAI 已发布 GPT-5,这是一款统一模型,整合了推理、代理和高级数学能力,以提升业务运营的准确性、速度和问题解决能力。

6153

GPT-5 开发者发布说明

OpenAI 已发布三种规模的 GPT-5(gpt-5、gpt-5-mini 和 gpt-5-nano),在编码、代理工具调用和长上下文检索方面实现了最先进的性能。

6154

GPT-5 编码与设计能力

OpenAI 宣布了 GPT-5,重点提升了编码和设计的能力,但公告中未提供具体的技术细节。

6155

OpenAI GPT-5 创意写作能力

OpenAI 宣布了 GPT-5 的新创意写作能力,扩展了模型生成高质量叙事和艺术文本的能力。

6156

医学研究与 GPT-5

OpenAI 已宣布将 GPT-5 应用于医学研究,扩大了模型在专业科学领域的实用性。

6157

TRL 中的视觉语言模型对齐

Hugging Face 已扩展 TRL 库以支持视觉语言模型的高级对齐方法,包括 MPO、GRPO 和 GSPO,此外还包括原生的 SFT 支持和 vLLM 集成。

6158

Cursor 中的 GPT-5 集成

OpenAI 宣布将 GPT-5 集成到 Cursor 代码编辑器中,提升了 AI 驱动的软件开发能力。

6159

OpenAI GPT-5 首次亮相

OpenAI 提供了 GPT-5 的首次亮相,标志着其大型语言模型系列进入新一代。

6160

安进如何使用 GPT-5

安进通过 OpenAI API 利用 GPT-5 加速生物技术研究和药物发现过程。

6161

OpenAI GPT-5 系统卡

OpenAI 已发布 GPT-5,一个统一系统,具备实时路由器,可根据查询复杂度在快速高吞吐模型和更深层推理模型之间动态切换。

6162

GPT-5 安全完成:从基于拒绝的方式转向以输出为中心的安全训练

OpenAI 为 GPT-5 引入了安全完成,这是一种在惩罚不安全输出的同时最大化有用性的安全训练方法,减少了对双重用途提示的二元“遵从或拒绝”权衡。

6163

OpenAI GPT-5 发布说明

OpenAI 已发布 GPT-5,这是一套统一的 AI 系统,配备实时路由器,可在快速模型和更深层推理模型之间切换,提供在编码、数学和健康等领域的专家级智能。

6164

OpenAI 与 GSA 合作:为美国联邦劳动力提供 ChatGPT Enterprise

OpenAI 为美国联邦行政部门全体员工提供 ChatGPT Enterprise,费用为每个机构每年 1 美元,以降低行政负担并提升公共服务交付。

6165

OpenAI 估计开放权重大型语言模型的最坏情况前沿风险

OpenAI 通过使用恶意微调(MFT)来尝试在生物学和网络安全领域激发最大能力,评估了发布 gpt-oss 的风险,发现该模型相较于现有的开放权重模型并未显著推动风险前沿的提升。

6166

OpenAI gpt-oss-120b 与 gpt-oss-20b 发布

OpenAI 已发布 gpt-oss-120b 和 gpt-oss-20b,这两款在 Apache 2.0 许可证下的开源权重推理模型旨在用于代理工作流并支持可定制的推理力度。

6167

OpenAI gpt-oss 发布说明

OpenAI 已发布 gpt-oss-120b 和 gpt-oss-20b,这两款在 Apache 2.0 许可证下的开源权重推理模型,提供前沿水平的推理和工具使用能力,并针对消费级硬件进行优化。

6168

OpenAI 开放权重发布

OpenAI 已发布其最强大的开放权重推理模型,以实现 AI 访问的民主化,并在全球推动美国主导的民主 AI 标准。

6169

NVIDIA AI-Q Blueprint:DeepResearch Bench 上排名最高的开放深度研究代理

NVIDIA 的 AI-Q Blueprint 在 Hugging Face DeepResearch Bench 上的开放许可证堆栈中夺得榜首,采用 Llama 3.3-70B Instruct 与 Llama-3.3-Nemotron-Super-49B-v1.5 的组合实现。

6170

Qwen-Image 发布:原生文本渲染与精确图像编辑

Qwen-Image 是一个 20B MMDiT 图像基础模型,提供业界领先的复杂文本渲染和精确图像编辑能力。

6171

OpenAI 优化 ChatGPT 以提升用户实用性和福祉

OpenAI 正在将 ChatGPT 的优化目标从停留时间等参与度指标转向实际效用和用户福祉,并引入休息提醒以及对高风险个人决策的改进处理。

6172

3LM:面向阿拉伯语大型语言模型的STEM与代码基准

Hugging Face 与阿联酋技术创新研究院(TII UAE)推出 3LM,这是首个旨在评估阿拉伯语大型语言模型在 STEM 领域和代码生成方面的综合基准。

6173

Figma AI 集成与产品演进

Figma 正在其平台中集成 AI,以自动化常规设计任务,并通过 Figma Make 引入提示到应用的能力,将设计师的角色从实现转变为高级问题解决。

6174

使用 Gradio 在 Python 中实现 MCP 服务器

Hugging Face 推出了一种方法,帮助 Python 开发者使用 Gradio 快速构建 Model Context Protocol (MCP) 服务器,使 LLMs 能够与 Hugging Face Hub 上的数千个 AI 模型和 Spaces 集成。

6175

OpenAI 推出 Stargate Norway AI 数据中心

OpenAI 已在挪威纳尔维克推出了 Stargate Norway,这是一项以可再生能源驱动的 AI 数据中心计划,目标是在 2026 年底交付 100,000 块 NVIDIA GPU。

6176

Intercom 的可持续 AI 优势策略

Intercom 通过优先实现早期模型熟练度、严格的评估框架以及支持快速模型切换和成本优化的模块化架构,获得了可持续的 AI 优势。

6177

ChatGPT 学习模式发布

OpenAI 在 ChatGPT 中推出了学习模式,这是一种学习体验,旨在通过苏格拉底式提问和分层响应来引导学生解决问题,而不是直接提供答案。

6178

Hugging Face Trackio 发布

Hugging Face 已发布 Trackio,这是一款免费、开源、轻量级的实验跟踪库,可作为 wandb 的即插即用替代品,并原生集成 Hugging Face Spaces 和 Datasets。

6179

Qwen GSPO:可扩展的语言模型强化学习

Qwen 引入了 Group Sequence Policy Optimization(GSPO),这是一种序列级别的强化学习算法,相较于 GRPO 在训练稳定性和效率上都有显著提升,尤其适用于混合专家(MoE)模型。

6180

Hugging Face CLI 更新:迁移至 hf 命令

Hugging Face 已将 huggingface-cli 重命名为 hf,推出了更符合人体工学的资源-动作命令结构,并提供了在 HF 基础设施上运行脚本的新 hf jobs 服务。

6181

Parquet 内容定义分块用于高效数据去重

Hugging Face 推出 Parquet 内容定义分块(CDC),现已在 PyArrow 和 Pandas 中可用,使得在 Xet 存储层上对 Parquet 文件进行高效去重成为可能,显著降低上传和下载时间。

6182

Qwen-MT Turbo 发布说明

Qwen 发布了 Qwen-MT(qwen-mt-turbo),这是一款基于轻量级 MoE 的翻译模型,支持 92 种语言,具备高度可定制性且 API 成本低廉。

6183

Outtake 网络安全代理由 OpenAI 提供动力

Outtake 使用 GPT-4.1 和 OpenAI o3 自动检测和解决数字威胁,将下架时间从 60 天缩短到几小时。

6184

使用 Diffusers 和 PEFT 的 Flux 快速 LoRA 推理

Hugging Face 推出了一套针对 Flux.1-Dev 的优化方案,通过结合热切换、torch.compile 和 FP8 量化,实现 LoRA 推理最高 2.23 倍的加速。

6185

TimeScope:长视频大型多模态模型理解的新基准

Hugging Face 推出 TimeScope,这是一项开源基准,通过在时长从 1 分钟到 8 小时的内容中插入视频针,评估视觉语言模型的时间理解能力。

6186

OpenAI DevDay 2025 公告

OpenAI 将于 2025 年 10 月 6 日在旧金山举办第三届年度 DevDay,分享新进展并与超过 1,500 名开发者交流。

6187

Model ML 金融服务 AI 基础设施

Model ML 正在利用 OpenAI 的最新模型和 Agent SDK,为金融机构提供专用 AI 代理和端到端工作流自动化。

6188

Qwen3-Coder 发布说明

Qwen 已发布 Qwen3-Coder,这是一款混合专家模型,在代理式编码、浏览器使用和工具使用方面实现了开源模型的最新水平,性能可与 Claude Sonnet 4 相媲美。

6189

OpenAI 与 Penda Health AI 临床副驾驶研究

OpenAI 与 Penda Health 开发了 AI Consult,这款基于大型语言模型的副驾驶在肯尼亚内罗毕近 40,000 次患者就诊中将诊断错误降低了 16%,治疗错误降低了 13%。

6190

OpenAI 与 Oracle 合作扩展 Stargate AI 基础设施 4.5 GW

OpenAI 与 Oracle 合作在美国开发 4.5 吉瓦的额外 Stargate 数据中心容量,使 OpenAI 正在建设的总容量超过 5 GW。

6191

OpenAI 经济分析与生产力研究计划

OpenAI 发布了首份关于 ChatGPT 提升生产力的经济分析,并启动了一项为期 12 个月的研究合作,以评估 AI 对劳动力的影响。

6192

NVIDIA NIM 与 Hugging Face 的集成

NVIDIA 已将 NVIDIA NIM 扩展至支持 Hugging Face 上的超过 100,000 个 LLM,提供一个统一的 Docker 容器,实现模型分析、后端选择和性能优化的自动化,以实现快速部署。

6193

OpenAI 与英国政府的 AI 驱动增长战略合作伙伴关系

OpenAI 与英国政府已签署谅解备忘录,以加速公共和私营部门的 AI 采用并在英国扩展 AI 基础设施。

6194

OpenAI 应用业务首席执行官任命公告:人工智能作为全球赋能的工具

OpenAI 任命了一位新的应用业务首席执行官,负责推动人工智能驱动的知识、医疗、经济自由和个人支持的普惠化。

6195

OpenAI 启动 5000 万美元基金,支持非营利组织和社区组织

OpenAI 已设立一项初始 5000 万美元基金,直接支持非营利组织和社区组织在医疗、教育和经济机会等领域利用 AI 为公共利益服务。

6196

Arc 虚拟细胞挑战指南

Arc 虚拟细胞挑战要求参与者训练模型,以预测通过 CRISPR 对基因沉默对细胞转录组的影响,使用包含 30 万条单细胞 RNA 测序数据的数据集。

6197

ChatGPT 代理系统卡片

OpenAI 推出了 ChatGPT 代理,这是一款基于 o3 系列的代理模型,集成了深度研究、基于浏览器的任务执行、终端访问以及外部数据连接器。

6198

OpenAI 推出 ChatGPT 代理

OpenAI 已推出 ChatGPT 代理,这是一套统一的代理系统,结合网页交互、深度研究和对话智能,在虚拟计算机上执行复杂的多步骤任务。

6199

Gradio 5.38.0 MCP 服务器改进

Gradio 5.38.0 版为其模型上下文协议(MCP)服务器功能引入了五项关键更新,包括无缝的本地文件支持、实时进度通知以及自动化的 OpenAPI 规范转换。

6200

Hugging Face FutureBench:评估 AI 代理在未来事件预测中的表现

Hugging Face 推出了 FutureBench,这是一项通过要求 AI 代理预测未来真实世界事件来评估其推理和综合能力的基准,从而有效消除数据污染。