Cursor 中的 GPT-5 集成
OpenAI 宣布将 GPT-5 集成到 Cursor 代码编辑器中,提升了 AI 驱动的软件开发能力。
OpenAI GPT-5 首次亮相
OpenAI 提供了 GPT-5 的首次亮相,标志着其大型语言模型系列进入新一代。
安进如何使用 GPT-5
安进通过 OpenAI API 利用 GPT-5 加速生物技术研究和药物发现过程。
OpenAI GPT-5 系统卡
OpenAI 已发布 GPT-5,一个统一系统,具备实时路由器,可根据查询复杂度在快速高吞吐模型和更深层推理模型之间动态切换。
GPT-5 安全完成:从基于拒绝的方式转向以输出为中心的安全训练
OpenAI 为 GPT-5 引入了安全完成,这是一种在惩罚不安全输出的同时最大化有用性的安全训练方法,减少了对双重用途提示的二元“遵从或拒绝”权衡。
OpenAI GPT-5 发布说明
OpenAI 已发布 GPT-5,这是一套统一的 AI 系统,配备实时路由器,可在快速模型和更深层推理模型之间切换,提供在编码、数学和健康等领域的专家级智能。
OpenAI 与 GSA 合作:为美国联邦劳动力提供 ChatGPT Enterprise
OpenAI 为美国联邦行政部门全体员工提供 ChatGPT Enterprise,费用为每个机构每年 1 美元,以降低行政负担并提升公共服务交付。
OpenAI 估计开放权重大型语言模型的最坏情况前沿风险
OpenAI 通过使用恶意微调(MFT)来尝试在生物学和网络安全领域激发最大能力,评估了发布 gpt-oss 的风险,发现该模型相较于现有的开放权重模型并未显著推动风险前沿的提升。
OpenAI gpt-oss-120b 与 gpt-oss-20b 发布
OpenAI 已发布 gpt-oss-120b 和 gpt-oss-20b,这两款在 Apache 2.0 许可证下的开源权重推理模型旨在用于代理工作流并支持可定制的推理力度。
OpenAI gpt-oss 发布说明
OpenAI 已发布 gpt-oss-120b 和 gpt-oss-20b,这两款在 Apache 2.0 许可证下的开源权重推理模型,提供前沿水平的推理和工具使用能力,并针对消费级硬件进行优化。
OpenAI 开放权重发布
OpenAI 已发布其最强大的开放权重推理模型,以实现 AI 访问的民主化,并在全球推动美国主导的民主 AI 标准。
NVIDIA AI-Q Blueprint:DeepResearch Bench 上排名最高的开放深度研究代理
NVIDIA 的 AI-Q Blueprint 在 Hugging Face DeepResearch Bench 上的开放许可证堆栈中夺得榜首,采用 Llama 3.3-70B Instruct 与 Llama-3.3-Nemotron-Super-49B-v1.5 的组合实现。
Qwen-Image 发布:原生文本渲染与精确图像编辑
Qwen-Image 是一个 20B MMDiT 图像基础模型,提供业界领先的复杂文本渲染和精确图像编辑能力。
OpenAI 优化 ChatGPT 以提升用户实用性和福祉
OpenAI 正在将 ChatGPT 的优化目标从停留时间等参与度指标转向实际效用和用户福祉,并引入休息提醒以及对高风险个人决策的改进处理。
3LM:面向阿拉伯语大型语言模型的STEM与代码基准
Hugging Face 与阿联酋技术创新研究院(TII UAE)推出 3LM,这是首个旨在评估阿拉伯语大型语言模型在 STEM 领域和代码生成方面的综合基准。
Figma AI 集成与产品演进
Figma 正在其平台中集成 AI,以自动化常规设计任务,并通过 Figma Make 引入提示到应用的能力,将设计师的角色从实现转变为高级问题解决。
使用 Gradio 在 Python 中实现 MCP 服务器
Hugging Face 推出了一种方法,帮助 Python 开发者使用 Gradio 快速构建 Model Context Protocol (MCP) 服务器,使 LLMs 能够与 Hugging Face Hub 上的数千个 AI 模型和 Spaces 集成。
OpenAI 推出 Stargate Norway AI 数据中心
OpenAI 已在挪威纳尔维克推出了 Stargate Norway,这是一项以可再生能源驱动的 AI 数据中心计划,目标是在 2026 年底交付 100,000 块 NVIDIA GPU。
Intercom 的可持续 AI 优势策略
Intercom 通过优先实现早期模型熟练度、严格的评估框架以及支持快速模型切换和成本优化的模块化架构,获得了可持续的 AI 优势。
ChatGPT 学习模式发布
OpenAI 在 ChatGPT 中推出了学习模式,这是一种学习体验,旨在通过苏格拉底式提问和分层响应来引导学生解决问题,而不是直接提供答案。
Hugging Face Trackio 发布
Hugging Face 已发布 Trackio,这是一款免费、开源、轻量级的实验跟踪库,可作为 wandb 的即插即用替代品,并原生集成 Hugging Face Spaces 和 Datasets。
Qwen GSPO:可扩展的语言模型强化学习
Qwen 引入了 Group Sequence Policy Optimization(GSPO),这是一种序列级别的强化学习算法,相较于 GRPO 在训练稳定性和效率上都有显著提升,尤其适用于混合专家(MoE)模型。
Hugging Face CLI 更新:迁移至 hf 命令
Hugging Face 已将 huggingface-cli 重命名为 hf,推出了更符合人体工学的资源-动作命令结构,并提供了在 HF 基础设施上运行脚本的新 hf jobs 服务。
Parquet 内容定义分块用于高效数据去重
Hugging Face 推出 Parquet 内容定义分块(CDC),现已在 PyArrow 和 Pandas 中可用,使得在 Xet 存储层上对 Parquet 文件进行高效去重成为可能,显著降低上传和下载时间。
Qwen-MT Turbo 发布说明
Qwen 发布了 Qwen-MT(qwen-mt-turbo),这是一款基于轻量级 MoE 的翻译模型,支持 92 种语言,具备高度可定制性且 API 成本低廉。
Outtake 网络安全代理由 OpenAI 提供动力
Outtake 使用 GPT-4.1 和 OpenAI o3 自动检测和解决数字威胁,将下架时间从 60 天缩短到几小时。
使用 Diffusers 和 PEFT 的 Flux 快速 LoRA 推理
Hugging Face 推出了一套针对 Flux.1-Dev 的优化方案,通过结合热切换、torch.compile 和 FP8 量化,实现 LoRA 推理最高 2.23 倍的加速。
TimeScope:长视频大型多模态模型理解的新基准
Hugging Face 推出 TimeScope,这是一项开源基准,通过在时长从 1 分钟到 8 小时的内容中插入视频针,评估视觉语言模型的时间理解能力。
OpenAI DevDay 2025 公告
OpenAI 将于 2025 年 10 月 6 日在旧金山举办第三届年度 DevDay,分享新进展并与超过 1,500 名开发者交流。
Model ML 金融服务 AI 基础设施
Model ML 正在利用 OpenAI 的最新模型和 Agent SDK,为金融机构提供专用 AI 代理和端到端工作流自动化。
Qwen3-Coder 发布说明
Qwen 已发布 Qwen3-Coder,这是一款混合专家模型,在代理式编码、浏览器使用和工具使用方面实现了开源模型的最新水平,性能可与 Claude Sonnet 4 相媲美。
OpenAI 与 Penda Health AI 临床副驾驶研究
OpenAI 与 Penda Health 开发了 AI Consult,这款基于大型语言模型的副驾驶在肯尼亚内罗毕近 40,000 次患者就诊中将诊断错误降低了 16%,治疗错误降低了 13%。
OpenAI 与 Oracle 合作扩展 Stargate AI 基础设施 4.5 GW
OpenAI 与 Oracle 合作在美国开发 4.5 吉瓦的额外 Stargate 数据中心容量,使 OpenAI 正在建设的总容量超过 5 GW。
OpenAI 经济分析与生产力研究计划
OpenAI 发布了首份关于 ChatGPT 提升生产力的经济分析,并启动了一项为期 12 个月的研究合作,以评估 AI 对劳动力的影响。
NVIDIA NIM 与 Hugging Face 的集成
NVIDIA 已将 NVIDIA NIM 扩展至支持 Hugging Face 上的超过 100,000 个 LLM,提供一个统一的 Docker 容器,实现模型分析、后端选择和性能优化的自动化,以实现快速部署。
OpenAI 与英国政府的 AI 驱动增长战略合作伙伴关系
OpenAI 与英国政府已签署谅解备忘录,以加速公共和私营部门的 AI 采用并在英国扩展 AI 基础设施。
OpenAI 应用业务首席执行官任命公告:人工智能作为全球赋能的工具
OpenAI 任命了一位新的应用业务首席执行官,负责推动人工智能驱动的知识、医疗、经济自由和个人支持的普惠化。
OpenAI 启动 5000 万美元基金,支持非营利组织和社区组织
OpenAI 已设立一项初始 5000 万美元基金,直接支持非营利组织和社区组织在医疗、教育和经济机会等领域利用 AI 为公共利益服务。
Arc 虚拟细胞挑战指南
Arc 虚拟细胞挑战要求参与者训练模型,以预测通过 CRISPR 对基因沉默对细胞转录组的影响,使用包含 30 万条单细胞 RNA 测序数据的数据集。
ChatGPT 代理系统卡片
OpenAI 推出了 ChatGPT 代理,这是一款基于 o3 系列的代理模型,集成了深度研究、基于浏览器的任务执行、终端访问以及外部数据连接器。
OpenAI 推出 ChatGPT 代理
OpenAI 已推出 ChatGPT 代理,这是一套统一的代理系统,结合网页交互、深度研究和对话智能,在虚拟计算机上执行复杂的多步骤任务。
Gradio 5.38.0 MCP 服务器改进
Gradio 5.38.0 版为其模型上下文协议(MCP)服务器功能引入了五项关键更新,包括无缝的本地文件支持、实时进度通知以及自动化的 OpenAPI 规范转换。
Hugging Face FutureBench:评估 AI 代理在未来事件预测中的表现
Hugging Face 推出了 FutureBench,这是一项通过要求 AI 代理预测未来真实世界事件来评估其推理和综合能力的基准,从而有效消除数据污染。
Invideo AI 与 OpenAI 模型的集成
Invideo AI 使用由 OpenAI o3、GPT-4.1 和 gpt-image-1 提供动力的多代理系统,将视频制作时间缩短 10 倍,通过自然语言提示将创意转化为专业视频。
OpenAI董事会关于非营利委员会报告的声明
OpenAI董事会发布声明,承认独立非营利委员会的调查结果,该委员会负责提出组织慈善工作如何解决系统性问题的建议,以确保AGI惠及全人类。
OpenAI 非营利组织 Jam 计划
OpenAI 与沃尔顿家族基金会和 Emerson Collective 合作,发起了非营利组织 Jam,向遍布美国 10 个地点的 1,000 多名非营利组织领袖提供 AI 培训和工具,以扩大他们的社区影响力。
Consilium:多LLM协作平台
Consilium 是一个多LLM平台,通过结构化辩论和研究,使多个 AI 模型达成共识,既可作为 Gradio 界面,也可作为 MCP 服务器进行集成。
Ettin Suite:SoTA 配对编码器和解码器
Hugging Face 推出 Ettin,这是一套配对的仅编码器和仅解码器模型(参数范围 17M-1B),在相同的数据和配方下训练,以提供对架构性能的受控比较。
OpenAI 知识自由设计框架
OpenAI 为 ChatGPT 引入了一个知识自由框架,重点是默认客观性、用户可控的自定义以及针对政治偏见的新评估。
Hugging Face Hub 从 Git LFS 迁移到 Xet
Hugging Face 已将 500,000 个仓库和 20 PB 数据从 Git LFS 迁移到 Xet,这是一种为 AI 工作负载而设计的内容寻址存储系统。