6201

NVIDIA AI-Q Blueprint:DeepResearch Bench 上排名最高的开放深度研究代理

NVIDIA 的 AI-Q Blueprint 在 Hugging Face DeepResearch Bench 上的开放许可证堆栈中夺得榜首,采用 Llama 3.3-70B Instruct 与 Llama-3.3-Nemotron-Super-49B-v1.5 的组合实现。

6202

Qwen-Image 发布:原生文本渲染与精确图像编辑

Qwen-Image 是一个 20B MMDiT 图像基础模型,提供业界领先的复杂文本渲染和精确图像编辑能力。

6203

OpenAI 优化 ChatGPT 以提升用户实用性和福祉

OpenAI 正在将 ChatGPT 的优化目标从停留时间等参与度指标转向实际效用和用户福祉,并引入休息提醒以及对高风险个人决策的改进处理。

6204

3LM:面向阿拉伯语大型语言模型的STEM与代码基准

Hugging Face 与阿联酋技术创新研究院(TII UAE)推出 3LM,这是首个旨在评估阿拉伯语大型语言模型在 STEM 领域和代码生成方面的综合基准。

6205

Figma AI 集成与产品演进

Figma 正在其平台中集成 AI,以自动化常规设计任务,并通过 Figma Make 引入提示到应用的能力,将设计师的角色从实现转变为高级问题解决。

6206

使用 Gradio 在 Python 中实现 MCP 服务器

Hugging Face 推出了一种方法,帮助 Python 开发者使用 Gradio 快速构建 Model Context Protocol (MCP) 服务器,使 LLMs 能够与 Hugging Face Hub 上的数千个 AI 模型和 Spaces 集成。

6207

OpenAI 推出 Stargate Norway AI 数据中心

OpenAI 已在挪威纳尔维克推出了 Stargate Norway,这是一项以可再生能源驱动的 AI 数据中心计划,目标是在 2026 年底交付 100,000 块 NVIDIA GPU。

6208

Intercom 的可持续 AI 优势策略

Intercom 通过优先实现早期模型熟练度、严格的评估框架以及支持快速模型切换和成本优化的模块化架构,获得了可持续的 AI 优势。

6209

ChatGPT 学习模式发布

OpenAI 在 ChatGPT 中推出了学习模式,这是一种学习体验,旨在通过苏格拉底式提问和分层响应来引导学生解决问题,而不是直接提供答案。

6210

Hugging Face Trackio 发布

Hugging Face 已发布 Trackio,这是一款免费、开源、轻量级的实验跟踪库,可作为 wandb 的即插即用替代品,并原生集成 Hugging Face Spaces 和 Datasets。

6211

Qwen GSPO:可扩展的语言模型强化学习

Qwen 引入了 Group Sequence Policy Optimization(GSPO),这是一种序列级别的强化学习算法,相较于 GRPO 在训练稳定性和效率上都有显著提升,尤其适用于混合专家(MoE)模型。

6212

Hugging Face CLI 更新:迁移至 hf 命令

Hugging Face 已将 huggingface-cli 重命名为 hf,推出了更符合人体工学的资源-动作命令结构,并提供了在 HF 基础设施上运行脚本的新 hf jobs 服务。

6213

Parquet 内容定义分块用于高效数据去重

Hugging Face 推出 Parquet 内容定义分块(CDC),现已在 PyArrow 和 Pandas 中可用,使得在 Xet 存储层上对 Parquet 文件进行高效去重成为可能,显著降低上传和下载时间。

6214

Qwen-MT Turbo 发布说明

Qwen 发布了 Qwen-MT(qwen-mt-turbo),这是一款基于轻量级 MoE 的翻译模型,支持 92 种语言,具备高度可定制性且 API 成本低廉。

6215

Outtake 网络安全代理由 OpenAI 提供动力

Outtake 使用 GPT-4.1 和 OpenAI o3 自动检测和解决数字威胁,将下架时间从 60 天缩短到几小时。

6216

使用 Diffusers 和 PEFT 的 Flux 快速 LoRA 推理

Hugging Face 推出了一套针对 Flux.1-Dev 的优化方案,通过结合热切换、torch.compile 和 FP8 量化,实现 LoRA 推理最高 2.23 倍的加速。

6217

TimeScope:长视频大型多模态模型理解的新基准

Hugging Face 推出 TimeScope,这是一项开源基准,通过在时长从 1 分钟到 8 小时的内容中插入视频针,评估视觉语言模型的时间理解能力。

6218

OpenAI DevDay 2025 公告

OpenAI 将于 2025 年 10 月 6 日在旧金山举办第三届年度 DevDay,分享新进展并与超过 1,500 名开发者交流。

6219

Model ML 金融服务 AI 基础设施

Model ML 正在利用 OpenAI 的最新模型和 Agent SDK,为金融机构提供专用 AI 代理和端到端工作流自动化。

6220

Qwen3-Coder 发布说明

Qwen 已发布 Qwen3-Coder,这是一款混合专家模型,在代理式编码、浏览器使用和工具使用方面实现了开源模型的最新水平,性能可与 Claude Sonnet 4 相媲美。

6221

OpenAI 与 Penda Health AI 临床副驾驶研究

OpenAI 与 Penda Health 开发了 AI Consult,这款基于大型语言模型的副驾驶在肯尼亚内罗毕近 40,000 次患者就诊中将诊断错误降低了 16%,治疗错误降低了 13%。

6222

OpenAI 与 Oracle 合作扩展 Stargate AI 基础设施 4.5 GW

OpenAI 与 Oracle 合作在美国开发 4.5 吉瓦的额外 Stargate 数据中心容量,使 OpenAI 正在建设的总容量超过 5 GW。

6223

OpenAI 经济分析与生产力研究计划

OpenAI 发布了首份关于 ChatGPT 提升生产力的经济分析,并启动了一项为期 12 个月的研究合作,以评估 AI 对劳动力的影响。

6224

NVIDIA NIM 与 Hugging Face 的集成

NVIDIA 已将 NVIDIA NIM 扩展至支持 Hugging Face 上的超过 100,000 个 LLM,提供一个统一的 Docker 容器,实现模型分析、后端选择和性能优化的自动化,以实现快速部署。

6225

OpenAI 与英国政府的 AI 驱动增长战略合作伙伴关系

OpenAI 与英国政府已签署谅解备忘录,以加速公共和私营部门的 AI 采用并在英国扩展 AI 基础设施。

6226

OpenAI 应用业务首席执行官任命公告:人工智能作为全球赋能的工具

OpenAI 任命了一位新的应用业务首席执行官,负责推动人工智能驱动的知识、医疗、经济自由和个人支持的普惠化。

6227

OpenAI 启动 5000 万美元基金,支持非营利组织和社区组织

OpenAI 已设立一项初始 5000 万美元基金,直接支持非营利组织和社区组织在医疗、教育和经济机会等领域利用 AI 为公共利益服务。

6228

Arc 虚拟细胞挑战指南

Arc 虚拟细胞挑战要求参与者训练模型,以预测通过 CRISPR 对基因沉默对细胞转录组的影响,使用包含 30 万条单细胞 RNA 测序数据的数据集。

6229

ChatGPT 代理系统卡片

OpenAI 推出了 ChatGPT 代理,这是一款基于 o3 系列的代理模型,集成了深度研究、基于浏览器的任务执行、终端访问以及外部数据连接器。

6230

OpenAI 推出 ChatGPT 代理

OpenAI 已推出 ChatGPT 代理,这是一套统一的代理系统,结合网页交互、深度研究和对话智能,在虚拟计算机上执行复杂的多步骤任务。

6231

Gradio 5.38.0 MCP 服务器改进

Gradio 5.38.0 版为其模型上下文协议(MCP)服务器功能引入了五项关键更新,包括无缝的本地文件支持、实时进度通知以及自动化的 OpenAPI 规范转换。

6232

Hugging Face FutureBench:评估 AI 代理在未来事件预测中的表现

Hugging Face 推出了 FutureBench,这是一项通过要求 AI 代理预测未来真实世界事件来评估其推理和综合能力的基准,从而有效消除数据污染。

6233

Invideo AI 与 OpenAI 模型的集成

Invideo AI 使用由 OpenAI o3、GPT-4.1 和 gpt-image-1 提供动力的多代理系统,将视频制作时间缩短 10 倍,通过自然语言提示将创意转化为专业视频。

6234

OpenAI董事会关于非营利委员会报告的声明

OpenAI董事会发布声明,承认独立非营利委员会的调查结果,该委员会负责提出组织慈善工作如何解决系统性问题的建议,以确保AGI惠及全人类。

6235

OpenAI 非营利组织 Jam 计划

OpenAI 与沃尔顿家族基金会和 Emerson Collective 合作,发起了非营利组织 Jam,向遍布美国 10 个地点的 1,000 多名非营利组织领袖提供 AI 培训和工具,以扩大他们的社区影响力。

6236

Consilium:多LLM协作平台

Consilium 是一个多LLM平台,通过结构化辩论和研究,使多个 AI 模型达成共识,既可作为 Gradio 界面,也可作为 MCP 服务器进行集成。

6237

Ettin Suite:SoTA 配对编码器和解码器

Hugging Face 推出 Ettin,这是一套配对的仅编码器和仅解码器模型(参数范围 17M-1B),在相同的数据和配方下训练,以提供对架构性能的受控比较。

6238

OpenAI 知识自由设计框架

OpenAI 为 ChatGPT 引入了一个知识自由框架,重点是默认客观性、用户可控的自定义以及针对政治偏见的新评估。

6239

Hugging Face Hub 从 Git LFS 迁移到 Xet

Hugging Face 已将 500,000 个仓库和 20 PB 数据从 Git LFS 迁移到 Xet,这是一种为 AI 工作负载而设计的内容寻址存储系统。

6240

OpenAI 欧盟实践准则与欧洲 AI 战略

OpenAI 已宣布其意向签署欧盟《通用人工智能实践准则》,并启动 “OpenAI for Countries European Rollout”,以在欧洲扩展 AI 基础设施和应用采纳。

6241

Kimina-Prover:在大规模形式推理模型上应用测试时强化学习搜索

Hugging Face 宣布推出 Kimina-Prover-72B,这是一款面向 Lean 4 的最先进定理证明模型,凭借新颖的测试时强化学习(TTRL)搜索框架,在 miniF2F 基准上实现了 92.2% 的通过率。

6242

构建 Hugging Face MCP 服务器

Hugging Face 已发布官方的模型上下文协议(MCP)服务器,使 AI 助手能够通过单一 URL 动态访问 Hugging Face Hub 和数千个基于 Gradio 的 AI 应用程序。

6243

ScreenEnv 发布:部署全栈桌面代理

Hugging Face 发布了 ScreenEnv,这是一款 Python 库,可在 Docker 容器中创建隔离的 Ubuntu 桌面环境,用于测试和部署 GUI 代理。

6244

Hugging Face 异步机器人推理

Hugging Face 引入了异步机器人推理,将动作预测与执行解耦,减少机器人空闲时间,并实现任务完成时间最高约 2 倍的加速。

6245

Hugging Face Gradio MCP 服务器集成

Hugging Face 已将模型上下文协议(MCP)集成到 Gradio(v5.28.0),使 Hugging Face Spaces 成为一个庞大的 MCP 服务器库,为 LLM 提供图像编辑、转录等新能力。

6246

为 AMD MI300 创建自定义内核

Hugging Face 与 AMD 合作开发了针对 MI300X 的开源优化内核,显著提升了在 VLLM 中使用 FP8 推理 Llama 3.1 405B 的性能。

6247

Reachy Mini:开源桌面机器人用于 AI 开发

Hugging Face 与 Pollen Robotics 推出了 Reachy Mini,这是一款开源、可编程的桌面机器人,起价 $399,旨在用于人机交互和 AI 实验。

6248

OpenAI 与 AFT 启动国家人工智能教学学院

OpenAI 与美国教师联合会合作,启动国家人工智能教学学院,这是一项为期五年的计划,提供 1000 万美元的资金和资源,以提升 40 万名 K-12 教师的 AI 能力。

6249

Hugging Face 高效多模态数据管道

Hugging Face 引入了一个五阶段的多模态数据管道优化流程,采用平衡背包打包策略,以最小化 GPU 空闲时间和填充浪费。

6250

SmolLM3 发布:多语言、长上下文 3B 推理模型

Hugging Face 发布了 SmolLM3,这是一款 3B 参数模型,性能优于 Llama-3.2-3B 和 Qwen2.5-3B,具备双模式推理和 128k 上下文窗口。