Hugging Face 对白宫 AI 行动计划信息请求的回应
Hugging Face 主张开源和开放科学在 AI 开发中的根本作用,认为开源模型在性能和效率方面正日益匹配甚至超越闭源商业系统。
EliseAI: 通过 OpenAI 提升住房和医疗效率
EliseAI 利用 OpenAI 的 GPT-4 和 Whisper 模型,在住房和医疗行业自动化复杂的对话工作流,以提高运营效率。
ChatGPT for Business 2025年3月更新
OpenAI 在 2025 年 3 月为 ChatGPT for Business 引入了新功能,包括 Canvas、深度研究工具和 OpenAI o1 pro 模式。
NVIDIA GTC 2025 物理 AI 发布:Cosmos Transfer、物理 AI 数据集和 Isaac GR00T N1
NVIDIA 已发布用于可控世界场景生成的 Cosmos Transfer、一个 15TB 物理 AI 数据集以及 Isaac GR00T N1,这是首个用于通用人形机器人推理的开放基础模型。
Hugging Face Xet 存储集成
Hugging Face 已开始将仓库从 LFS 迁移到 Xet 存储,利用内容定义分块技术显著缩短了海量 AI 模型和数据集的上传与下载时间。
OpenAI 对埃隆·马斯克诉讼法院裁决的回应
OpenAI 宣布,法院已驳回埃隆·马斯克申请初步禁令的请求,并驳回了他的几项主张, affirming OpenAI 对维持其非营利实体的承诺。
LY Corporation 与 OpenAI 合作
LY Corporation 正在利用 OpenAI 的 API 和 GPT-4o 在其 LINE 和 Yahoo! JAPAN 平台上整合生成式 AI,预计年度销售额增加 110B yen,生产力提升 10B yen.
Gemma 3 发行说明 / 新功能
Google 发布了 Gemma 3,这是一个多模态、多语言的开放权重 LLM 家族,参数规模从 1B 到 27B,上下文窗口可达 128k 标记。
Open R1 Update #3: OlympicCoder 和代码推理洞察
Hugging Face 推出 OlympicCoder,一组在 IOI 问题上优于前沿模型的代码推理模型,并附带新数据集和训练推理模型的技术经验。
OpenAI 用于构建代理的新工具
OpenAI 发布了一套新的代理构建工具,包括 Responses API、开源 Agents SDK 以及用于网页搜索、文件搜索和计算机使用的内置工具。
LeRobot L2D: 世界上最大的开源自动驾驶数据集
Hugging Face 和 Yaak 发布了 Learning to Drive (L2D),这是一个多模态自动驾驶数据集,包含来自 30 个德国城市的超过 5,000 小时的驾驶数据,以实现端到端的空间智能训练。
OpenAI 链式思维监控用于奖励黑客检测
OpenAI 已经发现,监控链式思维(CoT)推理可以检测前沿模型中的奖励黑客和不当行为,但直接优化 CoT 以抑制不良思维可能导致模型隐藏其意图。
Nubank 集成 OpenAI GPT-4o 用于客户服务和欺诈检测
Nubank 正利用 OpenAI 的 GPT-4o 和 GPT-4o mini 自动化处理 55% 的一级客户咨询,将聊天响应时间降低 70%,并通过基于视觉的分析增强欺诈检测。
边缘上的LLM推理:通过React Native运行本地LLM
Hugging Face 提供了一份全面的指南,使用 React Native 和 llama.rn 在 Android 和 iOS 上本地运行量化的 GGUF 模型,构建注重隐私的移动应用。
Factory 使用 OpenAI 推理模型的软件开发平台
Factory 利用 OpenAI o1、o3-mini 和 GPT-4o 将特性开发周期提升 2-4 倍,并将上下文切换时间降低 60%。
QwQ-32B 发布说明 / 新功能
Qwen 发布了 QwQ-32B,这是一个 320亿参数的推理模型,利用扩展的强化学习来实现与更大的 DeepSeek-R1 相当的性能。
LaunchDarkly 的 AI 驱动产品管理方法
LaunchDarkly 首席产品与技术官 Claire Vo 阐述了 AI 如何自动化传统产品管理任务,并将角色推向商业通用管理或集成技术领导。
OpenAI NextGenAI 联盟启动
OpenAI 已启动 NextGenAI,这是一个由 15 家研究机构组成的联盟,获得 $50 million 的资助、算力和 API 访问支持,以加速 AI 驱动的研究和教育。
Aya Vision: 使用 8B 和 32B 模型推进多语言多模态
Cohere For AI 发布了 Aya Vision,这是一系列支持 23 种语言的开放权重视觉语言模型(8B 和 32B),在多语言多模态任务中表现优于更大的模型。
Hugging Face 与 JFrog 合作以增强 AI 模型安全
Hugging Face 已将 JFrog 的扫描器集成到 Hugging Face Hub,以减少误报并在各种序列化格式中检测模型权重内的恶意代码。
OpenAI 和美国国家实验室 1,000 科学家 AI Jam Session
OpenAI 和美国能源部在九个国家实验室组织了 '1,000 科学家 AI Jam Session',利用如 o3-mini 这样的前沿 AI 模型加速科学发现。
使用 Arize Phoenix 对 smolagents 进行跟踪与评估
Hugging Face 演示了如何将 Arize Phoenix 与 smolagents 结合使用,以实现对代理工作流的实时跟踪和基于 LLM‑as‑a‑judge 的评估。
Mercari 与 GPT-4o mini 的 AI 集成
Mercari 已将 GPT-4o mini 和其他 OpenAI 模型集成,以自动化产品列表生成并优化销售建议,从而提高了列表转化率和每位用户的平均销售额。
OpenAI GPT-4.5 研究预览
OpenAI 已发布 GPT-4.5,这是一个大规模通用模型,旨在相比 GPT-4o 提供更广泛的知识、改进的情感智能和减少的幻觉。
使用 o1 和 o3-mini 构建自主金融分析师
Endex 正在利用 OpenAI 的 o1 和 o3-mini 推理模型构建一个自主的 AI 金融分析师,能够进行复杂的数据合成、多模态分析和精确的金融推理。
Hugging Face 和 IISc 合作开源 Vaani 数据集
Hugging Face 与印度科学院(IISc)和 ARTPARK 合作,提供对 Vaani 的全球访问,Vaani 是一个旨在代表印度语言多样性的大规模多模态多语言数据集。
OpenAI Deep Research 系统卡片
OpenAI 已推出 Deep Research,这是一种由早期版本的 o3 驱动的、针对网页浏览进行了优化的代理式能力,用于执行复杂任务的多步骤互联网研究。
FastRTC: 用于 Python 的实时通信库
Hugging Face 发布了 FastRTC,这是一个旨在通过处理 WebRTC 和 WebSocket 通信层来简化实时音视频 AI 应用开发的 Python 库。
QwQ-Max-Preview 发布
Qwen 已推出 QwQ-Max-Preview,一个基于 Qwen2.5-Max 构建的预览推理模型,在数学、编码和 Agent 相关工作流程方面表现出色。
Hugging Face 远程 VAEs 用于推理端点
Hugging Face 推出了一项实验功能,将 VAE 解码过程委托给远程端点,以降低消费级 GPU 上高分辨率图像和视频合成的显存需求。
OpenAI 阻断 AI 的恶意使用
OpenAI 已发布一份报告,详细说明其阻断恶意 AI 使用的努力,重点在于防止国家关联的威胁行为者和威权政权利用 AI 进行隐蔽影响行动和网络活动。
SigLIP 2 发布说明 / 新特性
Google 发布了 SigLIP 2,这是一个多语言视觉语言编码器系列,在零样本分类、图像-文本检索和 VLM 迁移性能方面在所有规模上均优于原始 SigLIP。
Uber AI 集成用于按需服务
Uber 使用 OpenAI 的技术来个性化用户互动,自动化复杂的市场解决方案,并通过 AI 驱动的协作者提升劳动力生产力。
SmolVLM2: 让每台设备都能理解视频
Hugging Face 发布了 SmolVLM2,这是一系列高效的视觉和视频语言模型,参数规模为 2.2B、500M 和 256M,旨在使从手机到服务器的设备能够进行本地视频理解。
PaliGemma 2 Mix 发布说明
Google 已发布 PaliGemma 2 mix,这是一系列在包括 OCR、标题生成和目标检测在内的多样化任务上微调的视觉语言模型,以展示 PaliGemma 2 预训练检查点的潜力。
OpenAI SWE-Lancer 基准发布
OpenAI 推出了 SWE-Lancer,一个包含超过 1,400 个来自 Upwork 的真实世界自由职业软件工程任务的基准,用于衡量 AI 模型在软件开发中的经济影响和技术能力。
Hugging Face 添加 Hyperbolic、Nebius AI Studio 和 Novita 作为 Serverless 推理提供商
Hugging Face 已将 Hyperbolic、Nebius AI Studio 和 Novita 集成作为 Serverless 推理提供商,通过 Hub 和客户端 SDK 直接扩展对 DeepSeek-R1 和 FLUX.1 等模型的访问。
OpenAI 和 Guardian Media Group 内容合作伙伴关系
OpenAI 和 Guardian Media Group 已建立战略合作伙伴关系,将 Guardian 编辑内容整合到 ChatGPT 中,为每周 3 亿用户提供直接访问可信报道和扩展摘要的途径。
Hugging Face Open LLM Leaderboard 更新:集成 Math-Verify 以改进数学评估
Hugging Face 使用 Math-Verify 重新评估了 Open LLM Leaderboard 上的 3,751 个模型,以修复解析错误和格式严格性,导致 MATH-Hard 排名发生显著变动。
Hugging Face 将 Fireworks.ai 集成作为推理提供商
Hugging Face 已在 Hub 上添加 Fireworks.ai 作为受支持的推理提供商,使得如 DeepSeek-R1 和 Llama-3.2-90B-Vision-Instruct 等模型能够在 HF 生态系统中进行无服务器推理。
Fanatics Betting and Gaming 在金融领域的 AI 应用
Fanatics Betting and Gaming 正在利用 ChatGPT 和定制化 GPTs 来自动化手动财务任务,减少每月工作量并加速战略决策。
Wayfair AI 实施与策略
Wayfair 正在集成 OpenAI 的生成式 AI 和多模态功能,以个性化电子商务体验,现代化遗留代码库,并在法律工作流程中自动化风险分析。
Rogo 使用 OpenAI o1 和 GPT-4o 扩展金融研究
Rogo 利用包含 OpenAI o1 和 GPT-4o 的分层模型架构来自动化金融研究和尽职调查,每周为分析师节省超过 10 小时。
Hugging Face: 优化 10亿次分类的成本和延迟
Hugging Face 提供了一个框架和基准,用于降低大规模编码器模型推理的成本,表明 NVIDIA L4 GPU 和优化的批次大小可以以低至 253.82 美元处理 10亿 次文本分类。
OpenAI Model Spec 更新
OpenAI 已在 CC0 许可证下发布了更新的 Model Spec,以定义 AI 行为,优先考虑用户可定制性和知识自由,同时保持安全防护措施。
Hugging Face 视频数据集脚本
Hugging Face 推出了一套开源视频数据集脚本,旨在简化高质量、过滤后的数据集的创建,用于微调视频生成模型。
Hugging Face Xet支持的仓库:通过块级聚合加速Hub传输
Hugging Face 正在引入一个基于块的去重系统,使用 xet-core 和 hf_xet,通过块级聚合将上传和下载速度提高 2-3 倍。
Open R1 Update #2: OpenR1-Math-220k 数据集和推理洞察
Hugging Face 介绍了 OpenR1-Math-220k,这是一个旨在重建 DeepSeek R1 蒸馏管道的大规模数学推理数据集,同时分享了社区关于 GRPO 和 Chain-of-Thought 长度控制的见解。
OpenAI 与 Schibsted 媒体集团合作伙伴关系
OpenAI 已与 Schibsted 媒体集团合作,将 VG、Aftenposten、Aftonbladet 和 Svenska Dagbladet 等标题的高质量北欧新闻内容整合到 ChatGPT 中。
开放阿拉伯LLM排行榜 2
Hugging Face及其合作伙伴发布了开放阿拉伯LLM排行榜2(OALL v2),用本地阿拉伯数据集和新的RAG评估框架取代了饱和和机器翻译的基准,以更准确地衡量阿拉伯语能力。