Hugging Face 使用 Infisical 的机密管理扩展
Hugging Face 迁移至 Infisical,以在多云环境中实现机密管理的集中化,消除机密散乱,并通过自动化的 Kubernetes 集成和 RBAC 提升安全性。
文本生成推理 (TGI) Intel Gaudi 集成
Hugging Face 已将 Intel Gaudi 硬件支持直接集成到 Text Generation Inference (TGI) 主代码库中,为在 Intel AI 加速器上运行 LLM 提供了生产就绪的服务解决方案。
QVQ-Max 视觉推理模型发布
Qwen 已发布 QVQ-Max,这是一款能够分析图像和视频,以解决数学、编程和创意任务中复杂问题的视觉推理模型。
Zendesk 与 OpenAI:向主动 AI 代理转型以提升客户服务
Zendesk 正在试点一类由 OpenAI 模型驱动的 AI 代理,利用生成式推理和多代理架构,实现高达 80% 的客户服务解决方案自动化。
DeepSeek-V3-0324 发布说明
DeepSeek 发布了 DeepSeek-V3-0324,这是 R1 的基座模型更新版本,采用 MIT 许可证,并在指令遵循、编程和数学能力方面有所提升。
Qwen2.5-Omni 发布:用于实时交互的端到端多模态模型
Qwen 发布了 Qwen2.5-Omni,这是一款端到端多模态模型,能够处理文本、图像、音频和视频,以生成实时流式文本和自然语音响应。
OpenAI 面向 AGI 开发的安全策略
OpenAI 正在实施一个多层次的安全框架,结合 AI 驱动的防御、持续的红队演练以及零信任架构,以在向 AGI 迈进的过程中保护基础设施和新兴的 AI 代理。
使用 Sentence Transformers 训练和微调重新排序模型
Hugging Face 通过 Sentence Transformers 提供了完整的指南和框架,用于训练和微调 Cross Encoder 重新排序模型,以优化特定领域的检索性能。
OpenAI GPT-4o 图像生成发布
OpenAI 已将原生图像生成集成到 GPT-4o 中,使其能够在单一多模态模型中实现精确的文本渲染、多轮细化以及高保真度的写实效果。
GPT-4o 图像生成系统卡片附录
OpenAI 已在 GPT-4o 中原生嵌入了一种新的图像生成功能,能够实现照片级真实感输出、图像到图像的转换以及精确的文本渲染。
Hebbia Matrix: 使用多代理 AI 自动化金融和法律工作流
Hebbia 推出了 Matrix,这是一款由 OpenAI 的 o1、o3-mini 和 GPT-4o 提供动力的多代理 AI 平台,通过克服离线数据的 RAG 限制,实现了金融和法律工作高达 90% 的自动化。
OpenAI 领导层更新 2025年3月
OpenAI 已扩大 Mark Chen、Brad Lightcap 和 Julia Villagra 的职务,以更好地整合研究与产品开发并扩大全球运营。
Gradio 数据框更新:新功能和增强
Hugging Face 已更新 Gradio 中的 gr.Dataframe 组件,新增多单元格选择、列固定、搜索与过滤功能,并提升了可访问性。
Qwen2.5-VL-32B 发布说明
Qwen 已发布 Qwen2.5-VL-32B-Instruct,这是一款通过强化学习优化的视觉语言模型,具备卓越的数学推理能力、细粒度的图像理解以及符合人类偏好的响应。
OpenAI 与 MIT Media Lab 关于 ChatGPT 情感使用的研究
OpenAI 与 MIT Media Lab 对情感使用——即与 AI 的情感交互——进行了研究,发现虽然此类使用在真实世界中很少见,但其对福祉的影响因用户行为、交互方式和个人情况而异。
Hugging Face 推理端点分析更新
Hugging Face 更新了其推理端点分析仪表板,加入实时指标、可自定义时间范围以及详细的副本生命周期视图,以提升监控和调试能力。
Booking.com 与 OpenAI 个性化集成
Booking.com 已集成 OpenAI 的 GPT 模型,通过 AI 行程规划器、智能筛选和自动化评论摘要,彻底改变旅行发现和预订方式。
OpenAI 下一代音频模型 API 发布
OpenAI 在其 API 中发布了新的语音转文本和文本转语音模型,具备提升的转录准确性和可引导的合成语音,供语音代理使用。
Open R1:在本地运行 OlympicCoder 7B 进行编码
Hugging Face 提供了一份指南,介绍如何使用 LM Studio 和 Continue VS Code 扩展在本地部署 OlympicCoder 7B 模型,以实现可与 Claude 3.7 Sonnet 和 GPT-4o 在 LiveCodeBench 上竞争的编码性能。
Hugging Face 对白宫 AI 行动计划信息请求的回应
Hugging Face 主张开源和开放科学在 AI 开发中的根本作用,认为开源模型在性能和效率方面正日益匹配甚至超越闭源商业系统。
EliseAI: 通过 OpenAI 提升住房和医疗效率
EliseAI 利用 OpenAI 的 GPT-4 和 Whisper 模型,在住房和医疗行业自动化复杂的对话工作流,以提高运营效率。
ChatGPT for Business 2025年3月更新
OpenAI 在 2025 年 3 月为 ChatGPT for Business 引入了新功能,包括 Canvas、深度研究工具和 OpenAI o1 pro 模式。
NVIDIA GTC 2025 物理 AI 发布:Cosmos Transfer、物理 AI 数据集和 Isaac GR00T N1
NVIDIA 已发布用于可控世界场景生成的 Cosmos Transfer、一个 15TB 物理 AI 数据集以及 Isaac GR00T N1,这是首个用于通用人形机器人推理的开放基础模型。
Hugging Face Xet 存储集成
Hugging Face 已开始将仓库从 LFS 迁移到 Xet 存储,利用内容定义分块技术显著缩短了海量 AI 模型和数据集的上传与下载时间。
OpenAI 对埃隆·马斯克诉讼法院裁决的回应
OpenAI 宣布,法院已驳回埃隆·马斯克申请初步禁令的请求,并驳回了他的几项主张, affirming OpenAI 对维持其非营利实体的承诺。
LY Corporation 与 OpenAI 合作
LY Corporation 正在利用 OpenAI 的 API 和 GPT-4o 在其 LINE 和 Yahoo! JAPAN 平台上整合生成式 AI,预计年度销售额增加 110B yen,生产力提升 10B yen.
Gemma 3 发行说明 / 新功能
Google 发布了 Gemma 3,这是一个多模态、多语言的开放权重 LLM 家族,参数规模从 1B 到 27B,上下文窗口可达 128k 标记。
Open R1 Update #3: OlympicCoder 和代码推理洞察
Hugging Face 推出 OlympicCoder,一组在 IOI 问题上优于前沿模型的代码推理模型,并附带新数据集和训练推理模型的技术经验。
OpenAI 用于构建代理的新工具
OpenAI 发布了一套新的代理构建工具,包括 Responses API、开源 Agents SDK 以及用于网页搜索、文件搜索和计算机使用的内置工具。
LeRobot L2D: 世界上最大的开源自动驾驶数据集
Hugging Face 和 Yaak 发布了 Learning to Drive (L2D),这是一个多模态自动驾驶数据集,包含来自 30 个德国城市的超过 5,000 小时的驾驶数据,以实现端到端的空间智能训练。
OpenAI 链式思维监控用于奖励黑客检测
OpenAI 已经发现,监控链式思维(CoT)推理可以检测前沿模型中的奖励黑客和不当行为,但直接优化 CoT 以抑制不良思维可能导致模型隐藏其意图。
Nubank 集成 OpenAI GPT-4o 用于客户服务和欺诈检测
Nubank 正利用 OpenAI 的 GPT-4o 和 GPT-4o mini 自动化处理 55% 的一级客户咨询,将聊天响应时间降低 70%,并通过基于视觉的分析增强欺诈检测。
边缘上的LLM推理:通过React Native运行本地LLM
Hugging Face 提供了一份全面的指南,使用 React Native 和 llama.rn 在 Android 和 iOS 上本地运行量化的 GGUF 模型,构建注重隐私的移动应用。
Factory 使用 OpenAI 推理模型的软件开发平台
Factory 利用 OpenAI o1、o3-mini 和 GPT-4o 将特性开发周期提升 2-4 倍,并将上下文切换时间降低 60%。
QwQ-32B 发布说明 / 新功能
Qwen 发布了 QwQ-32B,这是一个 320亿参数的推理模型,利用扩展的强化学习来实现与更大的 DeepSeek-R1 相当的性能。
LaunchDarkly 的 AI 驱动产品管理方法
LaunchDarkly 首席产品与技术官 Claire Vo 阐述了 AI 如何自动化传统产品管理任务,并将角色推向商业通用管理或集成技术领导。
OpenAI NextGenAI 联盟启动
OpenAI 已启动 NextGenAI,这是一个由 15 家研究机构组成的联盟,获得 $50 million 的资助、算力和 API 访问支持,以加速 AI 驱动的研究和教育。
Aya Vision: 使用 8B 和 32B 模型推进多语言多模态
Cohere For AI 发布了 Aya Vision,这是一系列支持 23 种语言的开放权重视觉语言模型(8B 和 32B),在多语言多模态任务中表现优于更大的模型。
Hugging Face 与 JFrog 合作以增强 AI 模型安全
Hugging Face 已将 JFrog 的扫描器集成到 Hugging Face Hub,以减少误报并在各种序列化格式中检测模型权重内的恶意代码。
OpenAI 和美国国家实验室 1,000 科学家 AI Jam Session
OpenAI 和美国能源部在九个国家实验室组织了 '1,000 科学家 AI Jam Session',利用如 o3-mini 这样的前沿 AI 模型加速科学发现。
使用 Arize Phoenix 对 smolagents 进行跟踪与评估
Hugging Face 演示了如何将 Arize Phoenix 与 smolagents 结合使用,以实现对代理工作流的实时跟踪和基于 LLM‑as‑a‑judge 的评估。
Mercari 与 GPT-4o mini 的 AI 集成
Mercari 已将 GPT-4o mini 和其他 OpenAI 模型集成,以自动化产品列表生成并优化销售建议,从而提高了列表转化率和每位用户的平均销售额。
OpenAI GPT-4.5 研究预览
OpenAI 已发布 GPT-4.5,这是一个大规模通用模型,旨在相比 GPT-4o 提供更广泛的知识、改进的情感智能和减少的幻觉。
使用 o1 和 o3-mini 构建自主金融分析师
Endex 正在利用 OpenAI 的 o1 和 o3-mini 推理模型构建一个自主的 AI 金融分析师,能够进行复杂的数据合成、多模态分析和精确的金融推理。
Hugging Face 和 IISc 合作开源 Vaani 数据集
Hugging Face 与印度科学院(IISc)和 ARTPARK 合作,提供对 Vaani 的全球访问,Vaani 是一个旨在代表印度语言多样性的大规模多模态多语言数据集。
OpenAI Deep Research 系统卡片
OpenAI 已推出 Deep Research,这是一种由早期版本的 o3 驱动的、针对网页浏览进行了优化的代理式能力,用于执行复杂任务的多步骤互联网研究。
FastRTC: 用于 Python 的实时通信库
Hugging Face 发布了 FastRTC,这是一个旨在通过处理 WebRTC 和 WebSocket 通信层来简化实时音视频 AI 应用开发的 Python 库。
QwQ-Max-Preview 发布
Qwen 已推出 QwQ-Max-Preview,一个基于 Qwen2.5-Max 构建的预览推理模型,在数学、编码和 Agent 相关工作流程方面表现出色。
Hugging Face 远程 VAEs 用于推理端点
Hugging Face 推出了一项实验功能,将 VAE 解码过程委托给远程端点,以降低消费级 GPU 上高分辨率图像和视频合成的显存需求。
OpenAI 阻断 AI 的恶意使用
OpenAI 已发布一份报告,详细说明其阻断恶意 AI 使用的努力,重点在于防止国家关联的威胁行为者和威权政权利用 AI 进行隐蔽影响行动和网络活动。