6501

Hugging Face 使用 Infisical 的机密管理扩展

Hugging Face 迁移至 Infisical,以在多云环境中实现机密管理的集中化,消除机密散乱,并通过自动化的 Kubernetes 集成和 RBAC 提升安全性。

6502

文本生成推理 (TGI) Intel Gaudi 集成

Hugging Face 已将 Intel Gaudi 硬件支持直接集成到 Text Generation Inference (TGI) 主代码库中,为在 Intel AI 加速器上运行 LLM 提供了生产就绪的服务解决方案。

6503

QVQ-Max 视觉推理模型发布

Qwen 已发布 QVQ-Max,这是一款能够分析图像和视频,以解决数学、编程和创意任务中复杂问题的视觉推理模型。

6504

Zendesk 与 OpenAI:向主动 AI 代理转型以提升客户服务

Zendesk 正在试点一类由 OpenAI 模型驱动的 AI 代理,利用生成式推理和多代理架构,实现高达 80% 的客户服务解决方案自动化。

6505

DeepSeek-V3-0324 发布说明

DeepSeek 发布了 DeepSeek-V3-0324,这是 R1 的基座模型更新版本,采用 MIT 许可证,并在指令遵循、编程和数学能力方面有所提升。

6506

Qwen2.5-Omni 发布:用于实时交互的端到端多模态模型

Qwen 发布了 Qwen2.5-Omni,这是一款端到端多模态模型,能够处理文本、图像、音频和视频,以生成实时流式文本和自然语音响应。

6507

OpenAI 面向 AGI 开发的安全策略

OpenAI 正在实施一个多层次的安全框架,结合 AI 驱动的防御、持续的红队演练以及零信任架构,以在向 AGI 迈进的过程中保护基础设施和新兴的 AI 代理。

6508

使用 Sentence Transformers 训练和微调重新排序模型

Hugging Face 通过 Sentence Transformers 提供了完整的指南和框架,用于训练和微调 Cross Encoder 重新排序模型,以优化特定领域的检索性能。

6509

OpenAI GPT-4o 图像生成发布

OpenAI 已将原生图像生成集成到 GPT-4o 中,使其能够在单一多模态模型中实现精确的文本渲染、多轮细化以及高保真度的写实效果。

6510

GPT-4o 图像生成系统卡片附录

OpenAI 已在 GPT-4o 中原生嵌入了一种新的图像生成功能,能够实现照片级真实感输出、图像到图像的转换以及精确的文本渲染。

6511

Hebbia Matrix: 使用多代理 AI 自动化金融和法律工作流

Hebbia 推出了 Matrix,这是一款由 OpenAI 的 o1、o3-mini 和 GPT-4o 提供动力的多代理 AI 平台,通过克服离线数据的 RAG 限制,实现了金融和法律工作高达 90% 的自动化。

6512

OpenAI 领导层更新 2025年3月

OpenAI 已扩大 Mark Chen、Brad Lightcap 和 Julia Villagra 的职务,以更好地整合研究与产品开发并扩大全球运营。

6513

Gradio 数据框更新:新功能和增强

Hugging Face 已更新 Gradio 中的 gr.Dataframe 组件,新增多单元格选择、列固定、搜索与过滤功能,并提升了可访问性。

6514

Qwen2.5-VL-32B 发布说明

Qwen 已发布 Qwen2.5-VL-32B-Instruct,这是一款通过强化学习优化的视觉语言模型,具备卓越的数学推理能力、细粒度的图像理解以及符合人类偏好的响应。

6515

OpenAI 与 MIT Media Lab 关于 ChatGPT 情感使用的研究

OpenAI 与 MIT Media Lab 对情感使用——即与 AI 的情感交互——进行了研究,发现虽然此类使用在真实世界中很少见,但其对福祉的影响因用户行为、交互方式和个人情况而异。

6516

Hugging Face 推理端点分析更新

Hugging Face 更新了其推理端点分析仪表板,加入实时指标、可自定义时间范围以及详细的副本生命周期视图,以提升监控和调试能力。

6517

Booking.com 与 OpenAI 个性化集成

Booking.com 已集成 OpenAI 的 GPT 模型,通过 AI 行程规划器、智能筛选和自动化评论摘要,彻底改变旅行发现和预订方式。

6518

OpenAI 下一代音频模型 API 发布

OpenAI 在其 API 中发布了新的语音转文本和文本转语音模型,具备提升的转录准确性和可引导的合成语音,供语音代理使用。

6519

Open R1:在本地运行 OlympicCoder 7B 进行编码

Hugging Face 提供了一份指南,介绍如何使用 LM Studio 和 Continue VS Code 扩展在本地部署 OlympicCoder 7B 模型,以实现可与 Claude 3.7 Sonnet 和 GPT-4o 在 LiveCodeBench 上竞争的编码性能。

6520

Hugging Face 对白宫 AI 行动计划信息请求的回应

Hugging Face 主张开源和开放科学在 AI 开发中的根本作用,认为开源模型在性能和效率方面正日益匹配甚至超越闭源商业系统。

6521

EliseAI: 通过 OpenAI 提升住房和医疗效率

EliseAI 利用 OpenAI 的 GPT-4 和 Whisper 模型,在住房和医疗行业自动化复杂的对话工作流,以提高运营效率。

6522

ChatGPT for Business 2025年3月更新

OpenAI 在 2025 年 3 月为 ChatGPT for Business 引入了新功能,包括 Canvas、深度研究工具和 OpenAI o1 pro 模式。

6523

NVIDIA GTC 2025 物理 AI 发布:Cosmos Transfer、物理 AI 数据集和 Isaac GR00T N1

NVIDIA 已发布用于可控世界场景生成的 Cosmos Transfer、一个 15TB 物理 AI 数据集以及 Isaac GR00T N1,这是首个用于通用人形机器人推理的开放基础模型。

6524

Hugging Face Xet 存储集成

Hugging Face 已开始将仓库从 LFS 迁移到 Xet 存储,利用内容定义分块技术显著缩短了海量 AI 模型和数据集的上传与下载时间。

6525

OpenAI 对埃隆·马斯克诉讼法院裁决的回应

OpenAI 宣布,法院已驳回埃隆·马斯克申请初步禁令的请求,并驳回了他的几项主张, affirming OpenAI 对维持其非营利实体的承诺。

6526

LY Corporation 与 OpenAI 合作

LY Corporation 正在利用 OpenAI 的 API 和 GPT-4o 在其 LINE 和 Yahoo! JAPAN 平台上整合生成式 AI,预计年度销售额增加 ‰110B yen,生产力提升 ‰10B yen.

6527

Gemma 3 发行说明 / 新功能

Google 发布了 Gemma 3,这是一个多模态、多语言的开放权重 LLM 家族,参数规模从 1B 到 27B,上下文窗口可达 128k 标记。

6528

Open R1 Update #3: OlympicCoder 和代码推理洞察

Hugging Face 推出 OlympicCoder,一组在 IOI 问题上优于前沿模型的代码推理模型,并附带新数据集和训练推理模型的技术经验。

6529

OpenAI 用于构建代理的新工具

OpenAI 发布了一套新的代理构建工具,包括 Responses API、开源 Agents SDK 以及用于网页搜索、文件搜索和计算机使用的内置工具。

6530

LeRobot L2D: 世界上最大的开源自动驾驶数据集

Hugging Face 和 Yaak 发布了 Learning to Drive (L2D),这是一个多模态自动驾驶数据集,包含来自 30 个德国城市的超过 5,000 小时的驾驶数据,以实现端到端的空间智能训练。

6531

OpenAI 链式思维监控用于奖励黑客检测

OpenAI 已经发现,监控链式思维(CoT)推理可以检测前沿模型中的奖励黑客和不当行为,但直接优化 CoT 以抑制不良思维可能导致模型隐藏其意图。

6532

Nubank 集成 OpenAI GPT-4o 用于客户服务和欺诈检测

Nubank 正利用 OpenAI 的 GPT-4o 和 GPT-4o mini 自动化处理 55% 的一级客户咨询,将聊天响应时间降低 70%,并通过基于视觉的分析增强欺诈检测。

6533

边缘上的LLM推理:通过React Native运行本地LLM

Hugging Face 提供了一份全面的指南,使用 React Native 和 llama.rn 在 Android 和 iOS 上本地运行量化的 GGUF 模型,构建注重隐私的移动应用。

6534

Factory 使用 OpenAI 推理模型的软件开发平台

Factory 利用 OpenAI o1、o3-mini 和 GPT-4o 将特性开发周期提升 2-4 倍,并将上下文切换时间降低 60%。

6535

QwQ-32B 发布说明 / 新功能

Qwen 发布了 QwQ-32B,这是一个 320亿参数的推理模型,利用扩展的强化学习来实现与更大的 DeepSeek-R1 相当的性能。

6536

LaunchDarkly 的 AI 驱动产品管理方法

LaunchDarkly 首席产品与技术官 Claire Vo 阐述了 AI 如何自动化传统产品管理任务,并将角色推向商业通用管理或集成技术领导。

6537

OpenAI NextGenAI 联盟启动

OpenAI 已启动 NextGenAI,这是一个由 15 家研究机构组成的联盟,获得 $50 million 的资助、算力和 API 访问支持,以加速 AI 驱动的研究和教育。

6538

Aya Vision: 使用 8B 和 32B 模型推进多语言多模态

Cohere For AI 发布了 Aya Vision,这是一系列支持 23 种语言的开放权重视觉语言模型(8B 和 32B),在多语言多模态任务中表现优于更大的模型。

6539

Hugging Face 与 JFrog 合作以增强 AI 模型安全

Hugging Face 已将 JFrog 的扫描器集成到 Hugging Face Hub,以减少误报并在各种序列化格式中检测模型权重内的恶意代码。

6540

OpenAI 和美国国家实验室 1,000 科学家 AI Jam Session

OpenAI 和美国能源部在九个国家实验室组织了 '1,000 科学家 AI Jam Session',利用如 o3-mini 这样的前沿 AI 模型加速科学发现。

6541

使用 Arize Phoenix 对 smolagents 进行跟踪与评估

Hugging Face 演示了如何将 Arize Phoenix 与 smolagents 结合使用,以实现对代理工作流的实时跟踪和基于 LLM‑as‑a‑judge 的评估。

6542

Mercari 与 GPT-4o mini 的 AI 集成

Mercari 已将 GPT-4o mini 和其他 OpenAI 模型集成,以自动化产品列表生成并优化销售建议,从而提高了列表转化率和每位用户的平均销售额。

6543

OpenAI GPT-4.5 研究预览

OpenAI 已发布 GPT-4.5,这是一个大规模通用模型,旨在相比 GPT-4o 提供更广泛的知识、改进的情感智能和减少的幻觉。

6544

使用 o1 和 o3-mini 构建自主金融分析师

Endex 正在利用 OpenAI 的 o1 和 o3-mini 推理模型构建一个自主的 AI 金融分析师,能够进行复杂的数据合成、多模态分析和精确的金融推理。

6545

Hugging Face 和 IISc 合作开源 Vaani 数据集

Hugging Face 与印度科学院(IISc)和 ARTPARK 合作,提供对 Vaani 的全球访问,Vaani 是一个旨在代表印度语言多样性的大规模多模态多语言数据集。

6546

OpenAI Deep Research 系统卡片

OpenAI 已推出 Deep Research,这是一种由早期版本的 o3 驱动的、针对网页浏览进行了优化的代理式能力,用于执行复杂任务的多步骤互联网研究。

6547

FastRTC: 用于 Python 的实时通信库

Hugging Face 发布了 FastRTC,这是一个旨在通过处理 WebRTC 和 WebSocket 通信层来简化实时音视频 AI 应用开发的 Python 库。

6548

QwQ-Max-Preview 发布

Qwen 已推出 QwQ-Max-Preview,一个基于 Qwen2.5-Max 构建的预览推理模型,在数学、编码和 Agent 相关工作流程方面表现出色。

6549

Hugging Face 远程 VAEs 用于推理端点

Hugging Face 推出了一项实验功能,将 VAE 解码过程委托给远程端点,以降低消费级 GPU 上高分辨率图像和视频合成的显存需求。

6550

OpenAI 阻断 AI 的恶意使用

OpenAI 已发布一份报告,详细说明其阻断恶意 AI 使用的努力,重点在于防止国家关联的威胁行为者和威权政权利用 AI 进行隐蔽影响行动和网络活动。