Dell Enterprise Hub 更新:本地部署 AI 模型和应用程序

Dell 与 Hugging Face 宣布了 Dell Enterprise Hub 的新版本,提供了一个完整的工具包,用于在本地部署生成式 AI 模型和应用程序。此更新使企业能够在 Dell AI 服务器和 AI PC 上推出安全的、网络内的 AI 能力,将部署时间从数周缩短至不到一小时。

针对 Dell AI 服务器的优化模型部署

Dell Enterprise Hub 提供了针对特定 Dell AI 服务器平台优化的完整测试容器,支持通过 Docker 和 Kubernetes 进行部署和训练。这种方式确保模型经过基准测试并配置,以实现最大开箱即用性能。

可用的关键模型包括:

  • Meta Llama 4 Maverick(可部署在 NVIDIA H200 或 AMD MI300X Dell PowerEdge 服务器上)
  • DeepSeek R1
  • Google Gemma 3

为确保快速可用,Hub 与 Dell CTIO 和工程团队合作优化新发布;例如,Meta 的 Llama 4 模型在公开发布后一小时内即已在 Hub 上可用。

可直接部署的 AI 应用目录

除了原始模型外,Dell Enterprise Hub 现在还包括一个应用目录,用于在私有网络中部署开源 AI 应用程序。这些应用程序使用可定制的 Helm Chart,确保在部署期间注册 Model Context Protocol(MCP)服务器。

精选应用包括:

  • OpenWebUI:实现本地部署聊天机器人助手,利用 MCP 连接内部数据和服务,支持通过向量数据库和网络搜索的 RAG(检索增强生成)用例。
  • AnythingLLM:一个用于构建代理助手的平台,可连接多个 MCP 服务器。它支持多模型、图像和文档处理,以及面向内部用户的基于角色的访问控制。

多硬件加速器支持

Dell Enterprise Hub 是唯一提供跨三大 AI 加速硬件供应商的即用模型部署解决方案的平台:

  • NVIDIA:搭载 H100 和 H200 GPU 的 Dell 平台。
  • AMD:搭载 MI300X 的 Dell 平台。
  • Intel:搭载 Gaudi 3 的 Dell 平台。

Dell AI PC 的本地设备 AI

Hub 已扩展以支持由 Intel 或 Qualcomm NPU 驱动的 Dell AI PC 本地推理。这使 IT 组织能够通过 Dell Pro AI Studio 和 Microsoft Intune 等设备管理系统,为员工提供私有的本地设备 AI 能力。

支持的本地设备功能包括:

  • 语音转录:由 OpenAI Whisper 提供支持。
  • 聊天助手:由 Microsoft Phi 和 Qwen 2.5 提供支持。
  • 图像放大和嵌入生成

开发者工具:CLI 与 Python SDK

为了将 Dell Enterprise Hub 集成到开发工作流中,Hugging Face 发布了 dell-ai 开源库。该库提供了 Python SDK 和命令行界面(CLI),开发者可以通过 pip install dell-ai 在终端或代码中直接与 Hub 交互。

Sources