Dell Enterprise Hub 更新:本地部署 AI 模型和应用程序
Dell 与 Hugging Face 宣布了 Dell Enterprise Hub 的新版本,提供了一个完整的工具包,用于在本地部署生成式 AI 模型和应用程序。此更新使企业能够在 Dell AI 服务器和 AI PC 上推出安全的、网络内的 AI 能力,将部署时间从数周缩短至不到一小时。
针对 Dell AI 服务器的优化模型部署
Dell Enterprise Hub 提供了针对特定 Dell AI 服务器平台优化的完整测试容器,支持通过 Docker 和 Kubernetes 进行部署和训练。这种方式确保模型经过基准测试并配置,以实现最大开箱即用性能。
可用的关键模型包括:
- Meta Llama 4 Maverick(可部署在 NVIDIA H200 或 AMD MI300X Dell PowerEdge 服务器上)
- DeepSeek R1
- Google Gemma 3
为确保快速可用,Hub 与 Dell CTIO 和工程团队合作优化新发布;例如,Meta 的 Llama 4 模型在公开发布后一小时内即已在 Hub 上可用。
可直接部署的 AI 应用目录
除了原始模型外,Dell Enterprise Hub 现在还包括一个应用目录,用于在私有网络中部署开源 AI 应用程序。这些应用程序使用可定制的 Helm Chart,确保在部署期间注册 Model Context Protocol(MCP)服务器。
精选应用包括:
- OpenWebUI:实现本地部署聊天机器人助手,利用 MCP 连接内部数据和服务,支持通过向量数据库和网络搜索的 RAG(检索增强生成)用例。
- AnythingLLM:一个用于构建代理助手的平台,可连接多个 MCP 服务器。它支持多模型、图像和文档处理,以及面向内部用户的基于角色的访问控制。
多硬件加速器支持
Dell Enterprise Hub 是唯一提供跨三大 AI 加速硬件供应商的即用模型部署解决方案的平台:
- NVIDIA:搭载 H100 和 H200 GPU 的 Dell 平台。
- AMD:搭载 MI300X 的 Dell 平台。
- Intel:搭载 Gaudi 3 的 Dell 平台。
Dell AI PC 的本地设备 AI
Hub 已扩展以支持由 Intel 或 Qualcomm NPU 驱动的 Dell AI PC 本地推理。这使 IT 组织能够通过 Dell Pro AI Studio 和 Microsoft Intune 等设备管理系统,为员工提供私有的本地设备 AI 能力。
支持的本地设备功能包括:
- 语音转录:由 OpenAI Whisper 提供支持。
- 聊天助手:由 Microsoft Phi 和 Qwen 2.5 提供支持。
- 图像放大和嵌入生成。
开发者工具:CLI 与 Python SDK
为了将 Dell Enterprise Hub 集成到开发工作流中,Hugging Face 发布了 dell-ai 开源库。该库提供了 Python SDK 和命令行界面(CLI),开发者可以通过 pip install dell-ai 在终端或代码中直接与 Hub 交互。