Dell Enterprise Hub 업데이트: 온프레미스 AI 모델 및 애플리케이션

Dell과 Hugging Face는 Dell Enterprise Hub의 새로운 버전을 발표했으며, 온프레미스에서 생성 AI 모델 및 애플리케이션을 배포하기 위한 포괄적인 툴킷을 제공합니다. 이번 업데이트를 통해 기업은 Dell AI 서버와 AI PC에서 보안된 네트워크 내 AI 기능을 롤아웃할 수 있게 되며, 배포 기간을 몇 주에서 1시간 이하로 단축합니다.

Dell AI 서버용 최적화된 모델 배포

Dell Enterprise Hub는 특정 Dell AI 서버 플랫폼에 최적화된 완전 테스트된 컨테이너를 제공하여 Docker와 Kubernetes를 통해 배포 및 학습을 가능하게 합니다. 이 접근 방식은 모델이 벤치마크되고 최대 즉시 사용 성능을 위해 구성되도록 보장합니다.

주요 제공 모델은 다음과 같습니다:

  • Meta Llama 4 Maverick (NVIDIA H200 또는 AMD MI300X Dell PowerEdge 서버에 배포 가능)
  • DeepSeek R1
  • Google Gemma 3

신속한 가용성을 보장하기 위해, 허브는 Dell CTIO 및 엔지니어링 팀과 협력하여 새로운 릴리스를 최적화합니다; 예를 들어, Llama 4 모델은 Meta가 공개한 지 한 시간 이내에 허브에서 사용할 수 있게 되었습니다.

즉시 배포 가능한 AI 애플리케이션 카탈로그

순수 모델을 넘어, Dell Enterprise Hub는 이제 프라이빗 네트워크 내에서 오픈소스 AI 애플리케이션을 배포하기 위한 애플리케이션 카탈로그를 포함합니다. 이러한 애플리케이션은 사용자 정의 가능한 helm 차트를 활용하여 배포 중에 Model Context Protocol (MCP) 서버가 등록되도록 보장합니다.

주요 애플리케이션은 다음과 같습니다:

  • OpenWebUI: 온프레미스 챗봇 어시스턴트를 배포할 수 있게 하며, MCP를 활용해 내부 데이터와 서비스에 연결하고, 벡터 데이터베이스 및 웹 검색을 통한 RAG(검색 기반 생성) 사용 사례를 지원합니다.
  • AnythingLLM: 다중 MCP 서버에 연결되는 에이전트형 어시스턴트를 구축하기 위한 플랫폼입니다. 여러 모델, 이미지 및 문서 처리, 그리고 내부 사용자를 위한 역할 기반 접근 제어를 지원합니다.

다중 하드웨어 가속기 지원

Dell Enterprise Hub는 세 주요 AI 가속기 하드웨어 공급업체 전반에 걸쳐 즉시 사용 가능한 모델 배포 솔루션을 제공하는 유일한 플랫폼입니다:

  • NVIDIA: H100 및 H200 GPU 기반 Dell 플랫폼.
  • AMD: MI300X 기반 Dell 플랫폼.
  • Intel: Gaudi 3 기반 Dell 플랫폼.

Dell AI PC용 온디바이스 AI

허브는 Intel 또는 Qualcomm NPU 기반 Dell AI PC용 온디바이스 추론을 지원하도록 확장되었습니다. 이를 통해 IT 조직은 Dell Pro AI Studio와 Microsoft Intune과 같은 장비 관리 시스템을 통해 관리되는 사설 온디바이스 AI 기능을 직원에게 제공할 수 있습니다.

지원되는 온디바이스 기능은 다음과 같습니다:

  • Speech transcription: OpenAI Whisper 기반.
  • Chat assistants: Microsoft Phi 및 Qwen 2.5 기반.
  • Image upscaling and embedding generation.

개발자 도구: CLI 및 Python SDK

Dell Enterprise Hub를 개발 워크플로에 통합하기 위해, Hugging Face는 dell-ai 오픈소스 라이브러리를 출시했습니다. 이 라이브러리는 Python SDK와 명령줄 인터페이스(CLI)를 제공하여 개발자가 터미널이나 pip install dell-ai를 통해 코드에서 직접 허브와 상호작용할 수 있게 합니다.

Sources