volcano-sh/volcano

A Cloud Native Batch System (Project under CNCF)

해결하는 문제

Volcano는 고성능 배치 및 탄력적 워크로드를 처리할 때 발생하는 표준 Kubernetes 스케줄러의 한계를 해결하기 위해 설계되었습니다. 대규모 클러스터 전반에 걸쳐 효율적인 리소스 할당 및 최적화가 필요한 AI, 머신러닝, 딥러닝 및 빅데이터 애플리케이션에 필요한 전문적인 스케줄링 기능을 제공합니다.

작동 방식

Volcano는 표준 kube-scheduler를 확장 및 강화하여 Kubernetes 네이티브 배치 스케줄링 시스템을 구축합니다. 다양한 AI 및 HPC 프레임워크(PyTorch, TensorFlow, Ray, Spark 등)와 통합하여 이러한 워크로드가 클러스터 전체에 어떻게 분산되는지를 관리하며, 고성능 컴퓨팅(HPC)의 베스트 프랙티스를 클라우드 네이티브 환경에 통합합니다.

대상 사용자

Kubernetes에서 대규모 AI/ML 학습, 생물정보학, 유전체학 및 빅데이터 분석 플랫폼을 운영하는 엔지니어 및 조직, 특히 Kubeflow, Spark 또는 Flink와 같은 프레임워크를 사용하는 사용자를 대상으로 합니다.

주요 특징

  • 폭넓은 프레임워크 통합: PyTorch, TensorFlow, Ray, Spark, Flink 및 MPI에 대한 강력한 지원.
  • CNCF Incubating Project: Cloud Native Computing Foundation 생태계의 일부.
  • 고성능 중심: AI, 딥러닝 및 LLM 학습 워크플로에 특화되어 최적화됨.
  • Cloud-native 아키텍처: 클러스터 리소스 관리와의 원활한 통합을 보장하기 위해 Kubernetes 네이티브 시스템으로 구축됨.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트