quiltdata/quilt

Quilt is a Scientific Data Management Platform on AWS that helps teams and AI find, trust, and reuse data through deeply versioned, context-rich data packages.

해결하는 문제

Quilt는 과학적 데이터의 장기적인 사용 가능성을 보장하는 문제를 해결합니다. 팀과 워크플로우가 진화함에 따라 일반적으로 사라지는 맥락, 구조, 계보를 방지하여, AI 프로젝트의 진행 속도 저하와 데이터 팀의 수동 지원 업무를 피할 수 있습니다.

작동 방식

Quilt는 클라우드 데이터를 내구성 있고 검색 가능하며 재사용 가능한 "패키지"로 변환합니다. 각 패키지는 데이터와 함께 메타데이터, 문서, 버전 기록을 포함합니다. AWS 기반으로 구축되어 데이터를 이동하지 않고도 현장에서 관리할 수 있습니다.

대상 사용자

데이터의 재현성과 신뢰성이 중요한 과학 기관, 데이터 과학자, 생물정보학 워크로드를 위한 것입니다.

주요 특징

  • 심층적 버전 관리: 데이터 패키지의 버전 기록과 계보를 기록하여 재현성을 보장합니다.
  • AWS 네이티브: AWS 상의 데이터를 그대로 사용 가능하며, 엄격한 마이그레이션을 필요로 하지 않습니다.
  • Python SDK 및 CLI: S3로 패키지 생성, 설치, 업로드를 위한 도구를 제공합니다.
  • 하이브리드 모델: 오픈소스 SDK/CLI와 고급 검색 및 시각화 기능을 갖춘 엔터프라이즈 플랫폼을 모두 제공합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트