OpenMined/PySyft

Perform data science on data that remains in someone else's server

해결하는 문제

PySyft를 사용하면 데이터 과학자들이 데이터가 소유자의 기계에서 한 번도 나가지 않도록, 개인 정보가 보호된 데이터 위에서 분석과 계산을 수행할 수 있습니다. 이는 AI 및 연구를 위한 민감한 데이터 접근 문제를 해결하며, 원시 데이터 자체가 아니라 승인된 결과만 공유되도록 보장합니다.

작동 방식

이 시스템은 데이터 소유자와 데이터 과학자가 협력하는 피어 투 피어 아키텍처를 사용합니다. 데이터 과학자는 데이터 소유자에게 Python 작업(코드)을 제출합니다. 이러한 작업은 소유자의 기계에서 격리된 사전 환경에서 실행됩니다. 이 과정은 전송 수단에 독립적이며, 기존의 클라우드 스토리지(예: Google Drive 또는 Microsoft 365)를 동기화 엔진으로 사용하여 요청과 결과를 교환합니다.

대상 사용자

개인 데이터셋에서 통찰을 얻고자 하는 데이터 과학자 및 연구자, 그리고 민감한 정보를 엄격히 통제하고자 하는 조직 또는 개인의 데이터 소유자에게 적합합니다.

주요 특징

  • 개인정보 보호: 원시 개인 정보 데이터는 소유자의 기계에 그대로 유지됩니다.
  • 전송 수단 독립성: 기존의 파일 기반 클라우드 스토리지 제공업체와 호환됩니다.
  • 오프라인 우선: 연결이 복구되면 변경 사항을 동기화하여 피어가 오프라인 상태일 때도 기능을 유지할 수 있습니다.
  • 격리된 실행: 작업은 사전 환경에서 실행되어 소유자의 기계를 보호합니다.
  • 모크 데이터 지원: 데이터 과학자는 실제 개인 정보 데이터 위에서 작업을 제출하기 전에 모크 데이터를 사용하여 코드를 탐색하고 개발할 수 있습니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트