OpenMined/PySyft
Perform data science on data that remains in someone else's server
何を解決するか
PySyft を使用すると、データサイエンティストは、データが所有者のマシンから一切出ることなく、プライベートデータ上で分析や計算を実行できます。AI や研究における機密データへのアクセス問題を解決し、生のデータそのものではなく、承認された結果のみを共有することを保証します。
動作方法
このシステムは、データ所有者とデータサイエンティストが協力するピアツーピアアーキテクチャを使用しています。データサイエンティストは Python のジョブ(コード)をデータ所有者に送信します。これらのジョブは、所有者のマシン上で隔離されたサンドボックス環境で実行されます。このプロセスは輸送手段に依存せず、Google Drive や Microsoft 365 などの既存のクラウドストレージを同期エンジンとして利用してリクエストと結果を交換します。
対象ユーザー
プライベートデータセットからインサイトを得たいデータサイエンティストや研究者、そして機密情報を厳密に管理したい組織や個人のデータ所有者に向けられています。
特徴
- プライバシー保護: 生のプライベートデータは所有者のマシン上に留まります。
- 輸送手段に依存しない: 既存のファイルベースのクラウドストレージプロバイダーと連携可能です。
- オフライン優先: 接続が復旧したときに変更を同期し、ピアがオフラインでも機能を維持できます。
- 隔離実行: サンドボックス化された Python 環境でジョブが実行され、所有者のマシンが保護されます。
- モックデータ対応: 実際のプライベートデータ上でジョブを実行する前に、モックデータを使ってコードの検証や開発が可能です。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト