Hugging Face と VirusTotal のセキュリティ協力

Hugging Face と VirusTotal は提携し、Hugging Face Hub 全体で脅威インテリジェンススキャンを統合しました。この協力により、220 万件以上の公開モデルおよびデータセットリポジトリすべてが継続的にスキャンされ、機械学習コミュニティを悪意あるまたは改ざんされたアセットから保護します。

AI モデル配布におけるセキュリティリスク

AI モデルは複雑なデジタルアーティファクトであり、しばしば大きなバイナリファイル、シリアライズされたデータ、依存関係を含みます。これらの特性は、以下のようなセキュリティ脅威のベクトルを生み出します。

  • 悪意あるペイロード: モデルファイルに偽装されたファイルやアーカイブ。
  • 改ざんされたアセット: アップロード前に改ざんされたファイル。
  • 既知のマルウェア: 既存のマルウェアキャンペーンに関連するバイナリアセット。
  • 安全でない実行: 読み込み時に悪意あるコードを実行する依存関係やシリアライズオブジェクト。

VirusTotal 統合の技術的実装

Hugging Face Hub は、ユーザーがリポジトリ、ファイル、またはディレクトリページを閲覧すると、自動的に VirusTotal の情報を取得します。統合は以下の仕組みで動作します。

  • ハッシュ比較: Hub はファイルハッシュを VirusTotal の脅威インテリジェンスデータベースと比較します。
  • ステータス取得: ファイルハッシュが以前に VirusTotal によって分析されている場合、システムはそのステータス(クリーンまたは悪意あり)を取得します。
  • プライバシー保護: ユーザーのプライバシーとデータ保護原則の遵守のため、ファイルの生データは VirusTotal と共有されません。
  • メタデータ提供: 結果は、検出件数、既知の悪質関係、および該当する場合は関連する脅威キャンペーンインテリジェンスをユーザーに提供します。

コミュニティと組織へのメリット

VirusTotal インテリジェンスを Hugging Face Hub に統合することで、コミュニティに対して以下のような重要な利点が提供されます。

  • 透明性: ユーザーは、ファイルが VirusTotal エコシステム内でフラグ付けされたか分析されたかを即座に確認できます。
  • ワークフローの安全性: 組織はこれらの VirusTotal チェックを CI/CD やデプロイパイプラインに組み込んで、悪意あるアセットのデプロイを防止できます。
  • 効率性: 既存の VirusTotal インテリジェンスを活用することで、同一アセットの冗長または繰り返しスキャンが不要になります。
  • 信頼性: この協力は、Hugging Face Hub をオープンソース AI コラボレーションのための、より安全で信頼できる環境にすることを目指しています。

Sources