Hugging Face 与 VirusTotal 安全合作
Hugging Face 与 VirusTotal 已合作,在 Hugging Face Hub 上集成威胁情报扫描。此合作确保对 220 万以上的公开模型和数据集仓库进行持续扫描,以保护机器学习社区免受恶意或受损资产的影响。
AI 模型分发中的安全风险
AI 模型是复杂的数字工件,通常包含大型二进制文件、序列化数据和依赖项。这些特性会产生安全威胁的向量,包括:
- 恶意负载: 伪装成模型文件的文件或压缩包。
- 受损资产: 在上传前已被篡改的文件。
- 已知恶意软件: 与已知恶意软件活动关联的二进制资产。
- 不安全执行: 在加载时会执行恶意代码的依赖项或序列化对象。
VirusTotal 集成的技术实现
现在,当用户访问仓库、文件或目录页面时,Hugging Face Hub 会自动检索 VirusTotal 信息。该集成通过以下机制实现:
- 哈希比对: Hub 将文件哈希与 VirusTotal 威胁情报数据库进行比对。
- 状态获取: 如果文件哈希已被 VirusTotal 分析,系统会检索其状态(干净或恶意)。
- 隐私保护: 为维护用户隐私并遵守数据保护原则,不会向 VirusTotal 共享原始文件内容。
- 元数据提供: 结果向用户提供检测计数、已知不良关联以及(如适用)相关的威胁活动情报。
社区与组织的收益
将 VirusTotal 情报集成到 Hugging Face Hub 为社区提供了若干关键优势:
- 透明性: 用户可立即了解文件是否已在 VirusTotal 生态系统中被标记或分析。
- 工作流安全: 组织可以将这些 VirusTotal 检查纳入 CI/CD 或部署流水线,以防止恶意资产的部署。
- 效率: 利用现有的 VirusTotal 情报可消除对相同资产的冗余或重复扫描需求。
- 信任: 此合作旨在使 Hugging Face Hub 成为更安全、可靠的开源 AI 合作环境。