OpenAI 正在为 AI 的恶意使用做准备
OpenAI 与人类未来研究院、存在风险研究中心、新美国安全中心、电子前线基金会以及其他合作伙伴共同发表了一份研究论文,预测恶意行为者可能滥用 AI 技术的潜在风险。此工作旨在提供一个框架,以防止和减轻因攻击成本降低、新漏洞产生以及攻击归因难度增加而导致的全球安全威胁。
AI 作为全球安全挑战
AI 技术构成安全风险,因为它降低了执行现有攻击的成本,同时引入了新的漏洞,并使特定攻击的归因变得更加复杂。报告将 AI 识别为双用技术,意味着它既可以用于巨大的积极应用,也可以用于巨大的消极应用。
双用性质与风险评估
由于 AI 工具既可以用于公共利益也可以用于造成危害,社区必须评估研究项目是否可能被恶意行为者滥用。双用风险的示例包括:
- 监控工具:这些工具可用于抓捕恐怖分子或压迫普通公民。
- 信息内容过滤器:这些过滤器可用于掩盖假新闻或操纵公众舆论。
为了降低这些风险,报告建议对特定研究进行发布前风险评估,选择性地与可信组织共享敏感研究,并在科学界建立关于双用问题的规范。
缓解策略与建议
报告为公司、研究机构、从业者和政府提供了高层次的建议,以确保更安全的 AI 环境。
从网络安全实践中学习
AI 研究者应采纳计算机安全社区的实践来识别和防范威胁。推荐的实践包括:
- 红队演练:故意尝试突破或破坏系统以发现弱点。
- 技术预测:投资于预测工作,以在威胁出现之前识别它们。
- 保密报告:建立惯例,以保密方式报告在 AI 系统中发现的漏洞。
拓宽社会讨论
由于 AI 将改变全球威胁格局,关于其安全与防卫的讨论必须涉及更广泛的社会群体,包括国家安全专家、伦理学家、民间社会、企业以及普通公众。
AI 滥用的具体情景
为了使理论风险具体化,报告列出了几种 AI 可能被滥用的具体情景:
- 有针对性的说服:针对安全系统管理员的 AI 生成说服性广告。
- 自动化网络攻击:网络犯罪分子使用神经网络和 "fuzzing" 技术来创建具有自动漏洞生成能力的计算机病毒。
- 自动化物理攻击:黑客入侵清洁机器人,向 VIP 投递爆炸物有效载荷。
- 预测监控:流氓国家使用 AI 增强的监控系统,基于预测风险档案提前逮捕人员。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch