OpenAI 打击 AI 恶意使用报告 2025年6月
OpenAI 正在利用 AI 驱动的调查工具来检测和阻止诸如隐蔽影响行动、网络间谍和社会工程等恶意活动。这种方法充当专家团队的力量倍增器,使其能够更高效地识别和曝光滥用行为。
AI 安全与治理的战略框架
OpenAI 在一个框架下运作,该框架通过常识性规则和民主 AI 的发展,优先保护人们免受实际伤害。该策略侧重于防止专制政权利用 AI 工具巩固权力、控制公民或胁迫其他国家。
防止 AI 滥用的关键关注领域包括:
- 隐蔽影响行动(IO)
- 儿童剥削
- 诈骗和垃圾信息
- 恶意网络活动
最近的干预与案例研究
在2025年6月报告之前的三个月里,OpenAI 的调查团队使用 AI 检测并曝光了多类滥用活动。通过将 AI 融入其防御机制,组织成功阻止了以下行为:
- 隐蔽影响行动: 识别旨在操纵公众舆论的欺骗性活动。
- 网络间谍: 检测使用 AI 进行未授权数据访问或情报收集的尝试。
- 社会工程: 防止依赖心理操纵欺骗用户的攻击。
- 欺骗性招聘计划: 曝光用于诈骗或数据窃取的虚假职位邀请。
- 一般诈骗: 阻止各种基于 AI 的欺诈活动。
与美国 AI 行动计划的对齐
这些努力与 OpenAI 于三月向科学技术政策办公室提交的美国 AI 行动计划相一致。组织认为,确保 AI 造福人类需要双重方法:制定防止伤害的规则,并部署 AI 工具以赋能那些抵御系统性滥用的防御者。