OpenAI 打击 AI 恶意使用 2025年10月更新
自2024年2月以来,OpenAI 已中断并报告了超过40个违反其使用政策的网络。此举旨在防止专制政权利用 AI 进行人口控制或国家胁迫,同时减轻诈骗、恶意网络活动和隐蔽影响行动的危害。
威胁行为者剧本中的 AI 集成
威胁行为者目前正将 AI 融入现有攻击方法,以提升其操作速度,而不是使用模型来创建全新的攻击能力。OpenAI 观察到,AI 正被“附加到旧剧本”上,使恶意行为者能够更快行动。
检测与缓解策略
OpenAI 采用账户执法与信息共享相结合的方式来中断恶意活动。当检测到使用政策违规时,公司会采取以下措施:
- 账户封禁:发现参与违规活动的账户将被封禁。
- 合作伙伴协作:在适当情况下,将有关威胁行为者行为的洞察与合作伙伴共享。
- 公开报告:OpenAI 发布威胁情报报告,以提升对滥用行为的认识并改进对普通用户群体的保护。
中断活动的范围
中断工作针对以下几类特定的恶意使用:
- 国家关联威胁:防止专制政权利用 AI 对其他国家进行胁迫或控制本国人口。
- 网络活动:中断恶意网络行动。
- 影响行动:识别并阻止隐蔽的影响行动。
- 金融欺诈:防止利用 AI 进行诈骗。
OpenAI 表示,这些行动是其更广泛使命的一部分,即通过构建基于常识规则、保护用户免受实际危害的民主 AI,确保通用人工智能惠及全人类。