OpenAI 打击 AI 恶意使用 2025年10月更新

自2024年2月以来,OpenAI 已中断并报告了超过40个违反其使用政策的网络。此举旨在防止专制政权利用 AI 进行人口控制或国家胁迫,同时减轻诈骗、恶意网络活动和隐蔽影响行动的危害。

威胁行为者剧本中的 AI 集成

威胁行为者目前正将 AI 融入现有攻击方法,以提升其操作速度,而不是使用模型来创建全新的攻击能力。OpenAI 观察到,AI 正被“附加到旧剧本”上,使恶意行为者能够更快行动。

检测与缓解策略

OpenAI 采用账户执法与信息共享相结合的方式来中断恶意活动。当检测到使用政策违规时,公司会采取以下措施:

  • 账户封禁:发现参与违规活动的账户将被封禁。
  • 合作伙伴协作:在适当情况下,将有关威胁行为者行为的洞察与合作伙伴共享。
  • 公开报告:OpenAI 发布威胁情报报告,以提升对滥用行为的认识并改进对普通用户群体的保护。

中断活动的范围

中断工作针对以下几类特定的恶意使用:

  • 国家关联威胁:防止专制政权利用 AI 对其他国家进行胁迫或控制本国人口。
  • 网络活动:中断恶意网络行动。
  • 影响行动:识别并阻止隐蔽的影响行动。
  • 金融欺诈:防止利用 AI 进行诈骗。

OpenAI 表示,这些行动是其更广泛使命的一部分,即通过构建基于常识规则、保护用户免受实际危害的民主 AI,确保通用人工智能惠及全人类。

Sources