ArgusRed: 用于安全扫描和渗透测试的后训练 AI 模型

ArgusRed 是一款专门设计的安全工具,旨在执行自动化安全审计和渗透测试。与通常由于安全过滤器而拒绝生成漏洞利用代码或分析漏洞的通用大语言模型 (LLMs) 不同,ArgusRed 使用专门针对攻击性安全进行后训练的模型,以识别并证明授权系统中的漏洞。

双模式安全分析

ArgusRed 通过 CLI 运行,具有两种不同的模式:安全扫描 (Security Scan) 和渗透测试 (Pen Test)。每种模式在漏洞管理生命周期中承担不同的职责。

安全扫描 (Security Scan,静态分析)

Security Scan 模式通过读取代码库来识别潜在漏洞。它专注于将发现结果建立在实际代码的基础上,以避免“基于感觉”的报告。扫描涵盖了多个模块,包括:

  • 依赖项漏洞分析
  • 密钥与凭据检测
  • SQL 注入与 XSS 向量
  • 输入验证与清理
  • 文件权限与访问控制

关键性能指标:

  • Bank of Anthos (~30k LOC): 大约 10 分钟完成。
  • Symfony (~1.5M LOC): 大约 40 分钟完成。

渗透测试 (Pen Test,主动利用)

Pen Test 模式从理论上的漏洞识别转向主动利用。它尝试在用户已明确授权的运行系统中重现发现的结果。

为了防止滥用,Pen Test 模式受限于预约流程,其中目标、时间窗口和授权操作都会被记录在案。Agent 的网络出口被严格限制在授权的目标列表内。

漏洞利用验证与安全机制

ArgusRed 的独特之处在于提供“漏洞利用验证 (Exploit Verification)”,允许用户证明漏洞确实存在,而不是依赖于理论报告。

验证环境

用户可以选择 Agent 如何重现发现的结果:

  • Docker: 重现过程在从仓库启动的临时、隔离的容器中运行,确保宿主系统不受影响。
  • Live FS: 重现过程针对实际检出的代码运行。为了保持安全性,一个 Go harness 拦截了所有写操作,使代码保持只读。
  • Disabled: 工具以仅报告模式运行。

Go 安全防护套件 (Go Safety Harness)

ArgusRed 的安全性并非通过一系列基于提示词的拒绝来实现,而是通过位于模型下方的确定性 Go harness 实现。该 harness 拦截每一次工具调用,并在执行前进行处理:

  • 在 Security Scan 模式下: 无论模型的请求如何,harness 都会拦截所有具有破坏性的工具,例如文件写入或命令执行。
  • 在 Pen Test 模式下: harness 会将网络请求限制在预定义的授权目标内。

模型架构与分发

ArgusRed 是一款基于 Cosine 后训练模型的闭源二进制工具。开发者表示,现成的 API 不足以满足需求,因为它们经常拒绝执行必要的攻击性安全任务。

部署与访问

  • 安装: 可通过 Homebrew (brew install CosineAI/argusred/argusred) 或 curl 脚本进行安装。
  • 隐私: 二进制文件在用户的本地机器上运行,允许用户在防火墙后运行它,并通过 tcpdump 监控流量以验证其行为。
  • 定价: 新账户在首次运行时可获得 200 万个免费 token。随后的扫描将根据 Cosine 的使用量计费。Pen Test 任务的定价基于预约过程中确定的范围和工作量级别。

Sources