Qwen 3.8 27B 逆向工程能力
本地 LLM 达到前沿水平的逆向工程能力
Qwen 3.8 27B 可以执行以前仅限于前沿云端模型的复杂逆向工程任务,包括解构商业许可方案和生成可用的身份验证绕过方案。在一次真实测试中,该模型在完全运行于本地硬件的情况下,成功分析了一个商业二进制文件,恢复了被混淆的加密密钥,并在大约 30 分钟内生成了一个功能性的概念验证绕过程序。
静态分析与密钥恢复
Qwen 3.8 27B 在最终验证步骤之前从未执行过目标应用程序。该过程完全依赖于静态分析:
- 反汇编: 模型对框架进行了反汇编,并分析了数千行 arm64 代码。
- 映射: 它将安全函数映射到其各自的调用点。
- 密钥提取: 模型识别并恢复了一个供应商故意在二进制文件中混淆的公钥验证密钥。
- 架构映射: 它记录了完整的身份验证流程,包括初始在线激活、离线签名检查、硬件序列号绑定、嵌入式吊销列表以及已签名的更新路径。
自我修正与推理持久性
该模型成功的关键组件在于其无需人工干预即可自我修正的能力。在密钥恢复过程中,模型最初产生了一个通过签名检查但未能通过二进制完整性哈希检查的密钥。Qwen 3.8 27B 没有接受这种部分成功,而是识别出了不匹配之处,并对其分析进行了迭代,直到恢复的值与目标值完全一致(逐字节匹配)。
这种持久性归功于模型的高推理强度设置,虽然这种设置比较冗长且消耗 token,但能确保技术任务具有更高的准确度。
硬件与性能基准
测试是在配备 Nvidia GB10 Grace Blackwell 芯片和 128 GB 统一内存的 Lenovo ThinkStation PGX 上进行的。性能指标包括:
- 吞吐量: 通过结合使用 SGLang、NVFP4 和 DFlash2 推测解码技术,该模型在代码和推理任务上的速度达到了约每秒 50 个 token。
- 显存占用: 模型可在 17 GB VRAM 内运行。
- 工具链: 模型通过 Pi harness 进行操作,并利用标准的基于 Bash 的工具进行分析。
对软件安全与威胁模型的意义
一个 27B 参数模型在本地执行这些任务的能力,改变了专有软件的威胁模型。由于模型是在离线状态下运行,因此不存在基于云端的防护栏、使用限制或远程监控来阻止对机密代码的分析或绕过程序的创建。
行业观点
技术社区的讨论突出了关于这一能力的几个关键结论:
- 本地可执行文件的终结: 一些开发者认为,这些工具的可获得性使得销售独立桌面可执行文件的传统商业模式难以为继,因为任何智能逻辑都可以被快速逆向工程。
"With widely available LLMs I think that business model is truly dead... If you ever come out with something smart again there is no way I am shipping it as executable. SaaS it is for better or worse."
持久性胜过原始智能: 观察者指出,“真正的故事”不仅在于模型的智能程度,,而是它能够验证自己的工作并跟进处理复杂的、多步骤的技术失败。
对比其他模型: 虽然 Qwen 3.8 27B 能力非常出色,但一些用户报告称,其他模型(例如 Deepseek-v4-flash)在特定的逆向工程基准测试中表现可能更好。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch