Rio-3.5-Open-397B: 模型合并与归属争议分析
Rio-3.5-Open-397B 大语言模型由 IplanRIO(里约热内卢市的 IT 公司)发布,在技术分析揭示其并非原生微调模型,而是现有模型的加权合并模型后,面临了审查。争议的焦点在于最初未对 Nex-N2 Pro 模型进行归属说明,尽管开发者随后更新了文档以承认这一合并行为。
Rio-3.5-Open-397B 的技术构成
Rio-3.5-Open-397B 是两个现有模型的数学插值,而非从头开始训练的模型或简单的微调模型。技术分析表明,该模型的权重是 Nex-N2 Pro 和 Qwen3.5-397B-A17B 的线性组合。
根据社区分享的分析,所有 60 个层级和每个网络组件的权重张量都是约 60% Nex-N2 Pro 和 40% Qwen3.5-397B-A17B 的一致混合。这一发现表明,该模型是通过数学方式合并权重创建的,这一过程不需要传统的训练,但在某些情况下,可以通过结合基于相同架构的两个模型的优势来增强性能。
归属与文档更新
最初,该模型被呈现为一种“自研”的 Qwen3.5 微调模型。然而,在 GitHub issue 强调了对 Nex-N2 Pro(该模型在大约一周前于 Rio 的模型发布)缺乏归属说明后,开发者更新了 Hugging Face 模型页面。
更新后的文档现在明确指出:
该模型是通过合并 https://huggingface.co/nex-agi/Nex-N2-Pro 和 https://huggingface.co/Qwen/Qwen3.5-397B-A17B 构建的,并随后通过来自更强模型的 On-Policy Distillation 进行处理。
在道歉中,开发者声称发生了“上传错误”,即基础合并版本被上传到了公共仓库,而不是最终的蒸馏模型。这解释了为什么社区分析的版本看起来只是一个简单的权重合并,而没有声称的蒸馏训练。
社区见解与背景
该事件引发了关于市政 IT 项目透明度以及现代 LLM 开发性质的重大讨论。
模型合并 vs. 微调
观察者指出,由于 Nex-N2 本身基于 Qwen,模型之间的差异很小,这可能有助于线性权重合并的成功。这引发了更广泛的问题,即合并多个开源权重模型是否可以在无需承担全量训练计算成本的情况下,持续产生更优的结果。
机构透明度
一些社区成员对市政 IT 部门尝试创建高参数模型表示惊讶,而其他人则将最初缺乏归属说明视为透明度缺失。一位观察者指出,该模型在社交媒体上的病毒式增长以及市长办公室的利用,可能已经超过了研究人员提供的技术文档的进度。
声明的验证
技术批评者指出,只要上传的版本是简单的合并模型,关于“on-policy distillation”的声明就仍然无法验证。社区的共识是,只有在最终蒸馏版本的模型发布时,才能确认“自研”声明的有效性。