Rio-3.5-Open-397B: 模型合併與歸屬爭議分析
Rio-3.5-Open-397B 大型語言模型由 IplanRIO(里約熱內盧市政府的 IT 公司)發布,在技術分析揭露其並非原生微調模型,而是現有模型的加權合併後,面臨了嚴格審查。這場爭議的核心在於最初缺乏對 Nex-N2 Pro 模型的歸屬說明,儘管開發者隨後更新了文件以承認此次合併。
Rio-3.5-Open-397B 的技術組成
Rio-3.5-Open-397B 是兩個現有模型的數學插值,而非從頭訓練或簡單的微調模型。技術分析指出,該模型的權重是 Nex-N2 Pro 與 Qwen3.5-397B-A17B 的線性組合。
根據社群分享的分析,所有 60 個層級以及每個網路組件的權重張量(weight tensors)皆為約 60% Nex-N2 Pro 與 40% Qwen3.5-397B-A17B 的一致混合。這一發現顯示該模型是透過數學方式合併權重而創建的,此過程不需要傳統訓練,但在某些情況下,可以透過結合基於相同架構的兩個模型的優點來提升性能。
歸屬說明與文件更新
最初,該模型被呈現為「自研」的 Qwen3.5 微調版本。然而,在一個 GitHub issue 指出其缺乏對 Nex-N2 Pro 的歸屬說明(該模型約在一週前才發布)後,開發者更新了 Hugging Face 模型頁面。
更新後的文件現在明確指出:
The model is built via a merge of https://huggingface.co/nex-agi/Nex-N2-Pro and https://huggingface.co/Qwen/Qwen3.5-397B-A17B, proceeded by On-Policy Distillation from a stronger model.
在道歉聲明中,開發者聲稱發生了「上傳錯誤」,即將基礎合併版本上傳到了公開儲存庫,而非最終的蒸餾(distilled)模型。這解釋了為什麼社群分析的版本看起來只是簡單的權重合併,而沒有聲稱的蒸餾訓練。
社群見解與背景
此事件引發了關於市政 IT 專案透明度以及現代 LLM 開發性質的重大討論。
模型合併 vs. 微調
觀察者指出,由於 Nex-N2 本身就是基於 Qwen,因此模型之間的差異很小,這可能促成了線性權重合併的成功。這引發了更廣泛的疑問:合併多個開源權重模型是否能在不需承擔完整訓練計算成本的情況下,持續產生優異的結果。
機構透明度
部分社群成員對市政 IT 部門嘗試創建高參數模型表示驚訝,而其他人則將最初缺乏歸屬說明視為透明度不足。一位觀察者指出,該模型在社群媒體上的病毒式傳播以及市長辦公室的利用,其速度可能超過了研究人員提供的技術文件。
聲明之驗證
技術評論家指出,只要上傳的版本仍是簡單的合併模型,關於「on-policy distillation」的說法就仍無法驗證。社群的共識是,只有在最終蒸餾版本的模型發布時,才能確認「自研」說法的有效性。