GLM 5.2 發佈:Zhipu AI 的開源權重模型

Zhipu AI 已發佈 GLM-5.2,這是一款旨在提供易於取得且高性能智能的開源權重前沿模型。此次發佈在戰略上被定位為對日益增加的專有前沿模型限制的回應,特別是針對 Fable 模型突然受限的情況。

GLM-5.2 的關鍵技術能力

GLM-5.2 被定位為 Zhipu 迄今為止最強大的開源模型。其主要技術優勢包括:

  • 1M 上下文窗口: 該模型支持真正可用的 100 萬 token 上下文窗口,允許在單個提示詞中處理海量數據。
  • 長程任務完成能力: 它在獨立完成長程任務方面保持領先,這對於構建複雜的智能體(agentic)應用程式至關重要。
  • 程式碼編寫專業化: GLM-5.2 是 Zhipu 最強大的國內編碼模型的主要引擎。

可用性與存取方式

目前對該模型的存取採分層方式。所有 GLM Coding Plan 用戶(包括 Lite、Pro 和 Max 層級)可以立即使用。官方 API 預計將於下週上線。

戰略背景與行業影響

GLM-5.2 的發佈正值 AI 模型可取得性方面的地緣政治緊張局勢時期。發佈時間——北京時間下午 5:21——恰好與有關 Anthropic 收到政府信函禁止 Fable 的報導相符,報導中引用了其他模型無法取得的情況。

推動開源權重模型的趨勢

Hacker News 上的社群成員指出,隨著美國政府對公共模型能力施加限制,包括 MiniMax 和 Z.ai 在內的中國實驗室正呈現發佈前沿開源權重模型的趨勢。這引發了關於「激進開放」價值的討論,以防止智能被少數參與者壟斷。

"前沿智能必須保持開源、易於取得且可構建,為每一位投入的開發者服務。GLM-5.2 是 Zhipu 迄今為止最強大的開源模型。"

社群擔憂與反對觀點

雖然許多人歡迎這種開源權重方式,但一些用戶對這些模型的安全性與倫理問題提出了擔憂。這些擔憂包括:

  • 國家安全: 有建議認為非美國的智能模型應提交政府審查,以確保其符合安全標準(例如 Anthropic 或 OpenAI 的標準)。
  • 安全護欄: 質疑這些模型是否會秘密地破壞或拒絕回答可能協助網路或生物恐怖主義的答案。
  • 知識產權: 擔憂美國前沿模型的輸出是否被用於訓練中國的開源權重模型。
  • 倫理與 KYC: 對於可以下載並在本地運行模型的難以實施年齡驗證與了解客戶(KYC)協議。

目前的局限性與回饋

用戶指出,此次發佈伴隨的官方基準測試結果有所欠缺。有人推測此次發佈是為了利用 Fable 受限引發的 "Mythos drama"。根據嘗試過該模型先前版本的用戶的軼事報告,這些報告顯示雖然前景看好,但與 Claude 3.5 Sonnet 等模型相比,它們在處理複雜的全棧編碼時可能仍會面臨挑戰。

Sources