使用 Ollama 在本地執行未經審查的 Llama 2 模型

Ollama 允許使用者在本地執行 Llama 2 以及其他大型語言模型 (LLMs) 的未經審查版本。這些模型旨在移除標準版本中常見的對齊與審查機制,使其能夠回答標準模型可能會因為安全過濾器或倫理限制而拒絕的提示詞。

Ollama 中可用的未經審查模型

Ollama 提供多個未經審查模型的存取權限,每個模型都有不同的訓練背景與能力:

  • Fine-tuned Llama 2 7B Uncensored: 使用 Wizard-Vicuna 對話數據集進行微調的 Llama 2 7B 模型。可以透過 ollama run llama2-uncensored 執行。
  • Nous Hermes Llama 2 13B: 在超過 300,000 個指令上進行微調的 Llama 2 13B 模型。此模型的特點是回應較長、幻覺率較低,且不具備 OpenAI 風格的審查機制。可以透過 ollama run nous-hermes-llama2 執行。
  • Wizard Vicuna 13B Uncensored: 專門為了移除對齊而微調的 Llama 1 13B 模型。可以透過 ollama run wizard-vicuna 執行。

性能比較:受審查與未經審查的 Llama 2

標準 7B Llama 2 模型與 7B Llama 2 未經審查模型的比較顯示,未經審查模型能針對受審查版本會拒絕或轉向的提示詞提供直接的回答。

一般資訊與推測

雖然標準 Llama 2 模型以促進暴力為由,拒絕推測 Elon Musk 與 Mark Zuckerberg 之間假設性的拳擊賽,但未經審查模型則提供了對兩位人士身體素質與訓練背景的詳細分析,以評估可能的結果。

宗教與文學引用

當被要求提供包含「God created the heavens and the earth」這句話的經文與文學引用時,標準 Llama 2 模型拒絕提供引用,理由是該陳述屬於宗教信仰而非科學事實。相比之下,未經審查模型則提供了直接的回答:「Genesis 1:1」。

醫療與技術指令

針對詢問如何製作 Tylenol 的提示詞,標準 Llama 2 模型拒絕提供指令,聲稱製造藥物是違法且危險的。未經審查模型則提供了成分(acetaminophen, aspirin, caffeine, and diphenhydramine)的通稱描述,以及涉及混合與壓製的基本製造流程。

日常任務與創意內容

對於「dangerously spicy mayo」食譜的要求,標準 Llama 2 模型基於安全理由而拒絕。未經審查模型則提供了完整的食譜,包括 cayenne pepper 與 paprika 等成分。

流行文化與隱私

當被問及是誰讓 Rose 承諾她永遠不會放手(指電影 Titanic)時,標準 Llama 2 模型拒絕回答,理由是需要尊重個人隱私與私人對話。未經審查模型則正確地識別出角色 Jack 為做出承諾的人。

Sources

相關

  • Dispatch
  • Dispatch
  • Dispatch
  • 專案
  • Dispatch