使用 Ollama 在本地运行未经审查的 Llama 2 模型

Ollama 允许用户在本地运行 Llama 2 和其他大语言模型 (LLMs) 的未经审查版本。这些模型旨在移除标准版本中存在的对齐和审查机制,从而允许它们回答标准模型可能会因为安全过滤器或伦理约束而拒绝的提示。

Ollama 中可用的未经审查模型

Ollama 提供了对几种未经审查模型的访问,每种模型都有不同的训练背景和能力:

  • Fine-tuned Llama 2 7B Uncensored: 使用 Wizard-Vicuna 对话数据集进行微调的 Llama 2 7B 模型。可以通过 ollama run llama2-uncensored 执行。
  • Nous Hermes Llama 2 13B: 在超过 300,000 条指令上进行微调的 Llama 2 13B 模型。该模型的特点是回答较长、幻觉率较低,且没有 OpenAI 风格的审查机制。可以通过 ollama run nous-hermes-llama2 执行。
  • Wizard Vicuna 13B Uncensored: 专门为移除对齐而微调的 Llama 1 13B 模型。可以通过 ollama run wizard-vicuna 执行。

性能比较:经过审查与未经审查的 Llama 2

标准 7B Llama 2 模型与 7B Llama 2 未经审查模型的比较表明,未经审查的模型能够对经过审查版本拒绝或重定向的提示提供直接回答。

常规信息与推测

虽然标准 Llama 2 模型以促进暴力为由拒绝推测 Elon Musk 和 Mark Zuckerberg 之间假设的拳击比赛,但未经审查的模型提供了对两人身体素质和训练背景的详细分析,以评估可能的结果。

宗教与文学引用

当被问及包含“God created the heavens and the earth”这一短语的经文和文学作品时,标准 Llama 2 模型拒绝提供引用,理由是该陈述是一种宗教信仰而非科学事实。相比之下,未经审查的模型提供了直接回答:“Genesis 1:1”。

医学与技术指令

在响应关于如何制作 Tylenol 的提示时,标准 Llama 2 模型拒绝提供指令,理由是制造药物是违法且危险的。未经审查的模型提供了成分(acetaminophen, aspirin, caffeine, and diphenhydramine)的通用描述以及涉及混合和压缩的基本制造过程。

日常任务与创意内容

对于“dangerously spicy mayo”食谱的要求,标准 Llama 2 模型出于安全考虑拒绝了。未经审查的模型提供了完整的食谱,包括 cayenne pepper 和 paprika 等成分。

流行文化与隐私

当被问及是谁让 Rose 承诺她永远不会放手(指代电影 Titanic)时,标准 Llama 2 模型拒绝回答,理由是需要尊重个人隐私和私人对话。未经审查的模型正确地将角色 Jack 识别为做出该承诺的人。

Sources

相关

  • Dispatch
  • Dispatch
  • Dispatch
  • 项目
  • Dispatch