Hugging Face OpenClaw 遷移指南

Hugging Face 已推出指南,協助使用者將 OpenClaw、Pi 或 Open Code 代理遷移至開源模型,因 Anthropic 決定限制 Pro/Max 訂閱者在開放代理平台上使用 Claude 模型的存取。

OpenClaw 代理的遷移選項

使用者可透過 Hugging Face 推理提供者的託管開源模型,或在自有硬體上本地執行模型,恢復代理功能。

Hugging Face 推理提供者

推理提供者提供最快速的方式來恢復代理功能,尤其是對於缺乏本地運行模型所需硬體的使用者。此平台將請求路由至開源模型的提供者。

設定流程:

  1. 在設定中建立 Hugging Face 令牌。
  2. 使用以下指令初始化連線:openclaw onboard --auth-choice huggingface-api-key
  3. 在提示時選擇模型。Hugging Face 推薦 GLM-5,因其在 Terminal Bench 上的高效能。

設定: 使用者可透過在 OpenClaw 設定檔中指定 repo_id 來更新模型:

{
  "agents": {
    "defaults": {
      "model": {
        "primary": "huggingface/zai-org/GLM-5:fastest"
      }
    }
  }
}

HF PRO 訂閱者每月可獲得 2 美元的免費額度,用於推理提供者的使用。

使用 llama.cpp 的本地模型設定

在本地運行模型可提供完整的隱私、零 API 成本,且無速率限制。

安裝:

  • macOS/Linux: brew install llama.cpp
  • Windows: winget install llama.cpp

執行: 使用者可使用以下指令啟動內建 Web UI 的本地伺服器: llama-server -hf unsloth/Qwen3.5-35B-A3B-GGUF:UD-Q4_K_XL

對於此特定模型 (Qwen3.5-35B-A3B),建議使用 32 GB 記憶體。使用者可在 Hugging Face Hub 瀏覽數千個 GGUF 模型,以找到與其硬體相容的模型。

OpenClaw 整合: 若要將 OpenClaw 連接至本地的 llama.cpp 實例,請使用以下設定指令:

openclaw onboard --non-interactive \
   --auth-choice custom-api-key \
   --custom-base-url "http://127.0.0.1:8080/v1" \
   --custom-model-id "unsloth-qwen3.5-35b-a3b-gguf" \
   --custom-api-key "llama.cpp" \
   --secret-input-mode plaintext \
   --custom-compatibility openai

可透過 curl 進行驗證:curl http://127.0.0.1:8080/v1/models

比較:託管 vs. 本地部署

功能 Hugging Face 推理提供者 本地設定 (llama.cpp)
設定速度 最快 較慢
成本 基於 API(含部分免費額度) 零 API 成本
隱私 供應商託管 完全本地控制
硬體 不需要本地硬體 需要相容的硬體
速率限制 受供應商限制 無速率限制

Sources